{"as_of":"2026-08-14T13:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dda0459d7d3bbe4ab419b245ee2ad2743b361802f900c98a45531c502ca2bdf5","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T23:13:14.037650Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-02T14:47:26.322568Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T14:57:03.912343Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"cited_work":{"arxiv_id":"2502.04223","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04223","snapshot_observed_at":"2026-07-02T14:57:03.912343Z","title":"2502.04223 , archivePrefix=","venue":null,"work_id":"f552926a-d1de-45cc-963d-6515bc6e356c","year":2025},"citing_paper":{"arxiv_id":"2512.20856","last_updated":"2025-12-24T00:24:05Z","snapshot_observed_at":"2026-08-13T13:01:14.159027Z","submitted_at":"2025-12-24T00:24:05Z","title":"NVIDIA Nemotron 3: Efficient and Open Intelligence","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-18T01:40:42.190369Z"},"links":{"cited_paper":"/paper/2502.04223","citing_paper":"/paper/2512.20856"},"observation_digest":"sha256:55801ac18e01298f7fd90d96f60c89ea25f76c612a65b0182b6971a8fba60f07","observation_id":"a3305fff-7133-48f0-a338-3f8c60f09a65","resolution":{"observed_at":"2026-05-18T01:40:42.413510Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"cited_work":{"arxiv_id":"2502.04223","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04223","snapshot_observed_at":"2026-07-02T14:57:03.912343Z","title":"2502.04223 , archivePrefix=","venue":null,"work_id":"f552926a-d1de-45cc-963d-6515bc6e356c","year":2025},"citing_paper":{"arxiv_id":"2607.00596","last_updated":"2026-07-01T08:19:00Z","snapshot_observed_at":"2026-08-07T16:45:17.069643Z","submitted_at":"2026-07-01T08:19:00Z","title":"Semantic-Guided Reading Order Reconstruction in Historical Armenian Newspapers with LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-02T14:47:26.322568Z"},"links":{"cited_paper":"/paper/2502.04223","citing_paper":"/paper/2607.00596"},"observation_digest":"sha256:424a38473a8a2d89dcc6190b9468936e04516c5fdec00bf3d1a776d6dd30307a","observation_id":"9687850a-a79a-47a2-83a6-44853f20b9b7","resolution":{"observed_at":"2026-07-02T14:57:03.913867Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.04223/citation-record","integrity":"/paper/2502.04223/integrity","json":"/paper/2502.04223/citation-record.json","paper":"/paper/2502.04223"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.699091Z","title":"Claude 3: A new era in ai with advanced rea- soning and intelligence","venue":null,"work_id":"1968342b-1de2-4a0a-bdbe-b28a347970b9","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.802742Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:08a62eba2419b324dc6155dfe4c7aa096ac409b7995bd571fa3dc6c927893bd5","observation_id":"3118311e-b16e-45e0-8b77-ef819f0d83c9","resolution":{"observed_at":"2026-08-08T23:13:14.703780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.687403Z","title":"Scenescript: Reconstructing scenes with an autoregressive structured language model, 2024","venue":null,"work_id":"2e3aa9e0-11a0-4b6a-bb13-dab95e6b3b54","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.807117Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:6da892ca9aa193ecb549f6d6174c4a2010ca18f5a6c901c9aad9b10a2c2b5d40","observation_id":"95c67552-19fb-459f-8c60-85ea8f45a0ae","resolution":{"observed_at":"2026-08-08T23:13:14.691474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-08T23:13:13.811102Z","title":"Qwen-vl: A frontier large vision-language model with versatile abilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.811102Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:22304c256a30de05cb49c62a75783dc939872f3f3af1ecd92d3167c3d3a8fe86","observation_id":"d5ed1554-823f-4f61-b632-dad50925386d","resolution":{"observed_at":"2026-08-08T23:13:13.811102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.676315Z","title":"SwinDocSegmenter: An end-to-end unified domain adaptive transformer for document instance segmentation","venue":null,"work_id":"4e55bead-a6dc-4209-9693-82d83ac0b013","year":2023},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.815604Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:07ed8d05c02e8d22cd2375f7894bbb20698f2e743b00d54f2d06d403fc96dfd5","observation_id":"85cf7391-28f2-47c4-b4e9-b7aa0a1a1828","resolution":{"observed_at":"2026-08-08T23:13:14.680186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:13.819387Z","title":"Piqa: Reasoning about physical commonsense in nat- ural language","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.819387Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:7d7c396b906c7cfa819dec2fae2fbffb8c5af814deed515e39f8a3a402d34dd1","observation_id":"aa77ff2b-0947-49e6-bcd8-83906fa4f024","resolution":{"observed_at":"2026-08-08T23:13:13.819387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.657490Z","title":"Nougat: Neural optical understanding for academic documents","venue":null,"work_id":"1ad9d7ce-8b9f-41f8-86de-fabbbd679349","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.824129Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:31db5ce61b8cd2ef9d74f763fc97ce44beee4c6d4a1aad3e386d06a4b2ae5f32","observation_id":"70da46ed-252b-4a1c-aada-6806e1c2c2fd","resolution":{"observed_at":"2026-08-08T23:13:14.661315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-07-06T17:17:56.276857Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10774","snapshot_observed_at":"2026-08-08T23:13:13.828407Z","title":"Medusa: Simple llm inference acceleration framework with multiple decod- ing heads","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.828407Z"},"links":{"cited_paper":"/paper/2401.10774","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:4c2fe78cf14d49e08a15e064d2f76976a51c3e73145454799d012f42b8119283","observation_id":"761b8b5d-8d94-4d94-9557-2ec9a3c5c71e","resolution":{"observed_at":"2026-08-08T23:13:13.828407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.10852","last_updated":"2022-03-27T14:44:00Z","snapshot_observed_at":"2026-08-14T08:27:35.980119Z","submitted_at":"2021-09-22T17:26:36Z","title":"Pix2seq: A Language Modeling Framework for Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.10852","snapshot_observed_at":"2026-08-08T23:13:13.832416Z","title":"Pix2seq: A language modeling framework for object detection","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.832416Z"},"links":{"cited_paper":"/paper/2109.10852","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:42fbae396d75b85d29cc7a4a1118679bd6bc80a1c1ab8d58518b42e6eaf03f5a","observation_id":"0c20d5ca-39b0-434b-9b4d-caca9c4e1031","resolution":{"observed_at":"2026-08-08T23:13:13.832416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-08T23:13:13.836540Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.836540Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:ae75c0be4206912ae7ca4f41769e6021b3745234f8cf7ae2b8e50ba5d606c56c","observation_id":"111ec44c-e779-4622-af64-ce6e52b73ebf","resolution":{"observed_at":"2026-08-08T23:13:13.836540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.645719Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"c6cca6a3-a0bf-4cd6-9c44-ba498795198e","year":2021},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.840718Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:60da5a2c774034101ab9bc68863c889ec4aba78c9405f711de6276c5920d9596","observation_id":"7693b7ee-aefe-4f50-9a88-1586999a49d9","resolution":{"observed_at":"2026-08-08T23:13:14.649752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.633877Z","title":null,"venue":null,"work_id":"2eaf479b-2857-48eb-9505-901a673378cc","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.844771Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:0969a1610d595b8f7c2d529ac19e397502c13767fc15323802fcd15bd975940c","observation_id":"a442ef06-bac2-4c24-8bf0-745edb2fb5c9","resolution":{"observed_at":"2026-08-08T23:13:14.637976Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.622613Z","title":"https : //commoncrawl.org/","venue":null,"work_id":"31103c9e-ee53-4360-a2a7-042b1b644ef5","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.848850Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:05e3fe003a04f3880971dd3d35653de28484cbff98aa46d555748d6328c2f74f","observation_id":"acaeb2dd-5ca8-4c17-b247-b1041a69a59a","resolution":{"observed_at":"2026-08-08T23:13:14.626275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19737","last_updated":"2024-04-30T17:33:57Z","snapshot_observed_at":"2026-08-12T13:06:04.804423Z","submitted_at":"2024-04-30T17:33:57Z","title":"Better & Faster Large Language Models via Multi-token Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19737","snapshot_observed_at":"2026-08-08T23:13:13.852493Z","title":"Better and faster large language models via multi-token prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.852493Z"},"links":{"cited_paper":"/paper/2404.19737","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:fd55af31c5ee05cca5835a981186a3d3e327fc08c44349b5191f5264ee5554a1","observation_id":"3ab2815a-3860-4c02-b4b3-ce349166ef72","resolution":{"observed_at":"2026-08-08T23:13:13.852493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:13.856260Z","title":"Mask r-cnn","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.856260Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:497c7a5025091c433af596a850b4795233b74379b60389027d66b3349ff11e53","observation_id":"265bf2de-c961-4aa2-b1cb-3a052122f606","resolution":{"observed_at":"2026-08-08T23:13:13.856260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-08T23:13:13.860281Z","title":"Mea- suring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.860281Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:ab62f9c5045b41d9b666b58b948d51c0f7ab2876cfc3955ce9ab8e116bd32f92","observation_id":"bc373523-4b30-4c1a-b5a9-857e201ce650","resolution":{"observed_at":"2026-08-08T23:13:13.860281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12895","last_updated":"2024-03-19T16:48:40Z","snapshot_observed_at":"2026-08-14T10:58:54.442167Z","submitted_at":"2024-03-19T16:48:40Z","title":"mPLUG-DocOwl 1.5: Unified Structure Learning for OCR-free Document Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12895","snapshot_observed_at":"2026-08-08T23:13:13.864169Z","title":"mplug-docowl 1.5: Unified structure learning for ocr-free document understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.864169Z"},"links":{"cited_paper":"/paper/2403.12895","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:f649e1021d5e6a99464b2db16c523483ad69093b2e4c07d2c617c6863770bc24","observation_id":"04b58b47-9d1a-454e-a80d-43ac0c108524","resolution":{"observed_at":"2026-08-08T23:13:13.864169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.603010Z","title":"mplug-docowl 1.5: Unified structure learning for ocr-free document understanding, 2024","venue":null,"work_id":"425b05dc-0c66-46d8-9611-4744976ba8d2","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.868193Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:afd15559c2e2736806e901f0bd3e5d31556fda058ff14cbe1eb1d6c4051ff64c","observation_id":"842ca28d-c95a-40a7-84a4-2b778a0bda42","resolution":{"observed_at":"2026-08-08T23:13:14.607753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:13.872148Z","title":"Layoutlmv3: Pre-training for document ai with unified text and image masking","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.872148Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:6d1fa04c3af437627d8a10e9192904ad3d74602d4cde54aa90e265d3c4438aa9","observation_id":"4f0977c3-1a8d-4bcb-ae0f-aa9671886d38","resolution":{"observed_at":"2026-08-08T23:13:13.872148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.585352Z","title":"Pymupdf4llm: A python package for extracting pdf content in markdown format, 2024","venue":null,"work_id":"47f27fdf-7572-479e-b958-71468a711235","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.876076Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:4e6d0d4d75579ac940a427a8e665e697dc79d9892841f5bf7bd353de03c89d5b","observation_id":"a0a776e1-362b-417c-af0c-c644eeb2ce96","resolution":{"observed_at":"2026-08-08T23:13:14.589359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.573932Z","title":"Ultralytics yolov5, 2020","venue":null,"work_id":"705af28e-2cc6-4002-85fb-1ea42041fdb9","year":2020},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.879582Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:281903f88c5ac46d2868e7bfe19e7dba1875f0e437aa56792f4227ebac588a33","observation_id":"b7f70327-ae7b-41d8-a0b0-192cbdc43cda","resolution":{"observed_at":"2026-08-08T23:13:14.578466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.563706Z","title":"Weld, and Luke Zettle- moyer","venue":null,"work_id":"3e411808-38f4-48b9-a672-ad726540ac49","year":2017},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.883069Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:cb856f96359e99cfae8b1a8bb6b8f0f951ea5bd55357777ca75546ae0f39bb6a","observation_id":"946ce2dd-eccb-4db3-8914-3f7bccd5899e","resolution":{"observed_at":"2026-08-08T23:13:14.567308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05858","last_updated":"2019-09-20T20:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-11T17:57:18Z","title":"CTRL: A Conditional Transformer Language Model for Controllable Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.05858","snapshot_observed_at":"2026-08-08T23:13:13.886466Z","title":"Ctrl: A condi- tional transformer language model for controllable genera- tion","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.886466Z"},"links":{"cited_paper":"/paper/1909.05858","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:4df7f1e943080583f7a247042a7ee4394c1cc9ec673eaf29a724816eb1498181","observation_id":"0d7c3f1c-d4eb-485c-9231-469cd1e1066f","resolution":{"observed_at":"2026-08-08T23:13:13.886466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.553382Z","title":"Ocr-free document understanding transformer","venue":null,"work_id":"905c73a0-cc7b-4698-8604-68c5792c4582","year":2022},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.890221Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:94e0c45b1f79da928c4c4e3f55c9ef49676856126a9f5ce9f2bb662022b87b05","observation_id":"4a0cc075-d107-4429-b1f0-6fcdaaf60823","resolution":{"observed_at":"2026-08-08T23:13:14.557026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.542366Z","title":"The stack: 3 tb of permissively licensed source code","venue":null,"work_id":"7fb4da8e-1265-49a5-b5e1-c1dba2400f5e","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.893743Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:a326631f39b3e36db5338b4f25b1b9c8bc91af6c54360595e4c789fe6e3f452f","observation_id":"cb81aa4e-0570-418a-9d2d-c9c56601c720","resolution":{"observed_at":"2026-08-08T23:13:14.546446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04683","last_updated":"2017-12-05T19:36:03Z","snapshot_observed_at":"2026-08-07T10:40:47.462532Z","submitted_at":"2017-04-15T19:31:41Z","title":"RACE: Large-scale ReAding Comprehension Dataset From Examinations","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.04683","snapshot_observed_at":"2026-08-08T23:13:13.897557Z","title":"Race: Large-scale reading com- prehension dataset from examinations","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.897557Z"},"links":{"cited_paper":"/paper/1704.04683","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:6e6737c27ee85412339e360253b63e8651388caf66a321c962f849c4d2b6f1bc","observation_id":"b9ef5926-bbef-44ce-9d62-d9374bc252e7","resolution":{"observed_at":"2026-08-08T23:13:13.897557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14295","last_updated":"2024-05-23T08:15:49Z","snapshot_observed_at":"2026-08-13T00:00:51.009739Z","submitted_at":"2024-05-23T08:15:49Z","title":"Focus Anywhere for Fine-grained Multi-page Document Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14295","snapshot_observed_at":"2026-08-08T23:13:13.901378Z","title":"Focus anywhere for fine- grained multi-page document understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.901378Z"},"links":{"cited_paper":"/paper/2405.14295","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:36585f40f8fdeae801ac42b32b6e088c21620281083a5e629e291b2aca51bd49","observation_id":"1a4b1f9e-f32f-41a7-83f7-f897e90c8686","resolution":{"observed_at":"2026-08-08T23:13:13.901378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.532031Z","title":"Focus anywhere for fine-grained multi-page document understanding, 2024","venue":null,"work_id":"0899f148-8a56-4124-801b-47e6dc16f383","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.906162Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:f6f8b5cb8e7b137198f636573ffbbcec50a7c2c2293731bfac2de3e560294bbc","observation_id":"cf1114d1-38cb-41ad-a496-1dd3528849ce","resolution":{"observed_at":"2026-08-08T23:13:14.535757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.519916Z","title":"Multilingual denoising pre-training for neu- ral machine translation","venue":null,"work_id":"1dc17c1c-6791-4698-ab8c-96811983f85a","year":2020},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.910131Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:ff0baf523871c494f04a3ac9168a64dd5dad462f2df38d61fac070e7d6dc0f81","observation_id":"3a755a83-6984-4564-98bf-8248fb16dd0e","resolution":{"observed_at":"2026-08-08T23:13:14.524845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04473","last_updated":"2024-03-15T06:51:30Z","snapshot_observed_at":"2026-08-13T05:57:08.016883Z","submitted_at":"2024-03-07T13:16:24Z","title":"TextMonkey: An OCR-Free Large Multimodal Model for Understanding Document","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04473","snapshot_observed_at":"2026-08-08T23:13:13.913693Z","title":"Textmonkey: An ocr-free large multimodal model for understanding document","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.913693Z"},"links":{"cited_paper":"/paper/2403.04473","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:71780c76f966b08c8417fc82c9c09b4e6701a783629e05d6896b7e16823c0add","observation_id":"b6c8fc8b-a0b1-416b-ad9e-489219011128","resolution":{"observed_at":"2026-08-08T23:13:13.913693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-08T23:13:13.917542Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.917542Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:fca21580ad139f28398452972b3f038893a4c3780e2d8e76bcf362d19b278c10","observation_id":"def0c897-3751-4ce6-98a2-66a66499659c","resolution":{"observed_at":"2026-08-08T23:13:13.917542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11419","last_updated":"2024-08-21T16:54:23Z","snapshot_observed_at":"2026-08-13T10:09:07.558559Z","submitted_at":"2023-09-20T15:50:08Z","title":"KOSMOS-2.5: A Multimodal Literate Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11419","snapshot_observed_at":"2026-08-08T23:13:13.922039Z","title":"Kosmos-2.5: A multimodal literate model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.922039Z"},"links":{"cited_paper":"/paper/2309.11419","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:39b32df63b027ae18edccc5b8c29ac0565f4f2ed2266575287cf3da0bda5c3e5","observation_id":"f092e221-6002-4759-95c0-d245e880bfbc","resolution":{"observed_at":"2026-08-08T23:13:13.922039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02789","last_updated":"2018-09-08T11:47:16Z","snapshot_observed_at":"2026-08-14T07:00:02.529732Z","submitted_at":"2018-09-08T11:47:16Z","title":"Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02789","snapshot_observed_at":"2026-08-08T23:13:13.925841Z","title":"Can a suit of armor conduct electricity? a new dataset for open book question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.925841Z"},"links":{"cited_paper":"/paper/1809.02789","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:55118c570f96f8f5af8beff6adbbeef70a3de412dbb55eeac93bb416f4d25a96","observation_id":"a7a868ab-1734-46ef-857a-ac45143744a0","resolution":{"observed_at":"2026-08-08T23:13:13.925841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.507518Z","title":"Tableformer: Table structure understanding with transformers","venue":null,"work_id":"221fb39f-d363-415d-8ffa-6cd0daa53513","year":2022},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.929852Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:4e31b33f6b3fdbb6096d44bf35e32887bf44c4aa1fc6ecabec429485873748fa","observation_id":"d62fa345-f764-4300-85f4-ef502d89864b","resolution":{"observed_at":"2026-08-08T23:13:14.511696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.495779Z","title":null,"venue":null,"work_id":"cf195e1c-a0da-4ad7-a14a-fa7af67cb1a4","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.933631Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:5693f6c5b458a8fe6c3826b19828276780ae14e0653307b2bb85669e1f10c866","observation_id":"eeaee289-511e-4cdb-a620-94bc6e26945f","resolution":{"observed_at":"2026-08-08T23:13:14.499770Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.484884Z","title":"String normalization","venue":null,"work_id":"5eaf06d1-acb6-4cf4-b878-ba8f6c75f748","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.938476Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:827af5f13a436e7831c2bfe7ab632a47896038a6c8d7ffc97da44c8732c28ea6","observation_id":"fa3033c3-f7d3-4c2e-8c42-10c80025a3d3","resolution":{"observed_at":"2026-08-08T23:13:14.488520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.473905Z","title":"GPT-4o: Large language model","venue":null,"work_id":"c7988d6f-ed2a-4ca3-b7a4-d9e6aabe8b63","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.942459Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:a86d2398eb6bc68ab56625bd63f5b4e62904eedb0ac119e0b8e90c7e47ae6db2","observation_id":"4eaf5abb-62ca-4864-92bd-b49a1c364312","resolution":{"observed_at":"2026-08-08T23:13:14.477615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.462918Z","title":"A universal document converter","venue":null,"work_id":"9a8b3fb6-7dfc-441c-86cd-b9202d6f52d2","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.945987Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:8f9c3cc6f8c3c3500d027d7584091ed3ff277224434f7093e2489a5697dada92","observation_id":"e6d8d86a-a01f-426e-9211-744302daf415","resolution":{"observed_at":"2026-08-08T23:13:14.466545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.450974Z","title":"Nemotron-4 15b technical report,","venue":null,"work_id":"b9218f18-b44c-4072-8a43-4abbdd1a9140","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.949574Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:4735e294758430a47cbbff7d2c558cf4b2599c22dce01d5adcf9d61c82f1e6eb","observation_id":"c6d90306-d240-463e-bead-770b508a264d","resolution":{"observed_at":"2026-08-08T23:13:14.454600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06786","last_updated":"2023-10-10T16:57:28Z","snapshot_observed_at":"2026-08-13T05:52:51.072759Z","submitted_at":"2023-10-10T16:57:28Z","title":"OpenWebMath: An Open Dataset of High-Quality Mathematical Web Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06786","snapshot_observed_at":"2026-08-08T23:13:13.953269Z","title":"Openwebmath: An open dataset of high-quality mathematical web text","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.953269Z"},"links":{"cited_paper":"/paper/2310.06786","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:18a3e192e31a37c97be3fc7b7086bdf2f9a31e945533de4b91ae49ec9e623da3","observation_id":"a90df86d-7144-4288-98f7-27e0f686e828","resolution":{"observed_at":"2026-08-08T23:13:13.953269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.440192Z","title":"DocLayNet: A large human- annotated dataset for document-layout segmentation","venue":null,"work_id":"793768dd-8085-448d-b613-e7fcf308e3a8","year":2022},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.957679Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:2c09db450be4df86ad7c74aa3d03b9a14d08ca3f25ad7a7635875f366ab99d8f","observation_id":"db06cc08-7603-4cc4-96f8-abd109768e22","resolution":{"observed_at":"2026-08-08T23:13:14.443871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.428980Z","title":"Source code for nltk.metrics.scores","venue":null,"work_id":"31fcce00-5bd1-4a37-b890-b6cfbef69aca","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.961153Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:18c15b78c1372b48154ecd6f489d01acb45815315e068e9bd568983fe845f3f0","observation_id":"0f29857f-c5fe-4042-9bfb-9de6ae2c521c","resolution":{"observed_at":"2026-08-08T23:13:14.432750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.418068Z","title":"AM-RADIO: Agglomerative vision founda- tion model reduce all domains into one","venue":null,"work_id":"1b38cbf0-8175-4dc8-b572-1d3d649a6f44","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.965567Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:a21074a77ddf1a697d9cde3b7da4567f76af3e81f63cd984da53c9e9333c9868","observation_id":"09a7165b-020d-4c76-8c2e-31e48e7fb6cf","resolution":{"observed_at":"2026-08-08T23:13:14.421851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.406243Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks","venue":null,"work_id":"d437cdcc-e88c-497e-9e50-d0ceb68a07d8","year":2016},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.970199Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:aec28bedea240302dc8a186ef905f06add9daf1853ef5a604c7bd26024cea93f","observation_id":"c12a00df-869d-49f6-93cc-553572bc8479","resolution":{"observed_at":"2026-08-08T23:13:14.410365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:13.973635Z","title":"Winogrande: An adversarial winograd schema challenge at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.973635Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:8ee0b5e483caba77ceef49b5bb869ef197c947bf85a62d238833491d7d308876","observation_id":"4ada570c-c4e9-42aa-b513-0fbc1afa70bb","resolution":{"observed_at":"2026-08-08T23:13:13.973635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.389424Z","title":"Statistics of the Common Crawl Corpus 2012, 2013","venue":null,"work_id":"da66815d-3f59-445d-a317-3d927186f582","year":2012},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.977239Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:d492003c05d19e03fb2d4bf49827caee5c6454b9a4b9b1e5635e53a93caec297","observation_id":"758c2487-8eb1-4e2e-ba41-5736b07349cc","resolution":{"observed_at":"2026-08-08T23:13:14.393002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.378607Z","title":"An overview of the tesseract ocr engine","venue":null,"work_id":"b0573a38-70e5-44fa-b266-1e73cbb5925d","year":2007},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.980622Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:80492164d5bfb434b8f0a76f5a7925257902ae0af3f4b653ba90a2883e8a4bbb","observation_id":"e33fe1c6-3f8a-45e2-9a27-8790e2be5fd4","resolution":{"observed_at":"2026-08-08T23:13:14.382584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.368309Z","title":"Galactica: A large language model for science, 2022","venue":null,"work_id":"0c0d3418-4687-4b73-830c-fe0dbd9d4b89","year":2022},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.984256Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:fd63676334ea3d32a2bd005b71008c69e07a79ee92c673493aee447cbc938987","observation_id":"4b6d7446-1ecb-498e-a229-b51f6c8634b1","resolution":{"observed_at":"2026-08-08T23:13:14.372132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.357810Z","title":null,"venue":null,"work_id":"d84af48e-9efb-4862-9c20-be4465de2a10","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.987891Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:b3c480444607dfb126ebc97d2d069984f6527ded1eb51b0f9651655319338858","observation_id":"f3064b2c-e6fd-4c5d-937e-52b4650f38d2","resolution":{"observed_at":"2026-08-08T23:13:14.361614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.346747Z","title":null,"venue":null,"work_id":"b7e24f3a-df74-4d56-8fd0-56f2ed680a02","year":2007},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.992034Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:1770afedcb39dc72c768975468159c4696abaa25cbbdd5181517d812363c30f5","observation_id":"e28dcc4b-e213-460d-b572-f5bdfa76b019","resolution":{"observed_at":"2026-08-08T23:13:14.350550Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.335680Z","title":"Vary: Scaling up the vision vocabulary for large vision-language models, 2023","venue":null,"work_id":"ef7ac9a4-5046-4eac-8dd5-29a00064534d","year":2023},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.995547Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:4e60c622136ce3df6b171d0ec01f3d1a75edea2ef7fa742df0807e443cc3fedb","observation_id":"dcdfcc8c-3a46-4765-9e12-2256c080bb52","resolution":{"observed_at":"2026-08-08T23:13:14.339596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.324326Z","title":"Small language model meets with reinforced vision vocabu- lary, 2024","venue":null,"work_id":"7cc00367-734b-4ce2-bdff-0dcd0c98df84","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.999909Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:7be8ce10cc549c38ff2f8781a91900527ba903b44b0fc8829b087ee150489bd1","observation_id":"e8bd9d44-731c-4b9f-84f5-b561b55654bd","resolution":{"observed_at":"2026-08-08T23:13:14.328436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01704","last_updated":"2024-09-03T08:41:31Z","snapshot_observed_at":"2026-08-10T02:15:09.754142Z","submitted_at":"2024-09-03T08:41:31Z","title":"General OCR Theory: Towards OCR-2.0 via a Unified End-to-end Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01704","snapshot_observed_at":"2026-08-08T23:13:14.003979Z","title":"General OCR theory: Towards OCR-2.0 via a unified end-to-end model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.003979Z"},"links":{"cited_paper":"/paper/2409.01704","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:270ad724cdc078590f4f8cee2e02c399438a87756dddee1620125a56c415255d","observation_id":"b43f16ab-e725-4eaf-bf37-13af65de50bd","resolution":{"observed_at":"2026-08-08T23:13:14.003979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-10T16:18:23.994244Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-08T23:13:14.007821Z","title":"Hellaswag: Can a machine really finish your sentence? arXiv preprint arXiv:1905.07830, 2019","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.007821Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:b70d94a63871806bf9ed9f5556a995964ca4a691c0509c039346fd6fd22f6608","observation_id":"49a5a653-bf1f-4b17-ad5a-ba1a8470d580","resolution":{"observed_at":"2026-08-08T23:13:14.007821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.312519Z","title":null,"venue":null,"work_id":"6684b114-3807-45d3-9340-60d4216b1276","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.012221Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:8fca558fcfc1c455359892cb8a6b95a66292835156f84c444cefb0a59ce392b4","observation_id":"7ece616a-5bc6-4eb9-94a3-1d42a62c8da3","resolution":{"observed_at":"2026-08-08T23:13:14.316996Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.300312Z","title":"Identical scores (as in our case) lead to incorrect PR- Curves and inconsistent results","venue":null,"work_id":"c6a20fae-9c15-4e6d-85df-fa199d362bdf","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.015813Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:9d0d223ddd1d948ab7df5b0aa1a59527d0fd2e4383c207e2ffd1d41875557b03","observation_id":"191565a5-7d2c-4f98-a299-e0e2e88f2e62","resolution":{"observed_at":"2026-08-08T23:13:14.305070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.287758Z","title":"first separate classes, then match boxes)","venue":null,"work_id":"0c816280-c389-4c02-9db7-23a7fde60916","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.019511Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:63b301cfcb863b434a9e8c0f3833865884cb55be8fad3abf08fba4aecfddc904","observation_id":"bb576429-7620-4a3b-a0d1-c3dbfd4b8a51","resolution":{"observed_at":"2026-08-08T23:13:14.291895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.274457Z","title":"To manage paragraphs that span across pages, we need to carry open paragraphs over to next pages","venue":null,"work_id":"ee4eae54-5c45-4a9c-9c66-201f356efc8d","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.023135Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:7d864247b20b45b2acae3498420d9d929c05fcf3fd19b34f423a92f85436a6d5","observation_id":"ee7fd8b9-7eb8-449b-834a-814c1583fd79","resolution":{"observed_at":"2026-08-08T23:13:14.278767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.263697Z","title":null,"venue":null,"work_id":"f8dd0039-21ae-462b-9613-54870060f2cd","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.026953Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:e30cf2ae9026b975df3af956b052ec288276f3a4961b04f84531e34ff2677187","observation_id":"25f2f5e9-0364-4d21-9594-7eeac941f433","resolution":{"observed_at":"2026-08-08T23:13:14.267125Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.251802Z","title":"Floating text blocks (e.g., Text and List-item) are merged based on specific rules, such as not ending with punctuation","venue":null,"work_id":"3bcde673-2b0a-4712-afd1-0ec8a29821be","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.030759Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:0e199741bd9d3a5c88db1ca558e5f586e42994d02dc843f057b288c218b52a99","observation_id":"c4886ca4-1a6e-4655-934f-5d7103f2ff77","resolution":{"observed_at":"2026-08-08T23:13:14.256285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.241454Z","title":null,"venue":null,"work_id":"852de959-541c-4f41-8e24-bc9cea160830","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.034206Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:808928a53fb3e54f2e3e9f6c638a6f8f05d803df19649ce5073a9bd8948f50a4","observation_id":"cc1d955f-ed6e-4428-bf8c-573a6bb3b3b9","resolution":{"observed_at":"2026-08-08T23:13:14.244837Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.229124Z","title":null,"venue":null,"work_id":"97da52bf-0898-4c11-803d-86383430e108","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.037650Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:72525a3f3464e414460d01a8153ebddf92da6ee88209b5e6947814f497f19676","observation_id":"5f970aeb-a7f4-403f-9bc2-e60f19edd660","resolution":{"observed_at":"2026-08-08T23:13:14.233989Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":32},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 2 inbound Pith citation observations for arXiv:2502.04223."}