{"as_of":"2026-08-12T10:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d5b6bb9fe0927c2c1e3318425fa5372816530d79a35dbd0287119a459e5a0f3f","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:21:45.433810Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.05805/citation-record","integrity":"/paper/2507.05805/integrity","json":"/paper/2507.05805/citation-record.json","paper":"/paper/2507.05805"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.378756Z","title":"Combining visual and textual features for semantic segmentation of historical newspapers","venue":null,"work_id":"084e9f09-c6f8-4298-be11-637996819905","year":2021},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.158071Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:da653756a9a5e891ae0f24d36431fec4cf118f4296de41b47d2ae84e8843a3c9","observation_id":"948b190c-efde-4fe5-917b-8aba8975e703","resolution":{"observed_at":"2026-08-06T19:21:46.385820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13418","last_updated":"2023-08-25T15:03:36Z","snapshot_observed_at":"2026-08-12T03:48:04.422679Z","submitted_at":"2023-08-25T15:03:36Z","title":"Nougat: Neural Optical Understanding for Academic Documents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13418","snapshot_observed_at":"2026-08-06T19:21:45.163193Z","title":"Nougat: Neural optical understanding for academic documents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.163193Z"},"links":{"cited_paper":"/paper/2308.13418","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:55b8858785d3a305a83a76e064a2e635f9b8a8f86ca066a649c332d2a064cce8","observation_id":"89ac4112-0f79-442d-896d-93cb45d76f9a","resolution":{"observed_at":"2026-08-06T19:21:45.163193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.364646Z","title":"End-to- end object detection with transformers","venue":null,"work_id":"95aad45c-6eaf-41be-a975-fa3c05380a88","year":2020},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.167713Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:4d1d5869d9bf0f8ea2a7d3fd317c50efbb7310c935ecba349a151c0ba7430cd9","observation_id":"e0b7a83e-0167-404f-af00-c70967787c96","resolution":{"observed_at":"2026-08-06T19:21:46.369215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.350186Z","title":"Geometric layout analysis techniques for document image understanding: a review","venue":null,"work_id":"4a60b71c-6295-44cf-b7e8-e1b84ef5cd35","year":1998},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.172447Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:860c9d9d9f5de3e9ccc8631d5cfabace6eb53f665d2f7d6f05248faacea9e1c1","observation_id":"90ffb8e8-8a3c-4c74-b41d-dae52c3d625f","resolution":{"observed_at":"2026-08-06T19:21:46.354795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.334201Z","title":"M6doc: A large-scale multi-format, multi-type, multi- layout, multi-language, multi-annotation category dataset for modern document layout analysis","venue":null,"work_id":"ca765be6-3ac9-4a1b-a229-0b454dba4d1f","year":2023},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.176529Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:00a93c8bf146821b3d3b855a68c7549c54489a10bc89c323d1361d9f9b1d05f0","observation_id":"17cbca11-2ae1-43b7-96dc-a2d7393bb4fb","resolution":{"observed_at":"2026-08-06T19:21:46.339732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.04729","last_updated":"2019-08-28T16:24:53Z","snapshot_observed_at":"2026-08-10T12:14:32.877990Z","submitted_at":"2019-08-13T16:47:08Z","title":"Complicated Table Structure Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.04729","snapshot_observed_at":"2026-08-06T19:21:45.180847Z","title":"Complicated table structure recognition","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.180847Z"},"links":{"cited_paper":"/paper/1908.04729","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:c9ee31683a561238b809b16865e5834cc16dbdc1d036233a2c862e34370d50ed","observation_id":"8532636a-818a-4d78-824a-83f8a3fdff7b","resolution":{"observed_at":"2026-08-06T19:21:45.180847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.316347Z","title":"Vision grid transformer for document layout analysis","venue":null,"work_id":"09b640d8-0d11-4ea1-b134-755647f149b0","year":2023},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.185526Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:ab71fb2cfe335767e821ccd35d7806112d835f81f7adf6cd3d755ad268a94708","observation_id":"628a2aa3-bc84-44f6-91ca-f0f79ea295ab","resolution":{"observed_at":"2026-08-06T19:21:46.322172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.299644Z","title":"Image-to-markup generation with coarse-to- fine attention","venue":null,"work_id":"902ff5de-4851-40d5-95bb-618e643030c2","year":2017},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.190217Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:a40fafcd5a89a932b1737b85468e2e25841a64f6610dc1787170d1a17c70e6d7","observation_id":"04fe99a1-ee56-4185-a223-76b243e10f28","resolution":{"observed_at":"2026-08-06T19:21:46.304682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T19:21:45.194076Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.194076Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:ef4c124da479a712b31bf78b43e0d45f8c65b8482aca7d497b028fd14f00234c","observation_id":"2179ac71-6c26-4a9f-9fe6-51ec98aa41af","resolution":{"observed_at":"2026-08-06T19:21:45.194076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.09941","last_updated":"2020-10-15T14:21:53Z","snapshot_observed_at":"2026-07-06T09:57:27.039262Z","submitted_at":"2020-09-21T14:57:18Z","title":"PP-OCR: A Practical Ultra Lightweight OCR System","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.09941","snapshot_observed_at":"2026-08-06T19:21:45.198838Z","title":"Pp-ocr: A practical ultra lightweight ocr system","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.198838Z"},"links":{"cited_paper":"/paper/2009.09941","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:4d061977eef7cbec36711c2b571c3d8e97acc1fa0a88fe428a59c88125ceb805","observation_id":"37b94c75-fb2a-4d87-a428-78a78f1f1458","resolution":{"observed_at":"2026-08-06T19:21:45.198838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11592","last_updated":"2023-09-02T04:28:42Z","snapshot_observed_at":"2026-08-10T17:26:46.598883Z","submitted_at":"2023-08-19T17:32:34Z","title":"UniDoc: A Universal Large Multimodal Model for Simultaneous Text Detection, Recognition, Spotting and Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11592","snapshot_observed_at":"2026-08-06T19:21:45.203139Z","title":"Unidoc: A uni- versal large multimodal model for simultaneous text detec- tion, recognition, spotting and understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.203139Z"},"links":{"cited_paper":"/paper/2308.11592","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:097095a442e0d9213d791e078962c226e753a716a309ee914c30f4e716a1609c","observation_id":"d4ed33a4-f251-4927-860b-22ed8db00373","resolution":{"observed_at":"2026-08-06T19:21:45.203139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.283837Z","title":"Icdar 2013 table competition","venue":null,"work_id":"43cbdecc-ec8d-402e-a98a-bda969eb33b8","year":2013},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.208059Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:cf1e55b9691366181a984924b853064221f75f486f3b9a3b5111b85c3949aa03","observation_id":"4c6f9bfb-a128-4b72-90b3-cd29544d28b6","resolution":{"observed_at":"2026-08-06T19:21:46.289101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.266948Z","title":"Re- cursive xy cut using bounding boxes of connected compo- nents","venue":null,"work_id":"82fd7008-4173-4ec3-9209-a74d9f3dcf11","year":null},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.212790Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:bfcbc7cac9d9329fc56dc3d5f9edfcf6781e9016435b47f2c93818a45385c072","observation_id":"fd3ef7da-a236-4e79-958b-192b9ab1e574","resolution":{"observed_at":"2026-08-06T19:21:46.272584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.250356Z","title":"Mask r-cnn","venue":null,"work_id":"bba5f623-01f3-4ac7-9ec0-caa12ac94e7e","year":2017},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.218386Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:ae95dfb71d54f80adbba4a433a5bd58d6517b707629df231ec1278f3408ddd02","observation_id":"2c64b31b-bdce-4e0f-9279-9673e6c6cdd7","resolution":{"observed_at":"2026-08-06T19:21:46.255281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.234927Z","title":"Swintextspotter: Scene text spotting via bet- ter synergy between text detection and text recognition","venue":null,"work_id":"e4ab9286-b204-462f-93b0-3972967f7e84","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.223564Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:510fae69f211ed88cc8f31d278b2edf54c6f52b5ea2052f4659318d51e276b94","observation_id":"dd64e4d4-3f8f-4f67-bb69-952210127488","resolution":{"observed_at":"2026-08-06T19:21:46.239712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.228087Z","title":"Layoutlmv3: Pre-training for document ai with unified text and image masking","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.228087Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:e556dfb7ce9f7c1316e5ad1f07bcc076e641303dac5cd80f3f7822019c576178","observation_id":"3a77adf8-258e-4afe-bdbd-0aecd712a56b","resolution":{"observed_at":"2026-08-06T19:21:45.228087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.209483Z","title":"Improving table structure recognition with visual-alignment sequential coordinate modeling","venue":null,"work_id":"9d0e2bb3-3063-41e8-ae01-ff85003858c8","year":2023},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.232778Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:a704cbc32d9630346aff1ad76ab3ef928a0bc1019f19260c99d67cb766bd3e2b","observation_id":"a11b6919-5d65-4296-927c-f7cc0836588e","resolution":{"observed_at":"2026-08-06T19:21:46.214335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.195172Z","title":"Icdar2019 compe- tition on scanned receipt ocr and information extraction","venue":null,"work_id":"5bb2351b-c0ca-4601-a214-a9eb697e429c","year":2019},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.237325Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:17dc76fced8122cf0c36101926e02d2fb51ed651e6fc0475de4cd28cd078f9e8","observation_id":"9b2445af-2dc2-49d8-bc38-318f8e9b38cb","resolution":{"observed_at":"2026-08-06T19:21:46.199871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.180318Z","title":"Document transformation system from pa- pers to xml data based on pivot xml document method","venue":null,"work_id":"acaf8faf-659b-4320-9a12-dc41300f39ed","year":2003},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.242205Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:17fd663df35924740a6c138fc5f5b93d2ae98fbb4bde60490604e8f59607df7c","observation_id":"f01ac413-86a3-4a03-818f-08d165f1c4e5","resolution":{"observed_at":"2026-08-06T19:21:46.185045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.164774Z","title":"Data clustering: a review","venue":null,"work_id":"1307d018-94d1-4b6c-b382-87b79a47b136","year":1999},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.247034Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:91f335588ef428527e801bb93180cf59a0faea38438e2c79eae88ea5786bb6ae","observation_id":"00225f3e-7d96-4dad-a01a-5aba247a3993","resolution":{"observed_at":"2026-08-06T19:21:46.170181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.150122Z","title":"Funsd: A dataset for form understanding in noisy 14 scanned documents","venue":null,"work_id":"d5ba920e-54d8-4618-a9b0-778bd5a96e27","year":2019},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.252219Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:45065acb4f4ffafa0123ae7db49da868516556cb7635ae618f56c33f3a722d60","observation_id":"bbbb6fa5-bd0a-4b72-a621-472098f185ee","resolution":{"observed_at":"2026-08-06T19:21:46.154985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.136765Z","title":"ultralytics/yolov5: v6","venue":null,"work_id":"8acbf72d-204b-4e3d-a68a-5b55e04aec59","year":2021},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.256923Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:397264b82a3846c0e1dc5c96926348980fa2623312bb5eba948acb5325f0d6c9","observation_id":"f1e92513-f83b-46f7-b139-c30e1a75b96e","resolution":{"observed_at":"2026-08-06T19:21:46.141098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.122791Z","title":"Ocr-free document understanding transformer","venue":null,"work_id":"014438b0-8a7c-408c-bfc5-1d07a76f6f13","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.261333Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:e5782228d0721da4d5081a498db43392ea1ccc28879136e408bb0fb683d3bcb0","observation_id":"6ffa6289-39a2-404c-8ac2-a7a6510e7c33","resolution":{"observed_at":"2026-08-06T19:21:46.127407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T19:21:45.266080Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.266080Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:bf12eabbf444fd0d56c1a9c0c5b5d623e255f14670d4c734a0fb2cd41795cfda","observation_id":"6c24b300-fbbe-47fa-93d9-86fcd5c7dad2","resolution":{"observed_at":"2026-08-06T19:21:45.266080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.108117Z","title":"Pix2struct: Screenshot parsing as pretraining for visual lan- guage understanding","venue":null,"work_id":"025e456f-80f7-464a-bcae-992e281f71f1","year":2023},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.270962Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:8e1bc6c0bb88fd6d49f239ad3463e96ed68cf8b2e4633b36ce74e69e917bf179","observation_id":"7c3eded2-5ec9-4e76-bb21-1f285b9579b2","resolution":{"observed_at":"2026-08-06T19:21:46.112836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.13461","last_updated":"2019-10-29T18:01:00Z","snapshot_observed_at":"2026-07-06T08:33:12.534026Z","submitted_at":"2019-10-29T18:01:00Z","title":"BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.13461","snapshot_observed_at":"2026-08-06T19:21:45.275641Z","title":"Bart: Denoising sequence-to-sequence pre-training for natural language generation, translation, and comprehension","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.275641Z"},"links":{"cited_paper":"/paper/1910.13461","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:192dcb5eda7a66cd598a76cbb63bd41b07223fac0af6e8ece38adb7603173376","observation_id":"179b7bfc-070c-4402-81fc-9576e12fa9e1","resolution":{"observed_at":"2026-08-06T19:21:45.275641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.093627Z","title":"When counting meets hmer: counting-aware network for handwritten math- ematical expression recognition","venue":null,"work_id":"a8e3e72c-168f-4bb4-8d41-b89d6da0cc89","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.280408Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:2c2b6e53912b82d354af9472b343c75cad62bc139544258c2c1da25bc5dc5cf1","observation_id":"3c2edb88-8883-494d-9a00-41a4317650bd","resolution":{"observed_at":"2026-08-06T19:21:46.098472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05391","last_updated":"2022-10-13T07:11:59Z","snapshot_observed_at":"2026-08-11T10:48:12.416893Z","submitted_at":"2022-10-11T12:07:32Z","title":"PP-StructureV2: A Stronger Document Analysis System","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.05391","snapshot_observed_at":"2026-08-06T19:21:45.285089Z","title":"Pp- structurev2: A stronger document analysis system","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.285089Z"},"links":{"cited_paper":"/paper/2210.05391","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:1b42a8381507333ee27c48ba6499de4482f2590db24827feb0620e7c384cf81f","observation_id":"46109a49-ec28-4bce-b70a-13b968bdac39","resolution":{"observed_at":"2026-08-06T19:21:45.285089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.079401Z","title":"Tablebank: Table benchmark for image-based table detection and recognition","venue":null,"work_id":"9c3ea03b-3b05-4e66-8990-ae412ea747d5","year":1918},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.290580Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:360c6707ca55c7a265bf86ff088486a6b2d218f0ed33fbcc6ca48689e80872b2","observation_id":"41d4bbd8-17b6-48b7-b88d-d71c66551388","resolution":{"observed_at":"2026-08-06T19:21:46.083907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.01038","last_updated":"2020-11-11T05:08:05Z","snapshot_observed_at":"2026-08-10T05:19:59.289044Z","submitted_at":"2020-06-01T16:04:30Z","title":"DocBank: A Benchmark Dataset for Document Layout Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.01038","snapshot_observed_at":"2026-08-06T19:21:45.295175Z","title":"Docbank: A bench- mark dataset for document layout analysis","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.295175Z"},"links":{"cited_paper":"/paper/2006.01038","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:85813dbfef9b0fc37616822e180dec8322c933fc3702263bcddb3ab4c1b33e16","observation_id":"7b05f804-ab5f-45c0-b759-83846a464d23","resolution":{"observed_at":"2026-08-06T19:21:45.295175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.064119Z","title":"Relational represen- tation learning in visually-rich documents","venue":null,"work_id":"8faf957c-5267-4105-827b-61649acd3bd4","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.300239Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:39dcd0462750bef12872c942703357fe2fd2424fb7e6c0cf8d9d62219990fbdc","observation_id":"f86d9d90-f643-4002-b3ff-4b2209e0d562","resolution":{"observed_at":"2026-08-06T19:21:46.069488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.049601Z","title":"Tsrformer: Table structure recognition with transformers","venue":null,"work_id":"88a11c7e-c9a9-4a2d-b719-1421c3d41435","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.304719Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:64c564dab72f8b180b66cc2dcea9a0ea06c1887a7ba0dd20c8d051825ef9a2a5","observation_id":"020f6bcb-59ce-4d80-baa6-887115317d4a","resolution":{"observed_at":"2026-08-06T19:21:46.054108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.035023Z","title":"Show, read and reason: Table struc- ture recognition with flexible context aggregator","venue":null,"work_id":"0775aa3f-1d5d-4bfe-b57d-c1d162defbf1","year":2021},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.309328Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:b0d65450c1072fcce488ee87d685a1f1717f7fae2d09feb9e13e8788cb142118","observation_id":"c5896211-734c-4aad-9826-c1a3a9da0d0d","resolution":{"observed_at":"2026-08-06T19:21:46.040125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.020612Z","title":"Neural collaborative graph machines for table structure recognition","venue":null,"work_id":"49aa8a42-b3b9-47de-a8f8-ba5e6d006ac9","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.313757Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:a75d8efad4d2a73b06767e8b19bfdc4ef931c3a8b54b8edf443968240f7057be","observation_id":"36dbdeb3-4976-4fe0-a13b-051a56684fd2","resolution":{"observed_at":"2026-08-06T19:21:46.025441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-06T19:21:45.318202Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.318202Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:984f0326550a6aa2ef720e452c412dabae25deea973b29374e6840a00ee7929c","observation_id":"461f8255-12bb-4007-9b08-cf5868ed877e","resolution":{"observed_at":"2026-08-06T19:21:45.318202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.003906Z","title":"Abcnet: Real-time scene text spot- ting with adaptive bezier-curve network","venue":null,"work_id":"8cc563a8-e44e-49bb-8366-bbe37a382992","year":2020},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.323262Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:b41a34f88df605cefd8bdaac8e888dd3ed40c57899a9b209225b16c20bdd3d8f","observation_id":"be100a4a-f9b6-415f-8e90-27198021228b","resolution":{"observed_at":"2026-08-06T19:21:46.009480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.988036Z","title":"Spts v2: single-point scene text spotting","venue":null,"work_id":"05cc0eeb-6edb-41d5-a92f-30946cecb7ec","year":2023},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.327632Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:61bfe2b32aadabb110358f62062dda553d4c48abbfb3db57d6ea18e859f1a86e","observation_id":"470b5c36-f610-4f63-91d5-97f4d0d43e94","resolution":{"observed_at":"2026-08-06T19:21:45.992950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.973617Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"6179b500-254d-4d9b-aeb3-626566ce9fe4","year":2021},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.332097Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:10013a3c75e2d1b5cb0b274fdb352af94b43f098c3ea94265686e293ed5e2fe4","observation_id":"8a02eb8b-fe06-4c98-b82b-f643f20ee833","resolution":{"observed_at":"2026-08-06T19:21:45.978434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11419","last_updated":"2024-08-21T16:54:23Z","snapshot_observed_at":"2026-08-02T15:31:34.622625Z","submitted_at":"2023-09-20T15:50:08Z","title":"KOSMOS-2.5: A Multimodal Literate Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11419","snapshot_observed_at":"2026-08-06T19:21:45.336576Z","title":"Kosmos-2.5: A multimodal literate model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.336576Z"},"links":{"cited_paper":"/paper/2309.11419","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:47fb38f3ebb4ff69456e6c8c8e34b68f30dd55eec0a6edc76dde116a4d1b0084","observation_id":"195cbc1e-4303-4036-aab0-dde0d903b056","resolution":{"observed_at":"2026-08-06T19:21:45.336576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.957786Z","title":"Mask textspotter: An end-to-end trainable neural network for spotting text with arbitrary shapes","venue":null,"work_id":"ba1adcba-d98f-4868-8525-506efcd73b9f","year":2018},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.341450Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:f6c9986ac2ea26edf11ade976b5fd44a1cf028b5c098f8e9f7e9de365ac41a9c","observation_id":"a00cc7dc-b831-4dd2-86f4-25e3fbfa3485","resolution":{"observed_at":"2026-08-06T19:21:45.963331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.943093Z","title":"Optimized xy-cut for determining a page read- ing order","venue":null,"work_id":"ecac6a68-e7db-46c2-93f6-8f8730f09c11","year":2005},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.345904Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:7fbc53b9ffeedbd8b89a6acba447ebb9e1ef51ce8bc2b6b117c556bca829096a","observation_id":"881b0c1f-414e-49b7-993b-0a83ff09b7a4","resolution":{"observed_at":"2026-08-06T19:21:45.947838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.928793Z","title":"Icfhr 2014 competition on recognition of on-line handwritten mathematical expressions (crohme 2014)","venue":null,"work_id":"64ea8563-1ffa-4543-9be2-ea10fc326c35","year":2014},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.350522Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:acf0b6e70890aab453cb834556d82fa89b73f65140b5a49dc4bec27f29d8d5ef","observation_id":"0e9e0e64-d6fc-4aa1-8693-52b99fe4a0c9","resolution":{"observed_at":"2026-08-06T19:21:45.933356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.913328Z","title":"Tableformer: Table structure understanding with transformers","venue":null,"work_id":"595e8c2f-bccc-4181-954b-8f91b3371450","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.355000Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:9640e735ba02384dd427f5d8eb5a5b6cc8bcc6f2acd8dc29e77074c1029e52c3","observation_id":"94552ee5-d3f0-4630-bada-960b13da4fa2","resolution":{"observed_at":"2026-08-06T19:21:45.918412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.898726Z","title":"Cord: a con- solidated receipt dataset for post-ocr parsing","venue":null,"work_id":"d51516b6-9a07-4b23-97d8-54d76b929cb8","year":2019},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.360641Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:880d9669fb08298d3eee8fc6417504e1c7bdca620f8611766999c73f2fc365bb","observation_id":"88a44d67-2b9b-4d34-96ec-c55fb789eef1","resolution":{"observed_at":"2026-08-06T19:21:45.903544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.883619Z","title":"Doclaynet: A large human- annotated dataset for document-layout segmentation","venue":null,"work_id":"e3ae196b-ce7b-4d7f-bea1-0d4c68a807c6","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.365697Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:0e3a9d9d6ad068573b5cc426c5444ef1646aa56e4896beefbc8188efb8d21553","observation_id":"872eb70e-a7d9-45a7-a518-26ebd8f5cb0e","resolution":{"observed_at":"2026-08-06T19:21:45.889052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.869130Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks","venue":null,"work_id":"d5f8285d-a7c6-464e-87bd-54789e63eef5","year":2015},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.370621Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:1338fcbf03effe75d079d1b1a14f096861e4ccb1daef8d875056b09b496c4007","observation_id":"efbda340-8755-495f-83fc-464e61ad67c8","resolution":{"observed_at":"2026-08-06T19:21:45.873852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.05415","last_updated":"2018-06-15T21:36:10Z","snapshot_observed_at":"2026-08-03T23:15:24.155975Z","submitted_at":"2018-02-15T06:17:51Z","title":"Teaching Machines to Code: Neural Markup Generation with Visual Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.05415","snapshot_observed_at":"2026-08-06T19:21:45.375003Z","title":"Teaching machines to code: neural markup generation with visual attention","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.375003Z"},"links":{"cited_paper":"/paper/1802.05415","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:538d0baeaed9d6375c1ea541f29d742d2e87d006820a08c5ba00712d9ba56863","observation_id":"2b1d6d0d-721b-406d-8f4e-b73b92c58d1f","resolution":{"observed_at":"2026-08-06T19:21:45.375003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.853789Z","title":"Optimal boxes: boosting end-to- end scene text recognition by adjusting annotated bounding boxes via reinforcement learning","venue":null,"work_id":"e37faabf-e777-4dec-98a5-aa1bc0d758f5","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.379518Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:d3bb8677f6c08905c192ec64f4bd16295ce517efa17bf9f15222cf35bc54643c","observation_id":"c170a1f5-9610-4b76-9d6d-6f5d06f81485","resolution":{"observed_at":"2026-08-06T19:21:45.858931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.837725Z","title":"You can even annotate text with voice: Transcription-only-supervised text spotting","venue":null,"work_id":"5b438862-48f0-475e-9519-e452f8d60f78","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.384147Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:f300ff4da43a8edc6476c6adac8b0c636bc761911e3cb01dcbfd0f85918e5e41","observation_id":"ab2c288d-7ca2-446a-9fbd-fda1ccc47fc2","resolution":{"observed_at":"2026-08-06T19:21:45.843160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.822181Z","title":"Few could be better than all: Feature sampling and grouping for scene text detection","venue":null,"work_id":"d9e8c14f-7338-4e21-b2ad-2d03a24a9959","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.388544Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:09912dfbf926b8ba9df065bb32b1169c655dfeee363226b99c25a47fed434244","observation_id":"5a319298-a728-4ca8-bf3f-f4b3333995df","resolution":{"observed_at":"2026-08-06T19:21:45.827325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.11591","last_updated":"2021-08-27T04:56:07Z","snapshot_observed_at":"2026-08-10T04:47:48.064490Z","submitted_at":"2021-08-26T05:52:32Z","title":"LayoutReader: Pre-training of Text and Layout for Reading Order Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.11591","snapshot_observed_at":"2026-08-06T19:21:45.392730Z","title":"Layoutreader: Pre-training of text and layout for read- ing order detection","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.392730Z"},"links":{"cited_paper":"/paper/2108.11591","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:3bfa821cb693bd61e4742fefb5c82ed8c0cd1d34708d6cc2ef79997b11ea8744","observation_id":"0484cee8-75a7-4201-88cf-d52fa8438ce3","resolution":{"observed_at":"2026-08-06T19:21:45.392730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.806384Z","title":"Learning to extract semantic struc- ture from documents using multimodal fully convolutional neural networks","venue":null,"work_id":"03dceb17-c142-4155-adae-f0d1954d0540","year":2017},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.397512Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:674cdc703a83aa83c0c51274efc9d967a1e3416bcc065d6c4f10273f1976ade7","observation_id":"03832ba0-8b19-4b52-896a-0808bffac202","resolution":{"observed_at":"2026-08-06T19:21:45.811267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.789786Z","title":"Syntax-aware network for handwritten mathematical expression recognition","venue":null,"work_id":"8c79b71c-abe4-4b52-8fe6-54214e1d9694","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.401908Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:95d905abce8eb7fd5691ad08257f758251db8b15d5b8d34b030d2534ce6c8ba2","observation_id":"68b287c7-9c24-40a4-831d-5f3ddeaa17a0","resolution":{"observed_at":"2026-08-06T19:21:45.795640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11016","last_updated":"2023-10-17T06:08:55Z","snapshot_observed_at":"2026-07-06T16:34:19.351760Z","submitted_at":"2023-10-17T06:08:55Z","title":"Reading Order Matters: Information Extraction from Visually-rich Documents by Token Path Prediction","version":1},"cited_work":{"arxiv_id":"2310.11016","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.11016","snapshot_observed_at":"2026-08-06T19:21:45.488643Z","title":"Reading Order Matters: Information Extraction from Visually-rich Documents by Token Path Prediction","venue":"cs.CL","work_id":"3e6ccbbc-7d87-4611-915d-dd5ae24dea4c","year":2023},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.406729Z"},"links":{"cited_paper":"/paper/2310.11016","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:12dff51f3594845598ee3c25ab7f9583aec5ad29324fe1227a24ad4f995c4f86","observation_id":"a70f3a22-86b5-4ed4-a3b1-44bf787a18de","resolution":{"observed_at":"2026-08-06T19:21:45.495864Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.772359Z","title":"Vsr: a unified framework for document layout analysis combining vision, semantics and relations","venue":null,"work_id":"a731675b-6190-4d77-93e6-c2caa96df763","year":2021},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.411469Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:831cdf8378c6ea23f6c0bb2a0177c9f82b0a8f7c4107618f6d1f3875c91c7234","observation_id":"a063515c-3be1-4e26-973a-bad7a26f70e1","resolution":{"observed_at":"2026-08-06T19:21:45.777349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.756575Z","title":"Tabpedia: Towards comprehensive visual ta- ble understanding with concept synergy.Advances in Neural Information Processing Systems, 37:7185–7212, 2025","venue":null,"work_id":"75d697e0-7f03-461c-a73f-6de895f1c59e","year":2025},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.415784Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:8b7a6b9c8449ed695c562785eb9bce2c13cba83b3e3308d40cf313ad9915fbdf","observation_id":"25695353-289a-496a-96c9-a829c2bae29b","resolution":{"observed_at":"2026-08-06T19:21:45.761550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.741341Z","title":"Multi-modal in-context learning makes an ego-evolving scene text recognizer","venue":null,"work_id":"4f0ab428-ebad-4092-87ee-68b7ffef7995","year":2024},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.420331Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:f34fe0bcb27589a769ff21865bc453b5d91762e4d806b90940ce859919ffb27f","observation_id":"09757057-99eb-4106-b319-95ea1054d91c","resolution":{"observed_at":"2026-08-06T19:21:45.746186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.727010Z","title":"Pub- laynet: largest dataset ever for document layout analysis","venue":null,"work_id":"df670c34-b98e-42f6-b397-dfecce3326b7","year":2019},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.424847Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:1264aecfcfc5775d2d9b403eed2f1a27b73a6d7fb1e26f02146911ce4754db02","observation_id":"739e563b-2c55-478a-ba58-4b3f95051848","resolution":{"observed_at":"2026-08-06T19:21:45.731521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.711153Z","title":"Image-based table recognition: data, model, and evaluation","venue":null,"work_id":"139a0e4b-2602-4938-a975-a4ed7e2a4099","year":2020},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.429219Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:1151daac43b75a73f900fecdaa1a394c0dd06fa26e35e86367a4c567c6d9d75c","observation_id":"bc44b73e-4a4a-4120-bef9-a8252e078016","resolution":{"observed_at":"2026-08-06T19:21:45.716157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04159","last_updated":"2021-03-18T03:14:26Z","snapshot_observed_at":"2026-07-06T10:02:45.105181Z","submitted_at":"2020-10-08T17:59:21Z","title":"Deformable DETR: Deformable Transformers for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04159","snapshot_observed_at":"2026-08-06T19:21:45.433810Z","title":"Deformable detr: Deformable trans- formers for end-to-end object detection","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.433810Z"},"links":{"cited_paper":"/paper/2010.04159","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:c1ddd13c6c5d0bad38bbe974d5b0eb79e5620d30b93cfc79630f2403b343b5e3","observation_id":"e7492f35-525e-4233-92df-def6c3aa3648","resolution":{"observed_at":"2026-08-06T19:21:45.433810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":44},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 0 inbound Pith citation observations for arXiv:2507.05805."}