{"as_of":"2026-08-14T01:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:25036767e3c584361fe6963b6f57e3ac4388c8c34af39a1118406e8368638c15","coverage":[{"denominator":163,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:43:45.256004Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07943/citation-record","integrity":"/paper/2608.07943/integrity","json":"/paper/2608.07943/citation-record.json","paper":"/paper/2608.07943"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.10945","last_updated":"2024-12-25T01:27:01Z","snapshot_observed_at":"2026-08-12T23:00:36.622939Z","submitted_at":"2024-08-20T15:34:27Z","title":"HiRED: Attention-Guided Token Dropping for Efficient Inference of High-Resolution Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10945","snapshot_observed_at":"2026-08-12T00:43:44.859835Z","title":"and Vandierendonck, Hans and John, Deepu and Ji, Bo , booktitle =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.859835Z"},"links":{"cited_paper":"/paper/2408.10945","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:06800a40c1f181a26942ad6c740a9403621c9f133c1da23847a315f50ace40b8","observation_id":"44f2201d-8cca-4c5e-bf0d-597704fd42c4","resolution":{"observed_at":"2026-08-12T00:43:44.859835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.864936Z","title":"Computer Vision -- ECCV 2022 , series =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.864936Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:fa9af19ee3eb4dd948a9d83a7a7def49f4350d43c4bb0be07fc79cfd00a6ac82","observation_id":"b1fc838a-e9dc-4e1d-9be7-70d8374c280b","resolution":{"observed_at":"2026-08-12T00:43:44.864936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.869407Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.869407Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:a98bfc1570e582efe96761464a368581bece83e09048a855ddc426f46dc09a1c","observation_id":"df852115-3c45-4366-ad03-297ef762ec29","resolution":{"observed_at":"2026-08-12T00:43:44.869407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-10T18:37:57.419939Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-12T00:43:44.873268Z","title":"arXiv preprint arXiv:2504.10479 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.873268Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:92fad96aaf8d71b3b110774920a148221efd7dadc006fb86a9ad2b2de1ecfbf7","observation_id":"7d4168a7-e2a8-42d4-bd92-7300069a7090","resolution":{"observed_at":"2026-08-12T00:43:44.873268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.885320Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.885320Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:b7ae957e580f08cc5a3c75885ee760a3fd5e2270fe7dc2fda5ea1dd09107af83","observation_id":"83f1c353-4b85-4d46-9191-727830cfc1df","resolution":{"observed_at":"2026-08-12T00:43:44.885320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.00911","last_updated":"2026-04-29T09:42:42Z","snapshot_observed_at":"2026-08-12T16:00:42.146133Z","submitted_at":"2026-04-29T09:42:42Z","title":"When Good OCR Is Not Enough: Benchmarking OCR Robustness for Retrieval-Augmented Generation","version":1},"cited_work":{"arxiv_id":"2605.00911","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.00911","snapshot_observed_at":"2026-08-12T00:43:46.589858Z","title":"When Good OCR Is Not Enough: Benchmarking OCR Robustness for Retrieval-Augmented Generation","venue":"cs.CV","work_id":"c4f05195-8e1e-45e9-9bcc-5f710eba1c2b","year":2026},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.889101Z"},"links":{"cited_paper":"/paper/2605.00911","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:6684a6b594ed0aeb34ba8f3dece8b606f2aa5a7bd3069564d56063cdbfedadbc","observation_id":"26733541-9fa8-4400-9609-063cc8fa1225","resolution":{"observed_at":"2026-08-12T00:43:46.594317Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.893025Z","title":"Text or Pixels? It Takes Half: On the Token Efficiency of Visual Text Inputs in Multimodal","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.893025Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:c26fd0623e1785ea88eabdb27ac0959fc1f4d8b535d00fc33f1cc63402c3c2f0","observation_id":"cf578d9d-5941-46c8-a405-64481028bbf9","resolution":{"observed_at":"2026-08-12T00:43:44.893025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.897234Z","title":"2026 , eprint =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.897234Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:f32e05b25c19ce49b60c4b5e613f36e9ae884c8f57e08173a928f44767a9a6eb","observation_id":"a9a9d8dc-8ec4-4584-a714-2d3f3ef073ad","resolution":{"observed_at":"2026-08-12T00:43:44.897234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17262","last_updated":"2025-07-23T07:00:19Z","snapshot_observed_at":"2026-08-08T12:09:57.704230Z","submitted_at":"2025-07-23T07:00:19Z","title":"VisionTrap: Unanswerable Questions On Visual Data","version":1},"cited_work":{"arxiv_id":"2507.17262","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.17262","snapshot_observed_at":"2026-08-12T00:43:46.573794Z","title":"VisionTrap: Unanswerable Questions On Visual Data","venue":"cs.CV","work_id":"bddf9712-683b-4075-ba6f-bca04817b92f","year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.901620Z"},"links":{"cited_paper":"/paper/2507.17262","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:f1d3c5a9ef0fcabde84f2ec37bca7a1a4bee2d1addd4f9e7c5d4687660e7f779","observation_id":"61f9127f-894f-47f1-aeda-c029996a44a6","resolution":{"observed_at":"2026-08-12T00:43:46.578194Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.21553","last_updated":"2026-06-19T15:50:35Z","snapshot_observed_at":"2026-08-13T15:16:07.154145Z","submitted_at":"2026-06-19T15:50:35Z","title":"Dissecting Agentic RAG: A Component Ablation for Multi-Hop QA with a Local 7B Model","version":1},"cited_work":{"arxiv_id":"2606.21553","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.21553","snapshot_observed_at":"2026-08-12T00:43:46.557634Z","title":"Dissecting Agentic RAG: A Component Ablation for Multi-Hop QA with a Local 7B Model","venue":"cs.CL","work_id":"c8bc1ac2-4018-44b1-9819-01f81c27f652","year":2026},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.905952Z"},"links":{"cited_paper":"/paper/2606.21553","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:6fa6b27ee47266d91f2ee6fa8a8da5febe43934cafc590a39d5e43a72bdedf8e","observation_id":"dae74ccf-db72-4d2e-b521-1269e1ec794a","resolution":{"observed_at":"2026-08-12T00:43:46.561974Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.28337","last_updated":"2026-05-29T17:24:40Z","snapshot_observed_at":"2026-08-12T15:59:49.866437Z","submitted_at":"2026-05-29T17:24:40Z","title":"A Systems-Level Analysis of Sensitivity, Robustness, and Stability in Retrieval-Augmented Generation","version":1},"cited_work":{"arxiv_id":"2606.28337","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.28337","snapshot_observed_at":"2026-08-12T00:43:46.540731Z","title":"A Systems-Level Analysis of Sensitivity, Robustness, and Stability in Retrieval-Augmented Generation","venue":"cs.IR","work_id":"be40802b-8bb6-4102-a34b-4ae29df882a3","year":2026},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.910943Z"},"links":{"cited_paper":"/paper/2606.28337","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:aff98b07e102985ce9fdc0fd466a525afd8c78eaeeebdb318fa60853fc0392aa","observation_id":"24ecf0dc-4767-4501-9291-febf4ee8fd68","resolution":{"observed_at":"2026-08-12T00:43:46.545466Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"cited_work":{"arxiv_id":"2605.08888","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.08888","snapshot_observed_at":"2026-08-12T00:43:46.605923Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","venue":"cs.CL","work_id":"a2b11ae1-ffa5-42b5-9e74-28b8b6fb312d","year":2026},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.915267Z"},"links":{"cited_paper":"/paper/2605.08888","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:14c9f85b7becfcd85e69e8948b22322173ab3830aa3f37fbdc201c42c2603603","observation_id":"2dcf884d-4275-4f5d-ad95-f4f38a463a23","resolution":{"observed_at":"2026-08-12T00:43:46.611343Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.919529Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.919529Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:4d14b5ab735615052a3744807fae2c2624bc9c6d2bd7ad255b2aae0e00b0ea83","observation_id":"2d601261-d561-4568-9cd9-8e44f7fc3a7a","resolution":{"observed_at":"2026-08-12T00:43:44.919529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.923637Z","title":"2025 , url =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.923637Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:7eb5456b02aab317c9532b6d8362d054ed920256d54d353bba75f03c99624c7d","observation_id":"04e918a8-51a9-4267-8ddc-5cfdb20913bf","resolution":{"observed_at":"2026-08-12T00:43:44.923637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.927377Z","title":"2025 , url =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.927377Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:a8e42b9e4cc6158b39b64160ae2ec6822c3c744e9305953215566f8eaea50b0a","observation_id":"dc9b0df9-baa8-4cff-ba0f-47323e8d7387","resolution":{"observed_at":"2026-08-12T00:43:44.927377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.931291Z","title":"2025 , url =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.931291Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:9dcb1b7993211987f003762707ff86c412e3692f100fe53e2fe3b7a2f4b95cd2","observation_id":"bd6e07bf-de48-48ed-a79c-65650fa5603c","resolution":{"observed_at":"2026-08-12T00:43:44.931291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.935186Z","title":"The Reasoning Bottleneck in","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.935186Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:7c814b790441f2680f1cd5a9b45cf07bc768897ec7ce4f65fc0aec6544e0bef3","observation_id":"571e10c5-a584-4b6a-8d87-1e5002c947a2","resolution":{"observed_at":"2026-08-12T00:43:44.935186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.939190Z","title":"2026 , eprint =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.939190Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:4440c328a76fff157dab72e3c03e95528c4b057852911f49b213abe71eea3d9a","observation_id":"0c926538-e843-4035-9788-28fcde3067ce","resolution":{"observed_at":"2026-08-12T00:43:44.939190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.943277Z","title":"Facet-Level Tracing of Evidence Uncertainty and Hallucination in","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.943277Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:3685fbe52e52a43a1d93b18bf7b5470af966d352edca282c8edd7d5107c9d935","observation_id":"30304295-d34d-4502-9e85-0b7ffbf2d9b8","resolution":{"observed_at":"2026-08-12T00:43:44.943277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.14192","last_updated":"2026-05-13T23:18:07Z","snapshot_observed_at":"2026-08-11T12:40:59.527049Z","submitted_at":"2026-05-13T23:18:07Z","title":"Why Retrieval-Augmented Generation Fails: A Graph Perspective","version":1},"cited_work":{"arxiv_id":"2605.14192","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.14192","snapshot_observed_at":"2026-08-12T00:43:46.523003Z","title":"Why Retrieval-Augmented Generation Fails: A Graph Perspective","venue":"cs.CL","work_id":"d74ca3c2-17d2-4b5d-b2e6-3abb83e9678f","year":2026},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.947138Z"},"links":{"cited_paper":"/paper/2605.14192","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:f469ae3deb739e1b31a0652bc9d77e614352905a6ac72f8babfab733985bcf3d","observation_id":"57134060-62e6-4cc7-9b92-1abc8d73311a","resolution":{"observed_at":"2026-08-12T00:43:46.528145Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.951745Z","title":"2026 , eprint =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.951745Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:a514bef4245a340e93d7e8c62c0f16bd43bb1bc6078ba8c3bb1643d18b1ded6c","observation_id":"8562cbf3-c0a6-4785-9463-420fbf288767","resolution":{"observed_at":"2026-08-12T00:43:44.951745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.955611Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.955611Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:077c82c07131af573a4402a4a543aafd3160cf040c154c92cfc53fa9be1f224b","observation_id":"28129937-fd70-4867-9604-24d24c2f491f","resolution":{"observed_at":"2026-08-12T00:43:44.955611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.02660","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:46.502557Z","title":"arXiv preprint arXiv:2512.02660 , year =","venue":null,"work_id":"b8bac40b-22d7-4646-be56-badb779e1b64","year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.959669Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:25bc8550d1784e200ea2a525c3f0af4d3ca4b7019c1edd8a71fc194a7560de1d","observation_id":"7f355164-6eb3-4cb8-876e-fea28564fef0","resolution":{"observed_at":"2026-08-12T00:43:46.509038Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.963706Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.963706Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:6c081e99a777610f725810e9c9e756ee4ff70bfa6781aaf7effc89a2ad2104da","observation_id":"f1967142-b14c-4fa2-bdcc-8db11c948313","resolution":{"observed_at":"2026-08-12T00:43:44.963706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.967635Z","title":"Assessing the Impact of","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.967635Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:2e8d9473807ebc237f29a8cfb8bbe85a379423060bc0e378fbc47da95b21c8f1","observation_id":"a6f9ff7a-7620-46c3-a55f-20032dc5f323","resolution":{"observed_at":"2026-08-12T00:43:44.967635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03731","last_updated":"2023-12-14T09:31:50Z","snapshot_observed_at":"2026-08-13T17:36:33.931254Z","submitted_at":"2023-11-07T05:20:09Z","title":"A Survey of Large Language Models Attribution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03731","snapshot_observed_at":"2026-08-12T00:43:44.971576Z","title":"arXiv preprint arXiv:2311.03731 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.971576Z"},"links":{"cited_paper":"/paper/2311.03731","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:ea237e2f976ff09d3d087932bf893060cbe8831b3fbc9a2cf1a9068d43a9dc79","observation_id":"71e8eaa9-4dd6-4992-83ca-6278c3ffe246","resolution":{"observed_at":"2026-08-12T00:43:44.971576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.975679Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.975679Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:10b515d0b2f13d5d9d60dbe7b1fd0c5aacfb894338fc26c4cbfea59a2cf7d92c","observation_id":"c5f58b69-5136-4373-8f5c-7a40df3a98ac","resolution":{"observed_at":"2026-08-12T00:43:44.975679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.979559Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.979559Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:fe8502ab6d385c76370a2f714e9ef34c86420a457ec926fdd0735019e44447a5","observation_id":"2e2ebb13-5a1b-42c5-aba0-605ad5c1b732","resolution":{"observed_at":"2026-08-12T00:43:44.979559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.983858Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.983858Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:885f06f60f2fd3b8974c706eea65ec275f7dfe8f6599c9be5a04bcbf3555e35e","observation_id":"e8e74ae2-6722-43cc-b85f-be4b48d24e2d","resolution":{"observed_at":"2026-08-12T00:43:44.983858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.14162","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:46.412005Z","title":"arXiv preprint arXiv:2602.14162 , year =","venue":null,"work_id":"1d5bf7ce-5d23-4b51-bb81-5e3977de6fe8","year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.987806Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:384e3ffe2795a3e971166a4adf15406e6b6b23bf9def04401abe48b558a3cb7f","observation_id":"8a68233c-4c9c-4bee-8d65-26a0023eca54","resolution":{"observed_at":"2026-08-12T00:43:46.418076Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.991452Z","title":"Proceedings of the 33rd ACM International Conference on Multimedia , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.991452Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:2b1206d26d77c0dabdbd30cee6448a496a7f52f0a3783dd87658783ac663fa69","observation_id":"29fe9a39-ffe6-4e6e-a2b9-b04b9e8d93a2","resolution":{"observed_at":"2026-08-12T00:43:44.991452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:44.995314Z","title":"Information Fusion , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.995314Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:2c9a3a695f41e82033dd8ff14ee0367863eef7289f6b177db5d38f7993efb8a0","observation_id":"faf3fab1-7ba8-495b-b3a5-35a43c4cff0f","resolution":{"observed_at":"2026-08-12T00:43:44.995314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13579","last_updated":"2026-04-15T07:39:08Z","snapshot_observed_at":"2026-08-11T04:35:03.575200Z","submitted_at":"2026-04-15T07:39:08Z","title":"MM-Doc-R1: Training Agents for Long Document Visual Question Answering through Multi-turn Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2604.13579","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.13579","snapshot_observed_at":"2026-08-12T00:43:46.345662Z","title":"MM-Doc-R1: Training Agents for Long Document Visual Question Answering through Multi-turn Reinforcement Learning","venue":"cs.CL","work_id":"90bc802c-bd44-4799-a2be-143bf6dad91a","year":2026},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.998831Z"},"links":{"cited_paper":"/paper/2604.13579","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:76505844c01a1980ed81d63b953a79e8f1e2f6cf9b0b5f036ca08234531a339b","observation_id":"eb5e88b7-89e6-495e-8288-861bd818571e","resolution":{"observed_at":"2026-08-12T00:43:46.350348Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.002626Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.002626Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:388222d89109f2e094ef27a98c0e1a229fd6c87d5f9cb1421d962ae8971f4b20","observation_id":"82446d29-94b7-4497-ae94-275e9d2310c9","resolution":{"observed_at":"2026-08-12T00:43:45.002626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.006212Z","title":"arXiv preprint arXiv:2511.22850 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.006212Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:6008ac28ab09dbbce7dd8dfd8b80d7ec159079e52f369042271706f50b5dd0ce","observation_id":"f69a3aea-42af-461b-8f65-bbd4c0c9e9b9","resolution":{"observed_at":"2026-08-12T00:43:45.006212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.009935Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.009935Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:3c3df37bde1cac5b8c4291c7916d46e6b02685b19376f4ca1f655a6cf8c8e06b","observation_id":"1a335100-ed86-462c-9a42-0913b10ef1b1","resolution":{"observed_at":"2026-08-12T00:43:45.009935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.015302Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.015302Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:8d84fe95ab7a6433eacac445b1cb9479cbccb7c6e808d0797ac22ac6933514d2","observation_id":"aea6fc48-e7f7-4f80-b1bf-3a815980e7c2","resolution":{"observed_at":"2026-08-12T00:43:45.015302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.019534Z","title":"Proceedings of the 2025 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies (Volume 1: Long Papers) , year=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.019534Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:6969571534677d3b6bc8ae58ea4a5af98de91a0c57c4b0175f0e8e02f0e0551a","observation_id":"c565e878-de8f-4ef7-9717-07b3db5ccd61","resolution":{"observed_at":"2026-08-12T00:43:45.019534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.023923Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.023923Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:c4a771de650af64f2e235d02306daaffc4534a549c152da210866d7dfa35b6be","observation_id":"8ace049b-f842-4e4d-b7c4-d94f6d6bc502","resolution":{"observed_at":"2026-08-12T00:43:45.023923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.028159Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.028159Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:98470765c7b3b0336c580fd9b61c3a12a7241a702e5fae889487b9793b812e7d","observation_id":"9750023b-ef20-4885-aa37-097975e6f4f7","resolution":{"observed_at":"2026-08-12T00:43:45.028159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.032264Z","title":"arXiv preprint , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.032264Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:430044654bfc163d8e97ba1103a286e07cc226af062587d4624f969f5c66dfb0","observation_id":"2b7259f8-8e86-4d25-a167-11e84117048a","resolution":{"observed_at":"2026-08-12T00:43:45.032264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.036546Z","title":"Proceedings of the ACM Web Conference 2026 , pages=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.036546Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:9cbbe6beb0143fc78e58961a9ef8f18f44994e6430bdfdc0164b0a4ebd56091b","observation_id":"e8eab8d9-7dfc-47fa-a226-0e63a244ed9e","resolution":{"observed_at":"2026-08-12T00:43:45.036546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.040629Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.040629Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:c8132c742f71e1d171d03ecd88db6627db094aa10cae4a2fd5253593ce6c58b3","observation_id":"392aadf3-e0c1-426b-85aa-252f418c0434","resolution":{"observed_at":"2026-08-12T00:43:45.040629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.15253","last_updated":"2026-04-20T08:38:26Z","snapshot_observed_at":"2026-07-06T22:32:51.756468Z","submitted_at":"2025-10-17T02:33:16Z","title":"Scaling Beyond Context: A Survey of Multimodal Retrieval-Augmented Generation for Document Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.15253","snapshot_observed_at":"2026-08-12T00:43:45.045218Z","title":"arXiv preprint arXiv:2510.15253 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.045218Z"},"links":{"cited_paper":"/paper/2510.15253","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:77fffdbc866157e8693a0083e73cfd916598b4d935a389359f1b6220dbba2682","observation_id":"d08228bc-f8c7-49f6-bf9b-c646c0fd2c01","resolution":{"observed_at":"2026-08-12T00:43:45.045218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.050204Z","title":"International Journal on Document Analysis and Recognition , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.050204Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:e7b1ca3f5fd2750443c815025a57a97bb354b80944493deb583b6b699d8d408c","observation_id":"14662dff-c723-426d-a9e7-0b794bdae28d","resolution":{"observed_at":"2026-08-12T00:43:45.050204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.054270Z","title":"Artificial Intelligence Review , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.054270Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:e2a307e9f027c91668c85e2f1e8e35f66fa8e3faa1939f3e8fbeaf829d03463b","observation_id":"b60ac257-1677-4323-b96e-9766e24102cd","resolution":{"observed_at":"2026-08-12T00:43:45.054270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13534","last_updated":"2021-02-04T23:48:39Z","snapshot_observed_at":"2026-08-07T03:26:44.455151Z","submitted_at":"2020-11-27T03:05:59Z","title":"A Survey of Deep Learning Approaches for OCR and Document Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13534","snapshot_observed_at":"2026-08-12T00:43:45.058115Z","title":"arXiv preprint arXiv:2011.13534 , year=","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.058115Z"},"links":{"cited_paper":"/paper/2011.13534","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:215ba93ec2e955594fbc1bb5313543b5a51b76b970b0161bb6b686ad7d87d65a","observation_id":"688ade36-baeb-42b7-9c1b-d018eec4d71f","resolution":{"observed_at":"2026-08-12T00:43:45.058115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13731","last_updated":"2026-04-15T11:12:27Z","snapshot_observed_at":"2026-08-03T00:33:20.640303Z","submitted_at":"2026-04-15T11:12:27Z","title":"Doc-V*:Coarse-to-Fine Interactive Visual Reasoning for Multi-Page Document VQA","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.13731","snapshot_observed_at":"2026-08-12T00:43:45.062117Z","title":"arXiv preprint arXiv:2604.13731 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.062117Z"},"links":{"cited_paper":"/paper/2604.13731","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:a311562447a099ff9a0bfa1efd06c2abf7ff61cb417510c1e8a04c44fc3798a3","observation_id":"c0874d9d-45a8-4756-a196-ad5ed69580ed","resolution":{"observed_at":"2026-08-12T00:43:45.062117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13964","last_updated":"2025-03-18T06:57:21Z","snapshot_observed_at":"2026-08-07T16:55:45.055075Z","submitted_at":"2025-03-18T06:57:21Z","title":"MDocAgent: A Multi-Modal Multi-Agent Framework for Document Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13964","snapshot_observed_at":"2026-08-12T00:43:45.066175Z","title":"arXiv preprint arXiv:2503.13964 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.066175Z"},"links":{"cited_paper":"/paper/2503.13964","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:e469dd80520703ddb3fb86a89e42bfc8a6ec95aa1b95860be1e07c90547d5ef6","observation_id":"9033eae1-b9d2-4fa2-b924-3974b6c847f8","resolution":{"observed_at":"2026-08-12T00:43:45.066175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.070287Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.070287Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:24c21c35bb79b28791c815891b529d640c0e92df2f566bdac5d21e0055947547","observation_id":"a186397a-453f-44fd-8ed1-ddc552ead43d","resolution":{"observed_at":"2026-08-12T00:43:45.070287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04952","last_updated":"2024-11-07T18:29:38Z","snapshot_observed_at":"2026-08-13T08:08:03.934735Z","submitted_at":"2024-11-07T18:29:38Z","title":"M3DocRAG: Multi-modal Retrieval is What You Need for Multi-page Multi-document Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04952","snapshot_observed_at":"2026-08-12T00:43:45.074102Z","title":"arXiv preprint arXiv:2411.04952 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.074102Z"},"links":{"cited_paper":"/paper/2411.04952","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:303cb80bec5f6e7ecec2cda8f21f2bc104269c07e0c6593305fb307679fadf3d","observation_id":"b04f9c17-c579-430f-a839-666d9e00cabb","resolution":{"observed_at":"2026-08-12T00:43:45.074102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.078474Z","title":"International Conference on Document Analysis and Recognition , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.078474Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:08de4bb29bdc022323d20f591b3fcf0e77c6c8ac90816882e94007d788c310d0","observation_id":"a61deaa1-8a31-4370-9e5c-f9c0cf425f57","resolution":{"observed_at":"2026-08-12T00:43:45.078474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.082872Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.082872Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:4acb0741ab731b818ee896a96d025fb64ce84e576e7a844e32dd3832f79fbe16","observation_id":"1ef14cdb-9cf0-40ac-9a11-56dd3f513fa3","resolution":{"observed_at":"2026-08-12T00:43:45.082872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.086873Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.086873Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:ad60757c140d6bc2d05bb002e9df58dbdfa678e687c85be3618fe8985da3cc0e","observation_id":"4d0226e7-25c3-4d9d-8f25-ee05605ece16","resolution":{"observed_at":"2026-08-12T00:43:45.086873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.091011Z","title":"Proceedings of the 7th ACM International Conference on Multimedia in Asia , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.091011Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:8259d168621ff66ed0ba086fa7459604dddfabace9a5f3164dfa0d0162f911a9","observation_id":"14d3dce7-576a-442b-96de-6ef303c9727e","resolution":{"observed_at":"2026-08-12T00:43:45.091011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.095136Z","title":"Proceedings of the AAAI conference on artificial intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.095136Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:3dfe6d0c7229a66903eab2ba4db904b2b864efdfc2576d09b1e9d81d76155252","observation_id":"4544f279-d287-4a34-965b-7ce08d4b955f","resolution":{"observed_at":"2026-08-12T00:43:45.095136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.099097Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.099097Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:2e36012d7cf4f0c5ab7b693f84bb0d148aa98e769174ee19d6029caaeffc7094","observation_id":"3845c505-dcbc-4697-b424-a437c0fb5378","resolution":{"observed_at":"2026-08-12T00:43:45.099097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.103085Z","title":"Proceedings of the AAAI conference on artificial intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.103085Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:96f80d84f6229f263699508a8d91d9687bd500657c868c2b6e1d0b05c1da0224","observation_id":"66c02e25-46a2-425e-a2e5-2c0e93828e40","resolution":{"observed_at":"2026-08-12T00:43:45.103085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05970","last_updated":"2026-04-27T13:16:40Z","snapshot_observed_at":"2026-08-09T08:12:02.284497Z","submitted_at":"2024-10-08T12:17:42Z","title":"PDF-WuKong: A Large Multimodal Model for Efficient Long PDF Reading with End-to-End Sparse Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05970","snapshot_observed_at":"2026-08-12T00:43:45.107213Z","title":"arXiv preprint arXiv:2410.05970 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.107213Z"},"links":{"cited_paper":"/paper/2410.05970","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:aeab20d1326a11e3bfc75e700e857117395206451c49d136bb0c3d0e20592965","observation_id":"b9580e95-d1bd-4f88-9542-313c587885ee","resolution":{"observed_at":"2026-08-12T00:43:45.107213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05261","last_updated":"2024-10-07T17:58:35Z","snapshot_observed_at":"2026-08-12T22:28:53.225342Z","submitted_at":"2024-10-07T17:58:35Z","title":"TextHawk2: A Large Vision-Language Model Excels in Bilingual OCR and Grounding with 16x Fewer Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05261","snapshot_observed_at":"2026-08-12T00:43:45.111390Z","title":"arXiv preprint arXiv:2410.05261 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.111390Z"},"links":{"cited_paper":"/paper/2410.05261","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:79246974da0328d522e714f1a520c1f6f97456a5d102c2400342dab00044ebbf","observation_id":"bf31c70b-3f0c-430e-a618-afbd13d9eefa","resolution":{"observed_at":"2026-08-12T00:43:45.111390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.116011Z","title":"Proceedings of the 32nd ACM International Conference on Multimedia , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.116011Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:7a02b10efbc2e2bbe512bd3859d805ca284afc9dd74540d8d0c29cb98baa797d","observation_id":"297cfed6-d7ef-4f13-aafc-1dc2e45ec3e9","resolution":{"observed_at":"2026-08-12T00:43:45.116011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01744","last_updated":"2025-06-06T17:53:30Z","snapshot_observed_at":"2026-08-12T22:32:20.908382Z","submitted_at":"2024-10-02T16:55:01Z","title":"Leopard: A Vision Language Model For Text-Rich Multi-Image Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01744","snapshot_observed_at":"2026-08-12T00:43:45.119579Z","title":"arXiv preprint arXiv:2410.01744 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.119579Z"},"links":{"cited_paper":"/paper/2410.01744","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:f4c3b7f3e6de6239c66f85fa149a822d21b1e8340e306e2567a57ee4a0e3f6fc","observation_id":"71aaa882-5c7a-4d21-ab5f-1af3562fa442","resolution":{"observed_at":"2026-08-12T00:43:45.119579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.123338Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.123338Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:c88838fc8980602a01a85cdb211ede2b15049b2526537564a5e949818860ce41","observation_id":"1f0d2cbf-fe1f-491f-8fe0-9a1a596ff900","resolution":{"observed_at":"2026-08-12T00:43:45.123338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.126949Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.126949Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:a00b1f793529ad5ae14da0fefcc49589ec875ac3589b2ccd85d1a495e04585b0","observation_id":"42f3c840-5f9f-403b-99b1-5d3c8e52d7e3","resolution":{"observed_at":"2026-08-12T00:43:45.126949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.131217Z","title":"Pattern Recognition , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.131217Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:fc76341e47d6d45a7c08e35d6abd60d100a4534c1739eff76c8ecda96139a452","observation_id":"66df2c81-6e2b-472a-9df0-d0e922aa78b5","resolution":{"observed_at":"2026-08-12T00:43:45.131217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.135005Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.135005Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:2c5eca80f4b7fa91d63cf5c4a4593d71d126104cc7fa1802aeab0f423485146f","observation_id":"08b8a117-c0ef-4ae9-85f4-3828d60aad2f","resolution":{"observed_at":"2026-08-12T00:43:45.135005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.138602Z","title":"business document understanding at sub-billion scale , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.138602Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:5fe77ec4c8990423f2c00954b0b403dfcdecefcf93a720e5fb8dde4c1f124202","observation_id":"95330528-a689-45c0-a90e-05d682c343b3","resolution":{"observed_at":"2026-08-12T00:43:45.138602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.142726Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.142726Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:1e9076eb29c9d2b87e7e86183e15e9724326ad269eae15f63a8684e85004f66d","observation_id":"59d426a1-ffe5-42a1-b929-a27decbad34e","resolution":{"observed_at":"2026-08-12T00:43:45.142726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.147273Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.147273Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:2ae694c0f348349440b719d25ce485de99be402ee66e22585b77af9e621800e8","observation_id":"6891b786-7927-49fa-9076-11ca8e5a980b","resolution":{"observed_at":"2026-08-12T00:43:45.147273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.151805Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 2: Short Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.151805Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:db4eb8eb7d15c8c0d5501018c2eb3f0a10fd22a96064a9817d0777853a796e3a","observation_id":"8d8e0dc1-381d-4b70-b8e8-3eb56c85a424","resolution":{"observed_at":"2026-08-12T00:43:45.151805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.155657Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.155657Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:23715ff43982a2b9677a33144a4f38612d75318d8e24d181827d1df261389877","observation_id":"43e30f23-63bc-42d6-b8c9-6298d4f0d2be","resolution":{"observed_at":"2026-08-12T00:43:45.155657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.11313","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:46.171374Z","title":"arXiv preprint arXiv:2511.11313 , year=","venue":null,"work_id":"6875fbaf-f672-44d3-bbc5-21b8ea40d027","year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.159652Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:7021f2cfcfa3255c653770ebf3ecd12bc75fd49036d0728241c889031e40f7d9","observation_id":"f0a2d0c8-f19b-48e4-9fd2-817fc79eff03","resolution":{"observed_at":"2026-08-12T00:43:46.178313Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.163788Z","title":"arXiv preprint arXiv:2508.00579 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.163788Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:e7ce67d2fdc3f56e57a03653a426479f6e99ecf0d8316b45daca099444800915","observation_id":"d2ac0bf8-8b20-4e61-9982-ad85211575d0","resolution":{"observed_at":"2026-08-12T00:43:45.163788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.167778Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.167778Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:17756a23be80781d45015112e188f093a6addec5ba92d98de4b70e400a1aeed8","observation_id":"8426cedf-6b82-4b7f-921f-25c33622ee3d","resolution":{"observed_at":"2026-08-12T00:43:45.167778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.171350Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.171350Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:900cb419c20aec8734e26b5e168bb4cb1eb39f4c096335f9f45c3e1be3d5e4c5","observation_id":"955dca74-950c-499c-a746-ddd0edb28466","resolution":{"observed_at":"2026-08-12T00:43:45.171350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.175036Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.175036Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:ff49b0ad36ed4db4f97cd5d3c9bc604c1b12ba4b0c6e612d7bbff0924071b1b3","observation_id":"d0f8bfb7-77c0-4d37-868c-6bb65a976aeb","resolution":{"observed_at":"2026-08-12T00:43:45.175036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.178784Z","title":"Electronics , volume=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.178784Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:7458ffece0d62dc5e62f77abd116e5f77d210a5970a2790a6276bb45a428a73f","observation_id":"99642a99-218f-401c-afc9-5970ede5bd8d","resolution":{"observed_at":"2026-08-12T00:43:45.178784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.182199Z","title":"arXiv preprint arXiv:2601.05163 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.182199Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:e10077fb6ec3c53ceab43f2b989ee5406dc413044b447fde24849467c8419dcc","observation_id":"b5ea0f18-b186-4696-a4dd-70df93fa520d","resolution":{"observed_at":"2026-08-12T00:43:45.182199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.185688Z","title":"International Workshop on Document Analysis Systems , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.185688Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:854ae48daed9add48cc1f43db3ccba6dba7ea5ce2e4b2f15dd2e05426e1fc2bf","observation_id":"a585a4ba-b440-4f14-9d51-d09be5f9b890","resolution":{"observed_at":"2026-08-12T00:43:45.185688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.189103Z","title":"arXiv preprint arXiv:2511.11552 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.189103Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:ab3b97c72a1142fb35020a88d0c65ba0baed98093f51e090205cd085ecec56ac","observation_id":"de6d483b-bf81-4352-9b74-b0fec628a235","resolution":{"observed_at":"2026-08-12T00:43:45.189103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.193174Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.193174Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:2f9a5b51dd49ab66995777ad87745c0cddcf2c570261a3c54c50c97ec61e179c","observation_id":"1b91e141-dc27-4888-be16-a45492765758","resolution":{"observed_at":"2026-08-12T00:43:45.193174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.196906Z","title":"arXiv preprint arXiv:2508.03404 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.196906Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:3b9bde97fb8b05b1e7f7ce3d24fb973da5ccbd2ded72713a0cad3281753998f5","observation_id":"d5a5c956-6dd4-4d76-8a30-2cebc3f81622","resolution":{"observed_at":"2026-08-12T00:43:45.196906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.200588Z","title":"arXiv preprint arXiv:2603.02438 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.200588Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:909c8b60f3b5c85955b9f1a661772105fcbc64539b6038e788994e01d5ebc927","observation_id":"be1bcf5c-8cc2-4d19-85f9-093cac23fc7f","resolution":{"observed_at":"2026-08-12T00:43:45.200588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.204319Z","title":"arXiv preprint arXiv:2602.10271 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.204319Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:8e54137570c1ea0fe7358b3f438abbd08a4e5a5dccdb2d7bace8b31222ef6a00","observation_id":"e9796413-b5a2-4092-90a4-59231d048457","resolution":{"observed_at":"2026-08-12T00:43:45.204319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.208208Z","title":"International Conference on Document Analysis and Recognition , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.208208Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:bc7c8f139b4cb5642107d51b67500a9c187868b0f4638055232a99f9579c9e5c","observation_id":"c12fb129-ce0e-4964-9259-967f861e7c3d","resolution":{"observed_at":"2026-08-12T00:43:45.208208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.212321Z","title":"International Conference on Neural Information Processing , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.212321Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:97628d5b2ee4bf6225b344c8fc5f1f79c01c6597813aae412318e65b646dfb17","observation_id":"b06061ce-c66e-42b0-851e-bd00899123a4","resolution":{"observed_at":"2026-08-12T00:43:45.212321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.216103Z","title":"Australasian Joint Conference on Artificial Intelligence , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.216103Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:664a8f4eb3e4be56c42a72eb10ff704666e87e0d4b0bf6f82b54fccd20ad1a99","observation_id":"15ed592a-2c19-4568-ae50-3715939274f3","resolution":{"observed_at":"2026-08-12T00:43:45.216103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.219269Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.219269Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:89c240d6002eb07a2c8ccd50ecc3550f32a226a4c63d9cdd609ca258cf4c9b31","observation_id":"57993fd5-d789-4e0d-8197-c62cf0701d72","resolution":{"observed_at":"2026-08-12T00:43:45.219269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.07931","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:46.688296Z","title":"arXiv preprint arXiv:2603.07931 , year=","venue":null,"work_id":"cb44c1b1-f92d-46a5-9850-a3fa98a29dad","year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.222413Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:4abbe4db1b8548336391ef7618b4994bcd587e79983bdf29af846b3542fec324","observation_id":"02f3fab5-a6cf-416b-929f-2a1e362c1ea8","resolution":{"observed_at":"2026-08-12T00:43:46.694255Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.225209Z","title":"European Conference on Computer Vision Workshops (Text in Everything) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.225209Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:be7766fc4c4dc39ecdee88c82d521bff76c3ebe88f9687cda0e8a01b690f25b4","observation_id":"bf75faf8-a0f2-4673-bb90-bf91ef40ffaa","resolution":{"observed_at":"2026-08-12T00:43:45.225209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.228384Z","title":"International Conference on Document Analysis and Recognition (ICDAR) , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.228384Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:fc274e8865a045f25a8f6523ff134b39d1e38eb31e7c7aa961af4ec5111bd5e8","observation_id":"35618f16-f16d-47ae-b33d-d2a0d9f13099","resolution":{"observed_at":"2026-08-12T00:43:45.228384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.231591Z","title":"2019 , organization=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.231591Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:c58307682d5cea2b59cc3e527ac15d11057702c4f68ce285a5e5cd9f0a1e75ec","observation_id":"abad4ffb-ccda-4a9c-8851-0646538708c3","resolution":{"observed_at":"2026-08-12T00:43:45.231591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.234897Z","title":"2019 , organization=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.234897Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:e7098560cf85aea779be96ccb50d766d6233ba0817c1240f79776b157258d149","observation_id":"ac3e05aa-ffc0-410c-95e4-2b64dd4d5827","resolution":{"observed_at":"2026-08-12T00:43:45.234897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.237822Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.237822Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:9a0f6fc4e006ee937915b98e14ace33d712c048807f4cb854e9d73dd7200243d","observation_id":"39fca3fc-abb4-47eb-9859-8c4ef590e2a9","resolution":{"observed_at":"2026-08-12T00:43:45.237822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.240653Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.240653Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:b35a3b1fbe5ae87dfd82d13960fae9228881649b66e35213768525e3139180de","observation_id":"5dbca27e-7a51-4aa9-9564-2942a1100cc7","resolution":{"observed_at":"2026-08-12T00:43:45.240653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.243620Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.243620Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:ec31effa7645f97a877a53337fec5ae3755ae33ffc91237e166f6ec808f73c2d","observation_id":"5cea32a4-b9a4-4098-857e-86d681fa7689","resolution":{"observed_at":"2026-08-12T00:43:45.243620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.246397Z","title":"Constructing a Multi-hop","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.246397Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:f3c8a590033bae879cb9799b4865773413db27bbdc2a3572f87b1d6472727bf4","observation_id":"f20119eb-bc30-4773-873f-fd78f111c354","resolution":{"observed_at":"2026-08-12T00:43:45.246397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.249139Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.249139Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:a8023c9861e5c8dc200bb95dda6b4665103c18a66d0e72f74343525957296fa9","observation_id":"3ea211af-a0e8-42c2-83a7-643b7841cb42","resolution":{"observed_at":"2026-08-12T00:43:45.249139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.252435Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.252435Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:c5008613bbe577baedd94902683ab83550c6901ced71276f83fd8c360188df76","observation_id":"2154fcc7-fbfc-4970-bf4b-1abc14c707cb","resolution":{"observed_at":"2026-08-12T00:43:45.252435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:43:45.256004Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:45.256004Z"},"links":{"citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:9a94f9e0bb065efbfda0ee522a66543faff96db9551d98014d5c3c634d37debc","observation_id":"d6d50cbb-898c-4f67-ab95-233c343774bc","resolution":{"observed_at":"2026-08-12T00:43:45.256004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-13T23:22:11.130173Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":89,"verified_exact":5,"verified_fuzzy":0},"total_outbound_references":163},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 100 of 163 outbound references and 0 inbound Pith citation observations for arXiv:2608.07943."}