{"as_of":"2026-08-13T13:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ec9c625ede48943b849e8b3426edc6da94d052919d2988e1b2dae52d745e226e","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T05:09:49.912587Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:43:44.915267Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-12T00:43:46.605923Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08888","snapshot_observed_at":"2026-07-13T03:52:24.872919Z","title":"Tianyu Gao, Howard Yen, Jiatong Yu, and Danqi Chen","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09328","last_updated":"2026-07-23T17:56:03Z","snapshot_observed_at":"2026-08-05T04:17:50.821563Z","submitted_at":"2026-07-10T12:09:21Z","title":"WildTrace: Benchmarking Natural Evidence Trails in Long-Context Reasoning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T03:52:24.872919Z"},"links":{"cited_paper":"/paper/2605.08888","citing_paper":"/paper/2607.09328"},"observation_digest":"sha256:02460988beac0f9342c8fb0331eee50d3ded5814fb15d92c8a6917f470446737","observation_id":"3bc983a4-7311-4c23-9a07-123173bb822c","resolution":{"observed_at":"2026-07-13T03:52:24.872919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08888","snapshot_observed_at":"2026-08-02T07:40:56.029050Z","title":"Tianyu Gao, Howard Yen, Jiatong Yu, and Danqi Chen","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09328","last_updated":"2026-07-23T17:56:03Z","snapshot_observed_at":"2026-08-05T04:17:50.821563Z","submitted_at":"2026-07-10T12:09:21Z","title":"WildTrace: Benchmarking Natural Evidence Trails in Long-Context Reasoning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T07:40:56.029050Z"},"links":{"cited_paper":"/paper/2605.08888","citing_paper":"/paper/2607.09328"},"observation_digest":"sha256:52b9c9da9cd174fa5e1b2294de570b23c2dcb8ab7438017b96efb7bc00995c8f","observation_id":"197b182d-0c74-49dd-adfd-2f2f0e5128d3","resolution":{"observed_at":"2026-08-02T07:40:56.029050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"cited_work":{"arxiv_id":"2605.08888","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.08888","snapshot_observed_at":"2026-08-12T00:43:46.605923Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","venue":"cs.CL","work_id":"a2b11ae1-ffa5-42b5-9e74-28b8b6fb312d","year":2026},"citing_paper":{"arxiv_id":"2608.07943","last_updated":"2026-08-08T06:07:55Z","snapshot_observed_at":"2026-08-13T13:12:22.196135Z","submitted_at":"2026-08-08T06:07:55Z","title":"Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T00:43:44.915267Z"},"links":{"cited_paper":"/paper/2605.08888","citing_paper":"/paper/2608.07943"},"observation_digest":"sha256:256e718b2d43c13b1bce1472f77c7ad1576eb2bf3da7614290475b460ad0983d","observation_id":"2dcf884d-4275-4f5d-ad95-f4f38a463a23","resolution":{"observed_at":"2026-08-12T00:43:46.611343Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.08888/citation-record","integrity":"/paper/2605.08888/integrity","json":"/paper/2605.08888/citation-record.json","paper":"/paper/2605.08888"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.08584","last_updated":"2026-01-13T14:06:03Z","snapshot_observed_at":"2026-08-12T22:11:58.919874Z","submitted_at":"2026-01-13T14:06:03Z","title":"Ministral 3","version":1},"cited_work":{"arxiv_id":"2601.08584","doi":"10.48550/arxiv.2601.08584","metadata_source":"pith","pith_arxiv_id":"2601.08584","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ministral 3","venue":"cs.CL","work_id":"6f314463-0f42-4eea-a5c3-607e733d6afe","year":2026},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"cited_paper":"/paper/2601.08584","citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:ec10342c8831ecd97a9cae57e9dc601176322d8266b4823ed11d9f21c0ca63db","observation_id":"a448f9a8-a801-435d-8359-773500f4a891","resolution":{"observed_at":"2026-05-15T05:10:01.879289Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:23.713861+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:23.713861+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"No e x c e p t i o n s","venue":null,"work_id":"efd490f3-b5c9-4072-afbe-7e82f22c969a","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:53ab90e4e2b23a8a0868100aef58580e4d88781b31302b911e23aef2651f9ad5","observation_id":"57b1a8cc-7bf4-4ccd-aaf2-db7affba09e8","resolution":{"observed_at":"2026-05-15T05:10:02.233860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8ded5029-4535-4f63-b664-fb89bbf1f410","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:7266c1b97241cc52b470a87cdc4ef94e75468cacbcd3d2a7e520cb0859eedc12","observation_id":"c86db4e4-447a-4ad7-82d4-37366a1a8355","resolution":{"observed_at":"2026-05-15T05:10:02.247309Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The ci ta tio n MUST ,→ end with TWO right b rac ke ts ‘]] ‘ and then the period","venue":null,"work_id":"3210da9a-19c2-4785-95a6-5dc4d7208e0f","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:d8204f4c68e94a6135313de5ee9be126c2daeaca521c57974e3c33158b621221","observation_id":"f167d956-439c-4b3e-923f-28e59ab96787","resolution":{"observed_at":"2026-05-15T05:10:02.228958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"on ,→ page 5","venue":null,"work_id":"4057037d-2d37-4ad2-b7f1-8e59b9e5424b","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:4fc4ef769de6e19edfa6e7bbc6b718e287595c927096b0a1e3a200578d9a52c3","observation_id":"920927d8-0a38-4175-bebf-3eb31fdf52c2","resolution":{"observed_at":"2026-05-15T05:10:02.243164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7c371237-4673-4e90-aa1e-55f949d9fd92","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:a04783d9c70a5c805c9d408f9d8b9ce73f991758b6b7fa50ad250760fba380a4","observation_id":"51629ec7-1c03-4a4b-8fec-3701dc7dfdff","resolution":{"observed_at":"2026-05-15T05:10:02.191338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"12\" , \" ,→ iv","venue":null,"work_id":"42c6fe36-6274-4f1c-8e52-de67386671fa","year":2023},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:fbb9e9520982311cf71655f9fc26acd9c3b3ad5fb7dcc99b6c77394adc135d75","observation_id":"69b47268-eb08-40e3-855e-fa9de797b2f6","resolution":{"observed_at":"2026-05-15T05:10:02.200217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e75a3d93-1dda-4bb4-ba3c-978a4167e6a7","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:3e52d47c1c8ed72f833c199d305c0e30cba7e80093dbcae7cdb65258971d430f","observation_id":"1f8f8ee5-e840-47b8-8bee-98fdd819f121","resolution":{"observed_at":"2026-05-15T05:10:02.212816Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"on page X","venue":null,"work_id":"7df6ee66-bd8a-4f2d-b42b-cc0559855f29","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:75bc301d46bbab9a700c5562c53fde87c67c24bebf623005359d4642ef0f9a3c","observation_id":"a9faff63-5d42-44dd-9e1f-94c6230f420d","resolution":{"observed_at":"2026-05-15T05:10:02.208528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"covered","venue":null,"work_id":"86fbabc7-9925-401d-87f3-726499aeb0ca","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:29de0ac9c124916971c77055a2323a986a37ee4da9c10c8878734cafc1e420a3","observation_id":"145168da-40c6-4e8a-aee6-a417704f73ea","resolution":{"observed_at":"2026-05-15T05:10:02.239189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"63719e4e-a7f8-4c5e-9cb0-369883574d48","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:608b35a4c02a385cbe793c667a9904a5b1973dad55977d78b96714a0d3fab2f4","observation_id":"1ba105c4-9f9d-4d29-8966-2e6593d6c5e8","resolution":{"observed_at":"2026-05-15T05:10:02.224410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"covered","venue":null,"work_id":"8b9d9cf7-7a35-4d44-a322-30c737d5212e","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:d054559d89465810447c2858893a63da4ca26041902b21a7091e0d29d1bc8d35","observation_id":"7193d47b-87e6-417f-af6e-0e4f8a04cf8e","resolution":{"observed_at":"2026-05-15T05:10:02.251800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aef318d9-1b8f-40f2-ac06-db7689a3781a","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:3d715c54ac747ee937af5ee6ae06aba133f9f641488d48cf86101154a78e35b3","observation_id":"46f82e03-feb4-4f34-84bd-5647f9cad484","resolution":{"observed_at":"2026-05-15T05:10:02.216683Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"16 ,→ Mbytes","venue":null,"work_id":"18621887-fc4a-4723-87b1-813de4e09415","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:38d7bae4282d3613d520c6f533dae58507303ea67bcab2c5a26e049037048c73","observation_id":"7fdae806-390f-4dfd-b9ac-caf5417f081a","resolution":{"observed_at":"2026-05-15T05:10:02.195678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4dc25a3c-1012-458f-850f-65a5b2be9fbb","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:c2862bb9f7e3ef95896e210a0a84b6204b99df04c3fea98bf69181734273b88e","observation_id":"02230506-b7ef-4b2c-bc36-2daad283c3cf","resolution":{"observed_at":"2026-05-15T05:10:02.220567Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0d81df0f-8ff3-4254-b547-b52435650cd6","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:b49233423eac6906320fa0519e9d1e68a4ced96d76eb783aa4e217ab81cdd096","observation_id":"14168a6c-7ec4-43de-a589-66bdf9e86509","resolution":{"observed_at":"2026-05-15T05:10:02.204210Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Missing ,→ req ui re d items or adding i n c o r r e c t extra items is i n c o n s i s t e n t","venue":null,"work_id":"53b851f7-66c5-40f5-9531-a17f8523782d","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:2be7eac6828a951aed4499ac4873c9daf8bf4449acd9069e74f4f5efd5f3c8aa","observation_id":"a5c37f48-0859-49b4-b8ad-bc28559e1768","resolution":{"observed_at":"2026-05-15T05:10:02.102976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7966f93c-d870-4ccb-a495-bbef5bb1c2b4","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:cec096c4b7f31c81b3e718dc530e067bb0149e96258b1e9bf4be8379a5441b73","observation_id":"cc4a0c37-e64b-436c-b17a-5e330d26202a","resolution":{"observed_at":"2026-05-15T05:10:02.026329Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"If ,→ the name clearly differs , mark it i n c o n s i s t e n t","venue":null,"work_id":"bf542191-a440-4bdc-8c9c-0949297bf40c","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:49cff867e445aa9020482d31b4913acbcc5a845ff9a41e6f22e88fddd0a1df5f","observation_id":"3b57aba0-c499-4b22-9f84-86cea5ceb97c","resolution":{"observed_at":"2026-05-15T05:10:02.116871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Judge only from question , gold_answer , and ,→ m o d e l _ a n s w e r","venue":null,"work_id":"230bfe3a-b667-42a4-a339-1ddbccc9baa9","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:7c7d3845e38569700a3ae1850ec39f0abe33a17561d477ecd8c668ab2df4e769","observation_id":"fa1de118-abf2-4915-b6a1-175f63a07f7f","resolution":{"observed_at":"2026-05-15T05:10:02.122539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"c o n s i s t e n t","venue":null,"work_id":"c2be295b-a89f-45fa-a35c-c2cf1bcae2cc","year":2000},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:4dd8756b470cb855f922cd3b7e6322af9360b1e16bc43231b244387c0a39a585","observation_id":"b5957959-7eda-4fcb-b77f-ffc033b2c85d","resolution":{"observed_at":"2026-05-15T05:10:02.141830Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The input context is restricted to the gold evidence pages while retaining the standard reasoning prompt, removing the page-localization burden","venue":null,"work_id":"020aedc3-a068-4e85-9869-d91276d34c1c","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:32e45de008158f1fb255eb79650e53c419566c3114f7539bf69fb9ef06c335d3","observation_id":"76f7f6b1-40d7-4c88-9f28-637647a5d871","resolution":{"observed_at":"2026-05-15T05:10:02.045556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Building on (1), textual bounding-box descriptions of key evidence re- gions are injected into the prompt, additionally removing the region-grounding burden","venue":null,"work_id":"5ce7c1de-0860-4c95-a48c-249e608dfaae","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:284e8affa40fdf16541a52ac879571efd35f5f8fe9fafcbeef8e7552262f9f60","observation_id":"f3220c94-44fe-4f66-b01d-1ad59acdfb0f","resolution":{"observed_at":"2026-05-15T05:10:01.978235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Building on (2), the atomic facts contained in each annotated region are additionally provided, further removing the perceptual and fact-extraction burden","venue":null,"work_id":"9800b100-2af4-4994-9846-357b019b0010","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:b0b58d9748a84d801f67ee23fc96124b2d91a89b396c1a260a2c27a4153b8e3a","observation_id":"a0cebc6a-e3ed-48fe-8a4d-78946efdab46","resolution":{"observed_at":"2026-05-15T05:10:01.935329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A1: DocScope is a benchmark designed to evaluate the multimodal long-document understanding capabilities of models, primarily targeting question answering over long PDF documents","venue":null,"work_id":"ac391bd1-a857-43b6-9339-427e18afe7b0","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:119debd5ad9f4c165ecbd5038dda33a2ee4518698b7e62ff92bd03ea359b6d38","observation_id":"ec060a3a-869f-4392-86a3-d6f7eb6cd73a","resolution":{"observed_at":"2026-05-15T05:10:01.991976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b6b06cdc-df4d-45d3-b0b5-65731df6cd17","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:19bef2a13ea8f9c3ea90b264d81f37e7cc159fde3c36fc60a68f969c5b0f077d","observation_id":"d86938e4-a997-4361-8883-65e650b48f2c","resolution":{"observed_at":"2026-05-15T05:10:01.970400Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"69604e1d-5b8b-4a08-9c1f-1db9690fa0c4","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:21b7a478c8176206140ec2ae25c4cfacce46f6f4baa3eba8120172b03bb05fe0","observation_id":"4200a799-c4c2-4988-b566-42d92fda20b9","resolution":{"observed_at":"2026-05-15T05:10:02.136698Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A1: DocScope currently contains 1,124 QA instances, each consisting of a question and its corre- sponding answer grounded in a long document","venue":null,"work_id":"0554e6a1-aaa1-44e4-99ba-44c526fdd6a8","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:2ec2a3f5d6d8ee27bcb5dbcca00e5e8e53a4e047d1e5a5abed9b51403aa9d44a","observation_id":"0892faa7-2787-4e51-9822-f6bb379521ff","resolution":{"observed_at":"2026-05-15T05:10:02.074078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"647963d6-a509-4206-be8a-1166dd08fff9","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:c3925636d4f1d0022130e98ffb4feb2182fe9ef783168da5efe9e2373a7a91eb","observation_id":"5a664cfd-f8cc-4bc5-a5de-09b3a1422b23","resolution":{"observed_at":"2026-05-15T05:10:02.173545Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The larger set consists of potential QA pairs constructed from real-world long documents","venue":null,"work_id":"005a4086-522e-4a61-960f-df833cf8e90d","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:abf8df7eeb967c6572a4725e42c2a9f5a9bf886036db46ca31e466b31274670d","observation_id":"f4f1bb07-52f9-4b1e-bba1-a142f5e74073","resolution":{"observed_at":"2026-05-15T05:10:02.015125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The data are provided as raw document-based QA annotations rather than pre-extracted feature representations","venue":null,"work_id":"5dd0c11c-574f-415a-82cf-b8e29fe11481","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:49ff187bb30012743be4fb63d5108d89f188bfe4c41b451b68d4e05ca4f061fb","observation_id":"dc7d8d41-0e3c-4268-b1ee-90ca76d73450","resolution":{"observed_at":"2026-05-15T05:10:02.039597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"47 A5: Y es","venue":null,"work_id":"16014a61-c022-41b6-8eca-68d748259d11","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:ad7309610533f8ac28cea6f83110c56b783933a74e5f7bcdca2093d50fd111f3","observation_id":"a02a5747-4eec-4a74-bd5b-8e8a9087b4be","resolution":{"observed_at":"2026-05-15T05:10:02.107079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"51df194e-bd87-4998-b057-09c1f747f15b","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:c2646b42c38d2f9537c0f241c939cd1f4173bcae444f5be498274c21d44b9e54","observation_id":"795300a3-5ffa-41e3-bc8d-a71fbfead302","resolution":{"observed_at":"2026-05-15T05:10:02.049735Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instances are explicitly categorized by question type and answerability","venue":null,"work_id":"aaa73064-4dbf-4d17-8fc5-3d7969d001b2","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:1ed49fb4d0e29593db71148dbe340ab074c529a1d69fcd72ebea01f62892973a","observation_id":"1de1c7d1-8039-41b5-a324-e66a6dbf6295","resolution":{"observed_at":"2026-05-15T05:10:02.111841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DocScope is primarily intended as an evaluation benchmark and is split into a validation set and a test set","venue":null,"work_id":"3bae8963-ecf0-4be6-b5ca-a7d465b5b464","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:5159c150001724c6475b3105fef59bdeff10a2fd7b0e6406dfb71bad3161ebf4","observation_id":"5366064d-b089-4cba-a13c-ce7ad60e0831","resolution":{"observed_at":"2026-05-15T05:10:02.055687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"However, as the QA pairs are synthesized from complex real-world long documents, residual annotation errors or ambiguous cases may still exist","venue":null,"work_id":"e23fdf00-ac00-48de-806d-173b8724af47","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:55931a7e5a1e1d3363f2642de19efbe7473babb22200b6543f92307906b17513","observation_id":"b50b2971-b40e-49f6-b0f4-21fdbe258ff9","resolution":{"observed_at":"2026-05-15T05:10:02.131748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The released dataset will include the source PDF documents, questions, answers, supporting evidence, evidence bounding-box coordinates, and factual reasoning annotations","venue":null,"work_id":"a40c4372-5a01-4f08-8ecd-2ac3f97f52b3","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:ed3f0a56f2168e5e4716fd1c557d6394f41ff546e234d80fe5f70242b054fd4a","observation_id":"f6f5ad2e-5a8b-4deb-b336-1528d382f856","resolution":{"observed_at":"2026-05-15T05:10:02.182671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The source documents are publicly available documents, and the dataset does not inten- tionally contain conﬁdential information","venue":null,"work_id":"dda64ea4-df57-454d-b5fa-f6ff52a4f733","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:c808f2db5a2b92accd8a53fb1cd2224bf8fd76bb62156bc67ea5ea9e2222cbc1","observation_id":"7eefc9cf-b22f-4ec6-8b27-328beed6952d","resolution":{"observed_at":"2026-05-15T05:10:02.060946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Manual review and ﬁltering were conducted to remove or mitigate offensive, toxic, or sensitive content","venue":null,"work_id":"5d82fbaf-3c8b-499e-9305-ebf32eafe22e","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:4a35409f634e3cf414d70ccbf982caea47f9d76b8a4815a832b9aeffb9c59f06","observation_id":"77f544a7-691f-46e0-aa12-e24b533021d2","resolution":{"observed_at":"2026-05-15T05:10:02.160149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"QA pairs were synthesized using Claude-Opus-4.6 and then strictly reviewed","venue":null,"work_id":"45afb58e-9bfe-4a01-bc43-ad78444bd8f1","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:e565476c2a96bf4b8a1569aeea679a33868ccb4898ee6073c7133c3b68fd9c51","observation_id":"b824bd3c-4eff-4621-8dea-9a7107ce9189","resolution":{"observed_at":"2026-05-15T05:10:02.155408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5bdd43ba-617d-4cf3-846a-0f4f805080bf","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:9a76462d966b5488d7bc5addfc64038a8a3582e786bc6efe6bcf0647bee830f6","observation_id":"c9965207-8a82-4739-b0e5-e7dc40b5839a","resolution":{"observed_at":"2026-05-15T05:10:02.064837Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c8dd6c48-29e8-4367-ab8a-5132bc0943d5","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:db7a3027316a364e54d044c9a2dcc1b9d4b47b78605fcabb9139690266ee63db","observation_id":"c4360f86-a3ab-492b-8c68-82abbd0210e3","resolution":{"observed_at":"2026-05-15T05:10:02.078785Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The annotators worked for approximately ﬁve days and were compensated","venue":null,"work_id":"2777b20c-b5c0-4651-ae78-fb696d4cce0c","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:52fbccfd012664354429ccabb739947da05dcba1610a37d4c64335c3e5578f9f","observation_id":"83becdf8-a0d7-4dc6-a45e-212498ae7f74","resolution":{"observed_at":"2026-05-15T05:10:02.083387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"48 H.4 Preprocessing/cleaning/labeling","venue":null,"work_id":"4e0a6f89-0a09-4700-bb27-e82286b9892f","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:3b9db7b68295df7c3f88c741d9be6b53de2b088b450e0890c00eb0180d11b57c","observation_id":"bf0a3dcd-eca2-4b6c-ab92-55f773aaa4c1","resolution":{"observed_at":"2026-05-15T05:10:01.957242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The dataset construction involved QA synthesis, evidence annotation, bounding-box an- notation, factual reasoning annotation, and strict review","venue":null,"work_id":"cc58ef75-f90b-4f47-8489-7a249af72ce1","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:0229c0f7483babc027248754a1d4f0dd6a3298d325b471b0e196ed5e282922e6","observation_id":"eb9bbe3f-397b-40c7-9e5b-4cc1ef0dda14","resolution":{"observed_at":"2026-05-15T05:10:02.088878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Data decontamination was conducted through manual review and experimental checks to remove contaminated and duplicate instances","venue":null,"work_id":"35747925-7827-4c72-af98-c06ffe99e3a0","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:61365697d8748cb7c5db167407fa014faf4c166f60488f0d7bb95aacbd8ebd63","observation_id":"97f69336-5d69-4bdd-b05e-270cb0a1b6fd","resolution":{"observed_at":"2026-05-15T05:10:02.094060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The tools and scripts used for data generation will be released","venue":null,"work_id":"7c1d84bb-a549-41a5-8bf7-8d4a657738df","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:19cc2c8499359857c67b392a702c89946938f19641c6cbfcf6c0a829262870b3","observation_id":"62cfa16a-f83b-480a-a82e-8d158c3c24f3","resolution":{"observed_at":"2026-05-15T05:10:02.008581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A1: Y es","venue":null,"work_id":"918b40c4-fa56-4300-bb2b-351a7b34885f","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:2a9b7bd5bd422346e072b51233404bc40a4091e7786cf79eb5ef74a421fd407d","observation_id":"36982681-1e70-4509-b6ae-0b4af9ccb9df","resolution":{"observed_at":"2026-05-15T05:10:02.126783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0f4799a1-d163-430a-aed0-f5410c4f8e0a","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:9a3362feabe7dbc32410a3cc42db0d61c305fc2249ba679350372b1a12911bd4","observation_id":"4f1956e3-6249-402d-8f70-1e66c4248aa7","resolution":{"observed_at":"2026-05-15T05:10:02.146164Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c0285836-6afe-4f6a-9f19-16e68e8f75c8","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:6654146466ea1d6e79767002d55c5984421ad8c1afbbbe1254ef51f578e1e949","observation_id":"5022467a-2f22-44ba-aff6-e0932be64858","resolution":{"observed_at":"2026-05-15T05:10:02.186560Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fu- ture users should consider DocScope as an evaluation benchmark rather than a fully exhaustive representation of all long-document understanding scenarios","venue":null,"work_id":"78f65e4f-9c86-4a88-9929-9454049d6110","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:add8c787311a1274aa718fcf92c77047364581fcd8f46ed401b07cf90928c843","observation_id":"abbb6a7d-c77d-43e3-9bfb-4cd2b6d1d24b","resolution":{"observed_at":"2026-05-15T05:10:01.942712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a6abd951-e851-4574-8bb0-3bdf48c8d83d","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:b4b3affde2cd5c4cb37d671d89800f4fb8869e0ffb655e5a12ebe159da5a3bd5","observation_id":"a9fe33b0-2c46-4315-985f-16944b3505db","resolution":{"observed_at":"2026-05-15T05:10:02.002529Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A1: Y es","venue":null,"work_id":"3cb93fdf-153c-4410-818f-d53f0ef4f5ae","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:50f3403db5b80d888371745329d2c91a50f1f79affc3addef22bb9aa38ab845c","observation_id":"313e5e20-d98e-4d81-b124-67fd3485e16c","resolution":{"observed_at":"2026-05-15T05:10:02.020615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"No DOI is currently available","venue":null,"work_id":"61465f69-2e14-4bf7-81d7-cc65750b1a19","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:247ee4477e05c6176fd1ff320f09e55e2a19b502afab879eb83649a5e564e1ca","observation_id":"0043eaeb-96fe-4ffd-afbd-8dcd2daa996c","resolution":{"observed_at":"2026-05-15T05:10:02.177882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"569191bb-7157-496a-8616-1e6022298713","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:8f3b56fe8441fb9a80a1e4ede569ff7fa31a05d54da6630b32210f2fd3c2e634","observation_id":"c4421f2a-320c-4658-9bda-eb926a71ebbb","resolution":{"observed_at":"2026-05-15T05:10:02.150586Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The dataset will be distributed under the Creative Commons Attribution-NonCommercial- ShareAlike 4.0 International License (CC BY -NC-SA 4.0)","venue":null,"work_id":"497cd552-1a18-4069-a5b7-2848f9856262","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:6117bb878028d1df08dd0e421aeba1b3ab1f8928c76f9e9472a6381b5a14940b","observation_id":"e222ea3d-0f27-4a80-8bfa-1da863fc0f7f","resolution":{"observed_at":"2026-05-15T05:10:02.164788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The source documents are from publicly available resources, and no third-party IP-based or other restrictions have been imposed on the dataset","venue":null,"work_id":"c5d10557-734d-44d0-a3ae-4169864e0ce4","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:badaefea657ea833cee7c45ea506593f870e51abc5c8c910b884d39de516b138","observation_id":"414e4aff-d0f8-4606-a312-ba7e43abee8f","resolution":{"observed_at":"2026-05-15T05:10:01.984811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"H.7 Maintenance","venue":null,"work_id":"19349ceb-c338-4710-9398-7e134a926ce4","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:c3253d8ec19695fc3f738663240a6026bd8fe0dae0244551d7ee34444b4d7359","observation_id":"7948185d-7a60-480c-95cc-775cc7b88a85","resolution":{"observed_at":"2026-05-15T05:10:01.928197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b6cec311-af53-4fc1-a4fd-c979f876ea17","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:7b0b80b983ef83db0b2c316bb2f59c1567426b5594ec5e88cf82c54ff0296a35","observation_id":"b17bf033-bc56-4ff9-a100-51d42ae3968d","resolution":{"observed_at":"2026-05-15T05:10:02.098502Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e26df724-a048-459d-833c-cb16790db9a6","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:d7a2b8b96d767c8f6ab3ced060211e413b812640e315b931f3dd76666409e469","observation_id":"b754b1ad-0253-4549-aba0-4ed67531a899","resolution":{"observed_at":"2026-05-15T05:10:01.949874Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A3: Any errata will be posted on the project GitHub repository","venue":null,"work_id":"50b6c664-f495-40b2-8dcd-697a001b7e3d","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:0bd7b5af8ec4b22daa037eb69a3aa7cb3bdc78aa1965c30990600b7e6cbb41d8","observation_id":"1b583b51-8686-44d1-aa7c-a6d5ec0aaeee","resolution":{"observed_at":"2026-05-15T05:10:01.921063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The authors plan to update the dataset, and updates will be communicated through the ofﬁcial GitHub and Hugging Face repositories","venue":null,"work_id":"de29fff0-ecbe-462c-b935-46a8de040de6","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:87caa8213aa734c1ac99a13c5646e84daf17e1a2335be70d5a72a6491b0a7ef9","observation_id":"1f24961f-54b9-4b02-a4ac-8888ff70ecc0","resolution":{"observed_at":"2026-05-15T05:10:01.964105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A5: Y es","venue":null,"work_id":"e51b540c-fe53-41c1-9a99-ac8bf12f5ee5","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:3d2b9ff10b97bef12282e0cc373bb52ac205bf7d3c58bfa0022ad200202c5fd9","observation_id":"1ed364e2-ff40-4124-9373-2349a1d91f59","resolution":{"observed_at":"2026-05-15T05:10:02.031523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b8a44cbe-cb49-4f69-8e8f-85045fa7c5f6","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:46d707f91489f1939937c6cc58266096e866a302c0a97c59273228b246147f98","observation_id":"1958ade6-f0c5-4aec-aca1-6c78f0f03d0f","resolution":{"observed_at":"2026-05-15T05:10:02.169297Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":41},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 3 inbound Pith citation observations for arXiv:2605.08888."}