{"as_of":"2026-08-12T12:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:77564f725ce6194892ed7297add286e0d78e271451564f414cf0b276ff598819","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:13:17.797667Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:22:44.774647Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:19:50.245560Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"cited_work":{"arxiv_id":"2506.11440","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11440","snapshot_observed_at":"2026-07-04T13:19:50.245560Z","title":"Y., Shrivastava, A., Moore, J., West, P., Tan, C","venue":null,"work_id":"86829f56-885f-4074-83a8-248b3d67382d","year":2025},"citing_paper":{"arxiv_id":"2512.03053","last_updated":"2026-04-16T21:39:03Z","snapshot_observed_at":"2026-08-02T21:53:03.786766Z","submitted_at":"2025-11-25T00:47:02Z","title":"Mitigating hallucinations and omissions in LLMs for invertible problems: An application to hardware logic design automation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-17T05:24:05.830241Z"},"links":{"cited_paper":"/paper/2506.11440","citing_paper":"/paper/2512.03053"},"observation_digest":"sha256:e98d8f150cf41e173d714405379a64e53373666f80d5168a64a0eab7e7187513","observation_id":"a529bcd7-92a9-4507-b7d0-d067eb575c35","resolution":{"observed_at":"2026-05-17T05:29:05.107544Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"cited_work":{"arxiv_id":"2506.11440","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11440","snapshot_observed_at":"2026-07-04T13:19:50.245560Z","title":"Y., Shrivastava, A., Moore, J., West, P., Tan, C","venue":null,"work_id":"86829f56-885f-4074-83a8-248b3d67382d","year":2025},"citing_paper":{"arxiv_id":"2604.26145","last_updated":"2026-05-22T17:07:34Z","snapshot_observed_at":"2026-07-06T23:11:52.954360Z","submitted_at":"2026-04-28T22:05:57Z","title":"Ceci n'est pas une explication: Evaluating Explanation Failures as Explainability Pitfalls in Language Learning Systems","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-07T15:12:00.081798Z"},"links":{"cited_paper":"/paper/2506.11440","citing_paper":"/paper/2604.26145"},"observation_digest":"sha256:b6e6c2621c68919fa8eea7ff980c4d622aaa8516672153deb24b0586157409ee","observation_id":"d5bceb12-34fd-4946-9055-885ddeb8c53e","resolution":{"observed_at":"2026-05-12T00:31:17.313713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"cited_work":{"arxiv_id":"2506.11440","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11440","snapshot_observed_at":"2026-07-04T13:19:50.245560Z","title":"Y., Shrivastava, A., Moore, J., West, P., Tan, C","venue":null,"work_id":"86829f56-885f-4074-83a8-248b3d67382d","year":2025},"citing_paper":{"arxiv_id":"2604.26145","last_updated":"2026-05-22T17:07:34Z","snapshot_observed_at":"2026-07-06T23:11:52.954360Z","submitted_at":"2026-04-28T22:05:57Z","title":"Ceci n'est pas une explication: Evaluating Explanation Failures as Explainability Pitfalls in Language Learning Systems","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-25T06:31:00.249428Z"},"links":{"cited_paper":"/paper/2506.11440","citing_paper":"/paper/2604.26145"},"observation_digest":"sha256:00d1af93352664b175041ae1eb8de12c49e0bb441d3f8a3fe714e9f64185ffcc","observation_id":"27e3d2c1-b4be-484d-9a5b-c41848ca5ebf","resolution":{"observed_at":"2026-05-25T06:35:25.217000Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"cited_work":{"arxiv_id":"2506.11440","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11440","snapshot_observed_at":"2026-07-04T13:19:50.245560Z","title":"Y., Shrivastava, A., Moore, J., West, P., Tan, C","venue":null,"work_id":"86829f56-885f-4074-83a8-248b3d67382d","year":2025},"citing_paper":{"arxiv_id":"2606.02680","last_updated":"2026-06-01T15:56:31Z","snapshot_observed_at":"2026-07-06T23:43:02.654629Z","submitted_at":"2026-06-01T15:56:31Z","title":"Locality Does Not Imply Reachability: Boundary Repair in Block-Sparse Causal Attention","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T15:34:46.265644Z"},"links":{"cited_paper":"/paper/2506.11440","citing_paper":"/paper/2606.02680"},"observation_digest":"sha256:ba935ef99603b6ae68e8fafd6b83d3c889676d4786ff327a61bc08dd11bdde52","observation_id":"85b9209b-8f41-477c-a373-1c1bcf0298e8","resolution":{"observed_at":"2026-07-01T22:16:16.395398Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"cited_work":{"arxiv_id":"2506.11440","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11440","snapshot_observed_at":"2026-07-04T13:19:50.245560Z","title":"Y., Shrivastava, A., Moore, J., West, P., Tan, C","venue":null,"work_id":"86829f56-885f-4074-83a8-248b3d67382d","year":2025},"citing_paper":{"arxiv_id":"2606.26529","last_updated":"2026-08-02T07:15:01Z","snapshot_observed_at":"2026-08-06T23:24:45.715072Z","submitted_at":"2026-06-25T02:09:08Z","title":"The inattentional gap in task conditioned AI models that omit otherwise reportable safety critical signals","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T05:24:11.228672Z"},"links":{"cited_paper":"/paper/2506.11440","citing_paper":"/paper/2606.26529"},"observation_digest":"sha256:62386633deee84df537df5390c1f65007f55f6836532aaab525f41dbee6f9bed","observation_id":"3c3b00df-813b-4824-b32f-191aab9e1cd9","resolution":{"observed_at":"2026-07-04T13:19:50.247302Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11440","snapshot_observed_at":"2026-07-12T11:58:52.700648Z","title":"Y., Shrivastava, A., Moore, J., West, P., Tan, C","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26529","last_updated":"2026-08-02T07:15:01Z","snapshot_observed_at":"2026-08-06T23:24:45.715072Z","submitted_at":"2026-06-25T02:09:08Z","title":"The inattentional gap in task conditioned AI models that omit otherwise reportable safety critical signals","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-12T11:58:52.700648Z"},"links":{"cited_paper":"/paper/2506.11440","citing_paper":"/paper/2606.26529"},"observation_digest":"sha256:d13c0283243d029a906753dac3f0a38caf4593396ba1ada97f15221c785ff046","observation_id":"de7b2486-b4fc-40ae-9dac-3c900777e07b","resolution":{"observed_at":"2026-07-12T11:58:52.700648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11440","snapshot_observed_at":"2026-08-04T04:42:46.166372Z","title":"Y., Shrivastava, A., Moore, J., West, P., Tan, C","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26529","last_updated":"2026-08-02T07:15:01Z","snapshot_observed_at":"2026-08-06T23:24:45.715072Z","submitted_at":"2026-06-25T02:09:08Z","title":"The inattentional gap in task conditioned AI models that omit otherwise reportable safety critical signals","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T04:42:46.166372Z"},"links":{"cited_paper":"/paper/2506.11440","citing_paper":"/paper/2606.26529"},"observation_digest":"sha256:c91eb3751e5bb092221f77e2eadff2eb4335afd80de906933634dd05e4fb902f","observation_id":"c04a9899-bad2-4526-b63f-f5d0e9e2010e","resolution":{"observed_at":"2026-08-04T04:42:46.166372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11440","snapshot_observed_at":"2026-08-06T21:22:44.774647Z","title":"arXiv preprint arXiv:2506.11440 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04591","last_updated":"2026-08-05T08:53:16Z","snapshot_observed_at":"2026-08-09T20:11:58.542089Z","submitted_at":"2026-08-05T08:53:16Z","title":"When Absence Is Evidence: Evaluating Completeness-Sensitive Negative Reasoning in Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T21:22:44.774647Z"},"links":{"cited_paper":"/paper/2506.11440","citing_paper":"/paper/2608.04591"},"observation_digest":"sha256:a5795964404f0f737f606c12ea8a246d91bc85ddcaced7de8b476fb505ecfe69","observation_id":"f0cc3f5a-3a52-4705-8a0d-733ca1a87e7f","resolution":{"observed_at":"2026-08-06T21:22:44.774647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.11440/citation-record","integrity":"/paper/2506.11440/integrity","json":"/paper/2506.11440/citation-record.json","paper":"/paper/2506.11440"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.11018","last_updated":"2024-10-17T17:45:09Z","snapshot_observed_at":"2026-07-06T18:01:18.745347Z","submitted_at":"2024-04-17T02:49:26Z","title":"Many-Shot In-Context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.11018","snapshot_observed_at":"2026-08-07T04:13:17.648452Z","title":"Zhang, Bernd Bohnet, Luis Rosias, Stephanie Chan, Biao Zhang, Ankesh Anand, Zaheer Abbas, Azade Nova, John D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.648452Z"},"links":{"cited_paper":"/paper/2404.11018","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:1c8cb4f1dc065d5d5fe5e01e5151da0a066e5a1d1bd4808bf5d0a8dda6d94318","observation_id":"9bd0fe80-df29-4d2b-a589-d3c6b0e632c2","resolution":{"observed_at":"2026-08-07T04:13:17.648452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-07T04:13:17.652986Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.652986Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:6b398dd9312d850479c30a1a0fd2f5a1fe1cb1cd38178f795e62ef032abc154b","observation_id":"dd26a989-0335-450d-9d89-aa1080f9a8d6","resolution":{"observed_at":"2026-08-07T04:13:17.652986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.11088","last_updated":"2023-10-04T10:04:25Z","snapshot_observed_at":"2026-08-09T07:56:50.464493Z","submitted_at":"2023-07-20T17:59:41Z","title":"L-Eval: Instituting Standardized Evaluation for Long Context Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.11088","snapshot_observed_at":"2026-08-07T04:13:17.656859Z","title":"L-eval: Instituting standardized evaluation for long context language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.656859Z"},"links":{"cited_paper":"/paper/2307.11088","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:a912561b243054e3ac47c0112596d14e85c12dfc88922b6b177e688a986b6c7e","observation_id":"56e6fd7a-77b1-4878-bb0d-11a3c679c1f8","resolution":{"observed_at":"2026-08-07T04:13:17.656859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.262574Z","title":"Bowman, Ethan Perez, Roger Baker Grosse, and David Duvenaud","venue":null,"work_id":"f263939f-8200-4956-82f6-93390f7940d7","year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.660267Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:91868f22c16d4515c0039c0f445be130a9f94b84a339442bd3b6a2c8696fcc15","observation_id":"cdcc8374-c029-4222-ba5e-64aaaac30c8c","resolution":{"observed_at":"2026-08-07T04:13:18.265746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.253313Z","title":"Claude 3 haiku: our fastest model yet, 2024","venue":null,"work_id":"8b16802a-0542-4d16-8f7e-03fb5b618b0c","year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.663450Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:b8b9ad371607cce8de4cc6d5be9407f0610e7302f76d59f72164040ab6bc281f","observation_id":"59e6c12b-1be1-44d5-aa28-03d6df593380","resolution":{"observed_at":"2026-08-07T04:13:18.256396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14508","last_updated":"2024-06-19T04:00:32Z","snapshot_observed_at":"2026-08-08T03:49:18.086396Z","submitted_at":"2023-08-28T11:53:40Z","title":"LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14508","snapshot_observed_at":"2026-08-07T04:13:17.666475Z","title":"Longbench: A bilingual, multitask benchmark for long context understanding, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.666475Z"},"links":{"cited_paper":"/paper/2308.14508","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:5c38f310c2e1010a8405c1eba5804368ed420d4e98ac3ada8654fe693701a72a","observation_id":"4b240ed1-6152-4706-af7c-a8f15e1ee392","resolution":{"observed_at":"2026-08-07T04:13:17.666475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01625","last_updated":"2023-10-30T19:44:47Z","snapshot_observed_at":"2026-07-06T15:22:25.008777Z","submitted_at":"2023-05-02T17:35:08Z","title":"Unlimiformer: Long-Range Transformers with Unlimited Length Input","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01625","snapshot_observed_at":"2026-08-07T04:13:17.670308Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.670308Z"},"links":{"cited_paper":"/paper/2305.01625","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:77b5eede8e6220fc18540a658f04ae3c51e95b8fc8f4794e433433904ca7d254","observation_id":"26baed68-fc15-4741-9621-68208e1e5924","resolution":{"observed_at":"2026-08-07T04:13:17.670308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00785","last_updated":"2024-04-13T22:02:23Z","snapshot_observed_at":"2026-08-04T16:19:28.848684Z","submitted_at":"2023-10-01T20:46:44Z","title":"BooookScore: A systematic exploration of book-length summarization in the era of LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00785","snapshot_observed_at":"2026-08-07T04:13:17.673581Z","title":"Booookscore: A systematic exploration of book-length summarization in the era of llms, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.673581Z"},"links":{"cited_paper":"/paper/2310.00785","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:293f1c64cded2b5700a60df6e4d89280c03c9cb223f4e9c10b4cc94a0f8a19a9","observation_id":"b11f4f4b-22c4-454e-8ca2-8d6c6f6f1730","resolution":{"observed_at":"2026-08-07T04:13:17.673581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15595","last_updated":"2023-06-28T04:26:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-27T16:26:26Z","title":"Extending Context Window of Large Language Models via Positional Interpolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15595","snapshot_observed_at":"2026-08-07T04:13:17.676871Z","title":"Extending context window of large language models via positional interpolation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.676871Z"},"links":{"cited_paper":"/paper/2306.15595","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:0a581cbc679deb9ec1866456529add8cb9260fbc46a9c3f3811875db50d8aac5","observation_id":"6acd2405-5ee4-40df-ae14-56d6fbbad1a0","resolution":{"observed_at":"2026-08-07T04:13:17.676871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21060","last_updated":"2024-05-31T17:50:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:50:01Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21060","snapshot_observed_at":"2026-08-07T04:13:17.679986Z","title":"Transformers are ssms: Generalized models and efficient algorithms through structured state space duality, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.679986Z"},"links":{"cited_paper":"/paper/2405.21060","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:a2b53f0e58f73e83520602309e2e5236819aace27742b174e44b0c36642e7d47","observation_id":"b4aeb2d8-1861-4e57-b56d-81de0cdde438","resolution":{"observed_at":"2026-08-07T04:13:17.679986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T04:13:17.683266Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.683266Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:bc66800fcfbccdd2a64864726bb110f03c8beafac9ae7da3b780906455ef1989","observation_id":"86d5eac7-5bc7-4027-b66b-cf8d190b1f3c","resolution":{"observed_at":"2026-08-07T04:13:17.683266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13867","last_updated":"2023-07-20T17:59:14Z","snapshot_observed_at":"2026-08-10T14:34:25.208217Z","submitted_at":"2023-01-31T18:59:03Z","title":"Mathematical Capabilities of ChatGPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13867","snapshot_observed_at":"2026-08-07T04:13:17.686818Z","title":"Mathematical capabilities of chatgpt, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.686818Z"},"links":{"cited_paper":"/paper/2301.13867","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:ffed3436c8e8ef62f55235e469892318ccf7bafc10158717635ecbacc5c48079","observation_id":"ce77bd0a-7837-4a4f-9fcd-ff3e30cd340a","resolution":{"observed_at":"2026-08-07T04:13:17.686818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06646","last_updated":"2023-02-13T19:19:23Z","snapshot_observed_at":"2026-08-10T02:23:06.245291Z","submitted_at":"2023-02-13T19:19:23Z","title":"Simple Hardware-Efficient Long Convolutions for Sequence Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.06646","snapshot_observed_at":"2026-08-07T04:13:17.690031Z","title":"Fu, Elliot L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.690031Z"},"links":{"cited_paper":"/paper/2302.06646","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:f7abd5c5ab572a7314a5674d4cf4cf0fa861c43c7ab9d577dd7363fb53aad463","observation_id":"8c8f867e-c763-44a5-b07b-fafc618db48c","resolution":{"observed_at":"2026-08-07T04:13:17.690031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:17.693121Z","title":"How to train long-context language models (effectively), 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.693121Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:f7656ba44b03b88b18c71b73a626ca5beee0924989e21a53fbacac7a728c39c0","observation_id":"91348c31-eb1e-4342-aa92-49a2c48aff3f","resolution":{"observed_at":"2026-08-07T04:13:17.693121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.244457Z","title":"Gemini 2.5: Our most intelligent ai model, 2025","venue":null,"work_id":"f7c95de1-0204-4274-a3ca-4bc38df0f103","year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.695912Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:1ff39a8a76fe28e2b42d4ede6c9a9be84ef57ecdfd07093f36aa1cd9234fade9","observation_id":"314cd94a-af43-44cc-b755-1474571bdac2","resolution":{"observed_at":"2026-08-07T04:13:18.247436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T04:13:17.699059Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.699059Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:2bddea57b461d728586d1e5dcaeba7ac221c1239446b77e3bfaf7d6aaa14e2cc","observation_id":"3a79523c-c853-49ec-a913-ac6ebc8bd7ff","resolution":{"observed_at":"2026-08-07T04:13:17.699059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-07T04:13:17.702868Z","title":"Mamba: Linear-time sequence modeling with selective state spaces, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.702868Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:e4cd6d6863e12696c87df3877d82f841291120ca368d49430621dc3ecb0e0e40","observation_id":"95615ecf-e4c3-4f3f-afe8-9f3d94364ce2","resolution":{"observed_at":"2026-08-07T04:13:17.702868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-08-10T09:20:57.804343Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-08-07T04:13:17.705952Z","title":"Ruler: What's the real context size of your long-context language models?, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.705952Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:4125a7ae77430fd51e7972147f50d25c3509d7559ea7a42cc072aa19de7bb70f","observation_id":"534072d9-ab58-442f-a018-96860604436e","resolution":{"observed_at":"2026-08-07T04:13:17.705952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-07T04:13:17.709044Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.709044Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:97f42a27175c3ae14ba1c22df7b799f0bd1bb0e27500229cd7c879225b518b1b","observation_id":"23c9b130-cb9c-4e0c-97d7-b9063af6f734","resolution":{"observed_at":"2026-08-07T04:13:17.709044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.235324Z","title":"Needle in a haystack - pressure testing llms, 2023","venue":null,"work_id":"943b5767-1da6-4cf6-b222-1ce53009a4f9","year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.712296Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:0813cd4044ab24f61eee04a11bdb569605fbaa43ac89d5a1c95221fb0f976c3c","observation_id":"984be04b-3503-41a5-b086-912982775004","resolution":{"observed_at":"2026-08-07T04:13:18.238761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01261","last_updated":"2024-09-30T17:39:59Z","snapshot_observed_at":"2026-08-08T11:10:01.706250Z","submitted_at":"2024-04-01T17:33:38Z","title":"FABLES: Evaluating faithfulness and content selection in book-length summarization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01261","snapshot_observed_at":"2026-08-07T04:13:17.715567Z","title":"Fables: Evaluating faithfulness and content selection in book-length summarization, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.715567Z"},"links":{"cited_paper":"/paper/2404.01261","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:4a6ddef29f60bd89ad07b29fbb0b00016f3e4b3ea274d86eb13328b219daad02","observation_id":"23c904a3-feed-4302-b6b7-fc1b8b932fd3","resolution":{"observed_at":"2026-08-07T04:13:17.715567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17012","last_updated":"2024-09-25T16:57:20Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T06:53:10Z","title":"Benchmarking Cognitive Biases in Large Language Models as Evaluators","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17012","snapshot_observed_at":"2026-08-07T04:13:17.718512Z","title":"Benchmarking cognitive biases in large language models as evaluators, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.718512Z"},"links":{"cited_paper":"/paper/2309.17012","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:ec6498509045d0d3dfb8b41a9dbc150c08a1a188cc1266bb601244c27f960ef7","observation_id":"6c134385-792b-4c51-9ea6-155b1800f4e3","resolution":{"observed_at":"2026-08-07T04:13:17.718512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.07040","last_updated":"2017-12-19T16:48:05Z","snapshot_observed_at":"2026-07-31T01:20:29.856066Z","submitted_at":"2017-12-19T16:48:05Z","title":"The NarrativeQA Reading Comprehension Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.07040","snapshot_observed_at":"2026-08-07T04:13:17.721714Z","title":"The narrativeqa reading comprehension challenge, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.721714Z"},"links":{"cited_paper":"/paper/1712.07040","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:e1747174f692ddba04ddbee99bc97d2a55425deb384495a4b7b9c50fc42e4241","observation_id":"3e5344b0-c219-46e2-99c1-86b488710e7e","resolution":{"observed_at":"2026-08-07T04:13:17.721714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13121","last_updated":"2024-06-19T00:28:58Z","snapshot_observed_at":"2026-07-06T18:33:24.206083Z","submitted_at":"2024-06-19T00:28:58Z","title":"Can Long-Context Language Models Subsume Retrieval, RAG, SQL, and More?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13121","snapshot_observed_at":"2026-08-07T04:13:17.725291Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.725291Z"},"links":{"cited_paper":"/paper/2406.13121","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:ce5c29f424e18e43dac1f3f90b451afd842904d0796728833a4816991b85b401","observation_id":"7bffc137-3dd6-44fc-9766-b3b995853ebb","resolution":{"observed_at":"2026-08-07T04:13:17.725291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.225762Z","title":"The llama 4 herd: The beginning of a new era of natively multimodal ai innovation, 2025","venue":null,"work_id":"5fca47bb-6c45-4e16-af12-a18eee20c828","year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.728350Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:4b9c0721848c3088de2b54ba18c1171375055aef10463b55cd5790d96eeee0cd","observation_id":"0f02fd82-05aa-4263-8a70-41a75902de14","resolution":{"observed_at":"2026-08-07T04:13:18.228912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.216588Z","title":"Openai o3-mini, pushing the frontier of cost-effective reasoning., 2025","venue":null,"work_id":"3a1636e1-f06f-4715-a46e-11314785e94f","year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.731389Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:cf664cf57c2c37e3e56bb56a5b71968a6f10ab95d89928e47feba20c7b5b4f7b","observation_id":"48a5b14c-7bf1-4424-8f5f-cd326fc48a71","resolution":{"observed_at":"2026-08-07T04:13:18.219852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T04:13:17.734425Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.734425Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:8ca8f1cc060942e303a52939dcf2e2365ab128b5c5fe826f2f852dd92a62b42e","observation_id":"1f0529d3-daf8-4b7f-8057-ad04af79bf06","resolution":{"observed_at":"2026-08-07T04:13:17.734425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T04:13:17.737879Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.737879Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:cf06f3e261fdad6936c9683ec8cb888e1115f045a9123c10ee80d96f7ee7341d","observation_id":"9e74647e-5850-4944-af1d-86d0873be01a","resolution":{"observed_at":"2026-08-07T04:13:17.737879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.207774Z","title":"gutenberg-poetry-corpus: A corpus of poetry from project gutenberg, 2018","venue":null,"work_id":"2672ce1e-17d9-4f1d-b162-ef66d81deeab","year":2018},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.741220Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:135eccb8290e276b3281ce760146adfa3fbf3884f5a3ca1ddd5fbafc66ae30c0","observation_id":"9ccfa6f8-8ac4-4fc3-a740-588bac6e9edd","resolution":{"observed_at":"2026-08-07T04:13:18.210950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13048","last_updated":"2023-12-11T03:58:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-22T13:57:41Z","title":"RWKV: Reinventing RNNs for the Transformer Era","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13048","snapshot_observed_at":"2026-08-07T04:13:17.744118Z","title":"Wind, Stanislaw Wozniak, Ruichong Zhang, Zhenyuan Zhang, Qihang Zhao, Peng Zhou, Qinghua Zhou, Jian Zhu, and Rui-Jie Zhu","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.744118Z"},"links":{"cited_paper":"/paper/2305.13048","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:d7f134867d80805ffb68de7b3480299dedf766c107a59b870e08d1e56bf07e3d","observation_id":"0b8b784a-e963-4eea-88f9-63e0b67a47c8","resolution":{"observed_at":"2026-08-07T04:13:17.744118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.12409","last_updated":"2022-04-22T18:20:48Z","snapshot_observed_at":"2026-08-07T11:26:24.970964Z","submitted_at":"2021-08-27T17:35:06Z","title":"Train Short, Test Long: Attention with Linear Biases Enables Input Length Extrapolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.12409","snapshot_observed_at":"2026-08-07T04:13:17.747278Z","title":"Smith, and Mike Lewis","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.747278Z"},"links":{"cited_paper":"/paper/2108.12409","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:21148874b9e6bf48768501ee8432e764c7619aecba0097ccd330c601f5dbd780","observation_id":"f0555fb9-7405-4359-b81d-a649a992860b","resolution":{"observed_at":"2026-08-07T04:13:17.747278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.199005Z","title":"Qwen3 technical report, 2025 a","venue":null,"work_id":"ad61539f-cf60-4cfe-b660-798ba7685805","year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.751186Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:36fac16d0a2941b47c85310b5141bb2e2242a10e17f883d90521377c474120bf","observation_id":"0fb76f57-1b76-41a0-8d9c-66565c113efe","resolution":{"observed_at":"2026-08-07T04:13:18.202173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.189716Z","title":"Qwq-32b: Embracing the power of reinforcement learning, 2025 b","venue":null,"work_id":"bff0abe8-11a6-4ca6-b827-883190c1b7f2","year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.754563Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:469578d0240869a85f5120154463d43d549f6e6fcacf33c9d6db27c15663b1d8","observation_id":"624fdfa1-57c7-4b31-aa60-6f6d80e6ebb9","resolution":{"observed_at":"2026-08-07T04:13:18.192878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-07-06T16:10:07.931347Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-07T04:13:17.757980Z","title":"Code llama: Open foundation models for code, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.757980Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:f9a81601dd7672eb5b26cfe44576069009f0707b14d95a1263da4e950d671527","observation_id":"5ef853bc-f219-4f16-baf3-d60978a1bcf4","resolution":{"observed_at":"2026-08-07T04:13:17.757980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:17.761186Z","title":"Z ero SCROLLS : A zero-shot benchmark for long text understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.761186Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:ccea28e455b5be40329024186bbbcd0adb93f9dc095f3048b23c67b2f9107dcf","observation_id":"6d8bb6cf-7172-4920-9c7b-ee88dc9a0926","resolution":{"observed_at":"2026-08-07T04:13:17.761186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-08-12T04:55:58.532015Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-07T04:13:17.764087Z","title":"Roformer: Enhanced transformer with rotary position embedding, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.764087Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:6d5ecad91f14b2628cfc8dd9667afc8782b489d16fc00ed3ab1cc463e589e4fa","observation_id":"5f5985b6-1d6a-4717-94f6-42bb50b8cfe6","resolution":{"observed_at":"2026-08-07T04:13:17.764087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10554","last_updated":"2022-12-20T18:56:20Z","snapshot_observed_at":"2026-08-09T00:51:36.452647Z","submitted_at":"2022-12-20T18:56:20Z","title":"A Length-Extrapolatable Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10554","snapshot_observed_at":"2026-08-07T04:13:17.767285Z","title":"A length-extrapolatable transformer, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.767285Z"},"links":{"cited_paper":"/paper/2212.10554","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:296a1855c1b001b9fcee633d0a8c6d9b3e04abb6a8fc4601ccc00120054169b0","observation_id":"779560ff-d125-4b76-a476-ab4d55c1d77c","resolution":{"observed_at":"2026-08-07T04:13:17.767285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:17.770366Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.770366Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:ca46500e4c0b975c24f462724a34caed0babd7a820258a5ac61a96c45086509d","observation_id":"ef0c8129-be67-40d4-8a09-820e953193ad","resolution":{"observed_at":"2026-08-07T04:13:17.770366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12640","last_updated":"2024-09-20T00:47:33Z","snapshot_observed_at":"2026-08-12T01:26:07.252826Z","submitted_at":"2024-09-19T10:38:01Z","title":"Michelangelo: Long Context Evaluations Beyond Haystacks via Latent Structure Queries","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12640","snapshot_observed_at":"2026-08-07T04:13:17.773223Z","title":"Michelangelo: Long context evaluations beyond haystacks via latent structure queries, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.773223Z"},"links":{"cited_paper":"/paper/2409.12640","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:0648b428a68dcbcb851faba7b24e5497f9dab1224bcc8d91097087833e1a7b0a","observation_id":"41be1d9e-0019-4b67-bfaf-49151455a136","resolution":{"observed_at":"2026-08-07T04:13:17.773223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12766","last_updated":"2025-04-23T12:52:18Z","snapshot_observed_at":"2026-08-12T12:22:31.705535Z","submitted_at":"2024-03-18T17:32:32Z","title":"NovelQA: Benchmarking Question Answering on Documents Exceeding 200K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12766","snapshot_observed_at":"2026-08-07T04:13:17.776432Z","title":"Novelqa: Benchmarking question answering on documents exceeding 200k tokens, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.776432Z"},"links":{"cited_paper":"/paper/2403.12766","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:02b0be0a11148c44566cc0dfcf9b77cdb075aede0a8fde064000ed264d9c81fc","observation_id":"f6b28314-4984-4097-8f42-ffe392ba4c02","resolution":{"observed_at":"2026-08-07T04:13:17.776432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.172965Z","title":"Grok 3 beta — the age of reasoning agents, 2025","venue":null,"work_id":"3cfd4ab0-55f5-4cb7-b2c5-3fc2145011c4","year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.779538Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:e889d2d6d2ec7d159028312f801a1c06f8b764d91ae0530067758f73a15b8ea7","observation_id":"e8c5b1f1-76a0-45ce-9e64-548cd4be8f3a","resolution":{"observed_at":"2026-08-07T04:13:18.177910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16695","last_updated":"2024-12-02T20:23:49Z","snapshot_observed_at":"2026-08-08T10:04:03.139121Z","submitted_at":"2024-07-23T17:57:41Z","title":"Stress-Testing Long-Context Language Models with Lifelong ICL and Task Haystack","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16695","snapshot_observed_at":"2026-08-07T04:13:17.782387Z","title":"Stress-testing long-context language models with lifelong icl and task haystack, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.782387Z"},"links":{"cited_paper":"/paper/2407.16695","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:9b7362c812f6c6966cfd9156048105a59385476186713808e343b348e961c95c","observation_id":"77426410-528d-43a0-a526-55cec043c59f","resolution":{"observed_at":"2026-08-07T04:13:17.782387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T04:13:17.785799Z","title":"Qwen2.5 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.785799Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:75cf27196e84b14b23f3cf2a3389f55e49d2c3ddc2313939e96115e5817f376b","observation_id":"0416608e-094e-4f4f-a4c2-4a20a02e5fc6","resolution":{"observed_at":"2026-08-07T04:13:17.785799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16617","last_updated":"2024-06-11T18:54:13Z","snapshot_observed_at":"2026-08-06T05:28:31.850302Z","submitted_at":"2024-02-26T14:47:35Z","title":"Long-Context Language Modeling with Parallel Context Encoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16617","snapshot_observed_at":"2026-08-07T04:13:17.788599Z","title":"Long-context language modeling with parallel context encoding, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.788599Z"},"links":{"cited_paper":"/paper/2402.16617","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:ed8352f7707c455d675b8b7313d2c05a91f160ef9c8298dc16aa7affd3456cae","observation_id":"102efd5b-655b-4ab6-ba39-f87b1ae4a122","resolution":{"observed_at":"2026-08-07T04:13:17.788599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02694","last_updated":"2025-03-06T18:41:54Z","snapshot_observed_at":"2026-08-06T10:41:12.245173Z","submitted_at":"2024-10-03T17:20:11Z","title":"HELMET: How to Evaluate Long-Context Language Models Effectively and Thoroughly","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02694","snapshot_observed_at":"2026-08-07T04:13:17.791605Z","title":"Helmet: How to evaluate long-context language models effectively and thoroughly, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.791605Z"},"links":{"cited_paper":"/paper/2410.02694","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:088bafd6d65a3a29c0adc6edd10570394a50ea961aae0de24b5bf1a60d4b49d2","observation_id":"23303ff9-36c3-4125-bd84-9493b8df1701","resolution":{"observed_at":"2026-08-07T04:13:17.791605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-07T04:13:17.794692Z","title":"bench: Extending long context evaluation beyond 100k tokens, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.794692Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:f117fecffa28eb7f9fee185c9fb52b653a172aa509d8c9a3dc4dd5334f18e63d","observation_id":"f936a41a-b2a4-4d44-b710-f6820d013140","resolution":{"observed_at":"2026-08-07T04:13:17.794692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-07T04:13:17.797667Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.797667Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:7fff9a7da4b691ed620aba668c59d8853c013d209c08b0e342a24464af1b2978","observation_id":"0e55bcf3-5a6b-4018-9736-12d0dcdedbaf","resolution":{"observed_at":"2026-08-07T04:13:17.797667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T03:25:08.984777Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 8 inbound Pith citation observations for arXiv:2506.11440."}