{"as_of":"2026-08-18T13:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2ebbaa4dc2ae2e6aa8dfa62ce083a60251f37a0080cd0fae059a3da70c7e1b9b","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T17:39:08.452490Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T11:06:38.102348Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T11:11:27.550895Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"cited_work":{"arxiv_id":"2411.12395","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.12395","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Krojer, B., Komeili, M., Ross, C., Garrido, Q., Sinha, K., Ballas, N., and Assran, M","venue":null,"work_id":"8f9cb73a-3e81-47b7-98e9-5c73c6bbb639","year":null},"citing_paper":{"arxiv_id":"2602.13294","last_updated":"2026-05-21T07:15:56Z","snapshot_observed_at":"2026-08-17T14:05:09.950492Z","submitted_at":"2026-02-09T05:46:44Z","title":"VisPhyWorld: Probing Physical Reasoning via Code-Driven Video Reconstruction","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T11:06:38.102348Z"},"links":{"cited_paper":"/paper/2411.12395","citing_paper":"/paper/2602.13294"},"observation_digest":"sha256:90d4de2bff4ebee9370f48312af41a1e71a607f75f4d766568b16699b91a2985","observation_id":"65801f10-9aa9-4555-ae5a-e38a67416de9","resolution":{"observed_at":"2026-05-22T11:11:27.554087Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.12395/citation-record","integrity":"/paper/2411.12395/integrity","json":"/paper/2411.12395/citation-record.json","paper":"/paper/2411.12395"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.903433Z","title":"56% of college students have used AI on assignments or exams: Bestcolleges,","venue":null,"work_id":"d803f1cf-5837-403a-b1ff-6f7b153348fb","year":2023},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.358990Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:5774f4cf37e7dc9d9963f2256af08808996c501525ce624dd56e9e91e916a7ad","observation_id":"dd79d9b1-7380-466f-ab58-c8a12865509f","resolution":{"observed_at":"2026-08-12T17:39:08.907569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.890671Z","title":"Manjrekar","venue":null,"work_id":"d757d607-5a8a-4d5f-bf6d-692b451d35d6","year":2024},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.363513Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:c2bb058c559d3a725d337127942e87004465bcf7c67fd057fed3c007830a52cb","observation_id":"b7fba134-b158-4159-9e82-7fdd89f28d8f","resolution":{"observed_at":"2026-08-12T17:39:08.894498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01219","last_updated":"2025-09-14T09:34:46Z","snapshot_observed_at":"2026-08-16T12:38:46.158503Z","submitted_at":"2023-09-03T16:56:48Z","title":"Siren's Song in the AI Ocean: A Survey on Hallucination in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01219","snapshot_observed_at":"2026-08-12T17:39:08.367529Z","title":"Siren’s song in the ai ocean: A survey on hallucination in large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.367529Z"},"links":{"cited_paper":"/paper/2309.01219","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:f0fdbd594308b2d245990da5fbdb7e36dab803ea5682a2347b68a79dcd99923d","observation_id":"120c83de-044f-4cd6-9322-4df3b20c7f5a","resolution":{"observed_at":"2026-08-12T17:39:08.367529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.371709Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.371709Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:25c30b31dad17262842244efea6bfb8ec7d1029ab96ffa85416cc8f10d31fe41","observation_id":"a434acd6-0841-4cf4-a452-fb353b979dcf","resolution":{"observed_at":"2026-08-12T17:39:08.371709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-12T17:39:08.376028Z","title":"Sparks of artificial general intelligence: Early experiments with gpt-4,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.376028Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:0ce125dcec1dcf1e32b2e144a872501fb389b8701efbcef882cca6fb90bc1720","observation_id":"a06bbfa9-ee43-40a4-8667-340e2f005c4b","resolution":{"observed_at":"2026-08-12T17:39:08.376028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.381029Z","title":"Language models are unsupervised multitask learners,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.381029Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:4d208b70ee652655353ef0cf906ba8c4fe7135f15a5bd0380fdf695506e8e17b","observation_id":"4c81cbad-95bf-491a-9a14-bb9bdbebf415","resolution":{"observed_at":"2026-08-12T17:39:08.381029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-12T17:39:08.385458Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.385458Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:041a4466e71340ff9fe704997095dea42447eafa32e8c4b6c73bf047c70c7126","observation_id":"edf07336-dc48-4ab6-9669-655e786389f1","resolution":{"observed_at":"2026-08-12T17:39:08.385458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T17:39:08.389307Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.389307Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:c312b4d658219f02dcf86d57aebbbf365b2fb7f226ad448c078bcb164785cec3","observation_id":"3e003c7c-18cb-4c5c-bd27-11ade923dab2","resolution":{"observed_at":"2026-08-12T17:39:08.389307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-12T17:39:08.393263Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.393263Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:bae03e7128ba30de0a4dec06e2802801bc2cf508d601cc662d9f3611a90aeff0","observation_id":"03695bbc-4bfc-4842-bc74-c5760b1055bb","resolution":{"observed_at":"2026-08-12T17:39:08.393263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-12T17:39:08.397186Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.397186Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:97db280fa0d07e42dc14dddbbbbcfb4b744d92077c41719736d05b96b8f2b4ad","observation_id":"3e7a26aa-8f41-4065-9a68-49dedbd208c0","resolution":{"observed_at":"2026-08-12T17:39:08.397186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.401394Z","title":"Instruction tuning for large language models: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.401394Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:e986ad94b3dd3ab204792782f4690650169787c887898b82f23806ede6bf42f8","observation_id":"42446af3-b266-4cf3-8a5b-9d7181cdb463","resolution":{"observed_at":"2026-08-12T17:39:08.401394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.860013Z","title":"Fighting fire with fire: can chatgpt detect ai-generated text?","venue":null,"work_id":"6174e37d-9ebe-40e3-8a41-85b3df2404f7","year":2024},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.405159Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:ac39f750a9e82a26d182236b78d369b655a825d1e5cab3df634cade0d36e96f1","observation_id":"115bdd92-df93-46d8-a240-b2764aad0616","resolution":{"observed_at":"2026-08-12T17:39:08.863853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12209","last_updated":"2024-05-20T17:52:29Z","snapshot_observed_at":"2026-08-16T13:51:13.692816Z","submitted_at":"2024-05-20T17:52:29Z","title":"MathBench: Evaluating the Theory and Application Proficiency of LLMs with a Hierarchical Mathematics Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12209","snapshot_observed_at":"2026-08-12T17:39:08.408800Z","title":"Mathbench: Evaluating the theory and application proficiency of llms with a hierarchical mathematics benchmark,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.408800Z"},"links":{"cited_paper":"/paper/2405.12209","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:2be6c358fa76cf25a3b669e3e531a4845444388793ea37af5c3899d598d40ca9","observation_id":"b790d220-7b46-4551-bbe7-eadfd1481f07","resolution":{"observed_at":"2026-08-12T17:39:08.408800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03729","last_updated":"2024-04-01T20:56:11Z","snapshot_observed_at":"2026-08-18T10:21:42.337304Z","submitted_at":"2024-01-08T08:28:08Z","title":"The Butterfly Effect of Altering Prompts: How Small Changes and Jailbreaks Affect Large Language Model Performance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03729","snapshot_observed_at":"2026-08-12T17:39:08.412464Z","title":"The butterfly effect of altering prompts: How small changes and jailbreaks affect large language model perfor- mance,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.412464Z"},"links":{"cited_paper":"/paper/2401.03729","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:8b18b0ee2cb05d3a1cfb2d16ab82856457e4ac0765c1253d3e5592e5c8cec1f8","observation_id":"3285a012-fc59-4c10-93a6-87c5269e170f","resolution":{"observed_at":"2026-08-12T17:39:08.412464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.846670Z","title":"Quantifying language models’ sensitivity to spurious features in prompt design or: How i learned to start worrying about prompt formatting,","venue":null,"work_id":"2e681879-f30f-41d9-8eb3-5c0679c1fbe9","year":2024},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.416156Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:add0d6dcee7913d05ec20ec4bf354efe4defcb8fb9fd0b58da440e997fa0f419","observation_id":"0c58a8ba-7cf8-4d05-b7e5-c781e7ea4439","resolution":{"observed_at":"2026-08-12T17:39:08.850880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10711","last_updated":"2022-12-20T18:35:33Z","snapshot_observed_at":"2026-08-16T16:07:12.819832Z","submitted_at":"2022-12-20T18:35:33Z","title":"Task Ambiguity in Humans and Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10711","snapshot_observed_at":"2026-08-12T17:39:08.419760Z","title":"Task ambiguity in humans and language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.419760Z"},"links":{"cited_paper":"/paper/2212.10711","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:4c30c7430f52d4b67f11e5aab4d6ec8a1bfb606b0fa80208b4ccf47e7089f566","observation_id":"fcde1c31-717f-4f56-923b-320ea5e2a6f3","resolution":{"observed_at":"2026-08-12T17:39:08.419760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.834053Z","title":null,"venue":null,"work_id":"c50cb9aa-d820-4652-ba46-e2dfe9601518","year":null},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.423686Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:1bfe7d86886de66e3a3cdcabad42919dee4b236bf9456cc8bd22a9d6734b3459","observation_id":"2d443af0-68d7-495b-acff-79f44d8a38d4","resolution":{"observed_at":"2026-08-12T17:39:08.838025Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.820237Z","title":"The winograd schema challenge,","venue":null,"work_id":"b3744d45-bf90-45b3-973f-c56efdc48de0","year":2012},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.427497Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:effcecee3c0f2977f14ef9570e01cd75a57d812d6cd2b8dd5d1eabeaa80d9595","observation_id":"60877db6-650f-475a-8a3c-eae3a2054af7","resolution":{"observed_at":"2026-08-12T17:39:08.824823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.806433Z","title":"Gpt-4o system card,","venue":null,"work_id":"6ca25a83-2f59-4cca-a66a-de448157bf8c","year":2024},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.431031Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:aec7e4b33096e33495e72290c7b4f00f00ed14a7d2e67243ff06772f9852c1b3","observation_id":"5d86b036-0ab5-48da-9192-963695f02871","resolution":{"observed_at":"2026-08-12T17:39:08.810453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.793005Z","title":"Natural questions: a benchmark for question answering research,","venue":null,"work_id":"bc93415a-9f46-43dc-8f14-3af020863d04","year":2019},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.434415Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:eee6571e3cfd20ea2ac08f967cc11e251c3ea3e03211bcd05bf93512ef31216c","observation_id":"f4e1e5be-6b1d-4cca-8047-6bad97f4e02c","resolution":{"observed_at":"2026-08-12T17:39:08.797087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.779742Z","title":"AmbigQA: Answering ambiguous open-domain questions,","venue":null,"work_id":"df246282-0378-41ac-8039-ee123edc0f8f","year":2020},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.438058Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:59f628bb667b73f2572a32b8485259ef6f06e440588b7b0b31144927d268271e","observation_id":"350d6fbc-e570-4e7b-b330-34ca0f244b95","resolution":{"observed_at":"2026-08-12T17:39:08.783784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.766704Z","title":"Scope ambiguities in large language models,","venue":null,"work_id":"84f0af22-8708-420e-978f-e4d0aad23a45","year":2024},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.441544Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:99a2cb8e43160c12b88542af0260448699c2ea3b027988be660e3877fd061849","observation_id":"7a9ec339-6cfe-4d92-9cba-42f986aae223","resolution":{"observed_at":"2026-08-12T17:39:08.770656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-12T17:39:08.445089Z","title":"Mistral 7b (2023),","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.445089Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:19626593d79357996f228ca391681e9d9cd67631e03e863d8c1d296d8ea8bc72","observation_id":"39706813-4643-43d5-bcda-7d4ecd053b7f","resolution":{"observed_at":"2026-08-12T17:39:08.445089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08747","last_updated":"2025-01-05T04:09:00Z","snapshot_observed_at":"2026-08-16T00:12:56.001802Z","submitted_at":"2023-08-17T02:53:23Z","title":"An Empirical Study of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08747","snapshot_observed_at":"2026-08-12T17:39:08.448804Z","title":"An empirical study of catastrophic forgetting in large language models during continual fine-tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.448804Z"},"links":{"cited_paper":"/paper/2308.08747","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:71ce88c0e1630827145080333c10902ef15c3341eb34690996b22cd3eec0506c","observation_id":"e4113f78-fd4e-47d4-a15b-9c74d6b13237","resolution":{"observed_at":"2026-08-12T17:39:08.448804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.751411Z","title":"Preserving principal subspaces to reduce catastrophic forgetting in fine-tuning,","venue":null,"work_id":"cc0f527a-8fef-4545-a508-5dec78670abb","year":2024},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.452490Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:5f244599a4f4ab1abd18ccbfd1735f585ed26d076ca2a47420bc185f4867d820","observation_id":"142c4aa5-8cac-46e6-bf93-9ae4a50f416c","resolution":{"observed_at":"2026-08-12T17:39:08.757445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T10:25:32.660135Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 1 inbound Pith citation observation for arXiv:2411.12395."}