{"as_of":"2026-08-10T09:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:98e8bd545c368b799c638091bdcef3a8ffc259c151644e8c16232375dd5eb800","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":33,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T20:25:25.280155Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T08:59:42.744162Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":"2309.14316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-04T08:59:42.744162Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":"a7f03a83-65ed-495c-9295-ad87e6539976","year":2024},"citing_paper":{"arxiv_id":"2502.04419","last_updated":"2026-05-05T09:32:34Z","snapshot_observed_at":"2026-07-30T08:21:36.901013Z","submitted_at":"2025-02-06T15:20:58Z","title":"Understanding and Mitigating Bias Inheritance in LLM-based Data Augmentation on Downstream Tasks","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-23T03:53:00.509414Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2502.04419"},"observation_digest":"sha256:c5d7734c83804e57a9227875d53689dd3e6c9d2e8c1f35ed0752e54fd513370c","observation_id":"922ede37-ebb6-4baf-8953-181b1dd35375","resolution":{"observed_at":"2026-05-23T03:55:21.891117Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-08T20:25:25.280155Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05076","last_updated":"2025-02-07T16:50:27Z","snapshot_observed_at":"2026-08-09T22:53:32.736842Z","submitted_at":"2025-02-07T16:50:27Z","title":"Paying Attention to Facts: Quantifying the Knowledge Capacity of Attention Layers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T20:25:25.280155Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2502.05076"},"observation_digest":"sha256:712f17dae1ba70597392987ba7947f3f7bfc2f9b5167c2c1251fee41a1ac8341","observation_id":"60c5cb77-9cd5-42ae-a972-8d37de90996d","resolution":{"observed_at":"2026-08-08T20:25:25.280155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-07T14:05:18.668363Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20128","last_updated":"2025-05-26T15:27:55Z","snapshot_observed_at":"2026-08-07T20:40:53.191299Z","submitted_at":"2025-05-26T15:27:55Z","title":"Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:18.668363Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2505.20128"},"observation_digest":"sha256:94ea52ea25644e75187f89f64d7cb08b31bb82c1c29cd0f597af5b60da8078a2","observation_id":"aaa81709-b90d-4fe2-8dc2-c629d0d6ce3d","resolution":{"observed_at":"2026-08-07T14:05:18.668363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-07T13:47:24.624633Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction.arXiv preprint arXiv:2309.14316, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-09T00:22:01.118886Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:24.624633Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:81c98ef38868ce364131c09e3d930d27bc712ca5990f6d2c5aa41bdaee430bc6","observation_id":"77669f41-c167-40fb-88cb-742e12c3eb62","resolution":{"observed_at":"2026-08-07T13:47:24.624633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-07T12:51:48.484929Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23410","last_updated":"2025-05-29T12:59:30Z","snapshot_observed_at":"2026-08-09T00:45:20.615286Z","submitted_at":"2025-05-29T12:59:30Z","title":"From Parameters to Prompts: Understanding and Mitigating the Factuality Gap between Fine-Tuned LLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:48.484929Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2505.23410"},"observation_digest":"sha256:abe13c5c24b3fd1a232070514bd4b2f9c24634f15241e47b8bab44af789b642b","observation_id":"c9e6edf8-ab72-4508-a73a-2e53e53b2c5b","resolution":{"observed_at":"2026-08-07T12:51:48.484929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-07T12:13:13.741659Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:13.741659Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:09ebaecffa3489a66441ba7b44c802d60c413785f97bc06aec4a248cef6da16e","observation_id":"584af120-bfe6-40c1-b645-8947fdc8da08","resolution":{"observed_at":"2026-08-07T12:13:13.741659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-07T11:56:29.482658Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02058","last_updated":"2025-06-01T15:32:44Z","snapshot_observed_at":"2026-08-09T00:45:45.891734Z","submitted_at":"2025-06-01T15:32:44Z","title":"Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:29.482658Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2506.02058"},"observation_digest":"sha256:feed9db94f0ebadb7b1b34428dfa22bcaa9c822d4713478a50e8205f80cc9114","observation_id":"6856b69a-28b4-4b10-85a5-ef242ebea546","resolution":{"observed_at":"2026-08-07T11:56:29.482658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-07T11:27:40.217335Z","title":"Eden Biran, Daniela Gottesman, Sohee Yang, Mor Geva, and Amir Globerson","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02591","last_updated":"2025-06-03T08:12:28Z","snapshot_observed_at":"2026-08-09T04:57:56.469632Z","submitted_at":"2025-06-03T08:12:28Z","title":"On Generalization across Measurement Systems: LLMs Entail More Test-Time Compute for Underrepresented Cultures","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:40.217335Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2506.02591"},"observation_digest":"sha256:521d02e23bff0c515bcd322e2439cfcb5cce5f973040b629b464a5c58f8f7555","observation_id":"37e902b4-b076-4bcb-8da2-34f8d6088055","resolution":{"observed_at":"2026-08-07T11:27:40.217335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-07T05:34:24.181884Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07731","last_updated":"2025-06-09T13:15:50Z","snapshot_observed_at":"2026-08-09T00:45:01.971673Z","submitted_at":"2025-06-09T13:15:50Z","title":"NeurIPS 2025 E2LM Competition : Early Training Evaluation of Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:34:24.181884Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2506.07731"},"observation_digest":"sha256:7a1f7022c67a4d96948287403a5eccf7c6d61f6a1d77290ed9d949e41b185e05","observation_id":"3da28a5b-baa0-4e81-9e21-65db149cc632","resolution":{"observed_at":"2026-08-07T05:34:24.181884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-06T17:46:15.570127Z","title":"and Li, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10106","last_updated":"2025-07-14T09:45:34Z","snapshot_observed_at":"2026-08-07T07:18:38.132008Z","submitted_at":"2025-07-14T09:45:34Z","title":"BlueGlass: A Framework for Composite AI Safety","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:15.570127Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2507.10106"},"observation_digest":"sha256:da60ed07087ac23c22f79afc006ef870202cb1d972ce339c2ca8770ee55be94e","observation_id":"409004ff-8edb-4db6-9268-463a36c4b7d1","resolution":{"observed_at":"2026-08-06T17:46:15.570127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":"2309.14316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-04T08:59:42.744162Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":"a7f03a83-65ed-495c-9295-ad87e6539976","year":2024},"citing_paper":{"arxiv_id":"2508.00901","last_updated":"2026-05-18T13:04:24Z","snapshot_observed_at":"2026-08-02T13:13:12.421550Z","submitted_at":"2025-07-28T17:24:57Z","title":"Provable Knowledge Acquisition and Extraction in One-Layer Transformers","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T23:05:56.687644Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2508.00901"},"observation_digest":"sha256:022d25a5e7013162dcf1479216da40a58a5dd56e70e82cf521a0fc3fd980b116","observation_id":"0b250b3e-629d-4e98-a566-dbccacca7cfe","resolution":{"observed_at":"2026-05-21T23:10:44.869355Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":"2309.14316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-04T08:59:42.744162Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":"a7f03a83-65ed-495c-9295-ad87e6539976","year":2024},"citing_paper":{"arxiv_id":"2509.13316","last_updated":"2026-05-13T17:55:29Z","snapshot_observed_at":"2026-07-06T22:30:02.223630Z","submitted_at":"2025-09-16T17:59:04Z","title":"Do Activation Verbalization Methods Convey Privileged Information?","version":4},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-18T15:41:46.771905Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2509.13316"},"observation_digest":"sha256:87d44dd1712b1a9561407abec0e176123b68a90f6271203d29e637413fe4e1c9","observation_id":"2ac4b2c5-ff58-4036-9bf2-9abc5299b688","resolution":{"observed_at":"2026-05-18T15:42:42.195253Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":"2309.14316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-04T08:59:42.744162Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":"a7f03a83-65ed-495c-9295-ad87e6539976","year":2024},"citing_paper":{"arxiv_id":"2510.02370","last_updated":"2026-04-20T02:19:04Z","snapshot_observed_at":"2026-07-06T22:31:35.666707Z","submitted_at":"2025-09-29T06:18:18Z","title":"How Training Data Shapes the Use of Parametric and In-Context Knowledge in Language Models","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T13:10:16.948681Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2510.02370"},"observation_digest":"sha256:00a45a10ee8559a4367f4a0cbeccb7ba1595b4d439b50c1db86115b5bea32fb0","observation_id":"b26c2c3b-bdf0-4946-b8b2-ebaedda1f161","resolution":{"observed_at":"2026-05-18T13:11:23.918435Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-03T23:37:54.445297Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.07457","last_updated":"2026-07-20T02:41:15Z","snapshot_observed_at":"2026-08-06T01:49:16.929228Z","submitted_at":"2025-11-06T21:56:58Z","title":"GRIP: In-Parameter Graph Reasoning through Fine-Tuning Large Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T23:37:54.445297Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2511.07457"},"observation_digest":"sha256:99d00b18dea30e7347d689086f0fdb8e02c609cf330f52d476fed42786a8cb0a","observation_id":"e2bd3065-4683-437a-a370-0ffdd5c8bb05","resolution":{"observed_at":"2026-08-03T23:37:54.445297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":"2309.14316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-04T08:59:42.744162Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":"a7f03a83-65ed-495c-9295-ad87e6539976","year":2024},"citing_paper":{"arxiv_id":"2512.04695","last_updated":"2026-04-27T04:31:24Z","snapshot_observed_at":"2026-08-02T08:37:04.946075Z","submitted_at":"2025-12-04T11:45:21Z","title":"TRINITY: An Evolved LLM Coordinator","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-17T01:19:10.420266Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2512.04695"},"observation_digest":"sha256:b28535a8aa46bebcba799c16264f1b5ce9fc3446598a0101208cb966114618eb","observation_id":"1e97e419-6df3-4711-a144-feedda93e123","resolution":{"observed_at":"2026-05-17T01:21:24.812352Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-03T15:22:46.493352Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.17351","last_updated":"2026-07-28T16:53:50Z","snapshot_observed_at":"2026-08-03T18:14:53.588030Z","submitted_at":"2025-12-19T08:47:28Z","title":"Physics of Language Models: Part 4.1, Architecture Design and the Magic of Canon Layers","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T15:22:46.493352Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2512.17351"},"observation_digest":"sha256:e2b5f6f1b5a447c2cd99dadb287c6fd7df7d6329c01d2090e820c51caf6bab46","observation_id":"c37b4848-0230-429c-b460-bb576c2a14f8","resolution":{"observed_at":"2026-08-03T15:22:46.493352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-03T14:02:56.627082Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction.arXiv preprint arXiv:2309.14316,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.22088","last_updated":"2026-06-10T15:31:41Z","snapshot_observed_at":"2026-08-09T06:43:58.919201Z","submitted_at":"2025-12-26T17:20:09Z","title":"Unifying Learning Dynamics and Generalization in Transformers Scaling Law","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T14:02:56.627082Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2512.22088"},"observation_digest":"sha256:c4611557d9d5ab5bbdd632593f2c2e4f750c3e09647a0d4da6365ea741c4cce2","observation_id":"0c1d729d-f46e-43d4-bbfa-012a9c1b4871","resolution":{"observed_at":"2026-08-03T14:02:56.627082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":"2309.14316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-04T08:59:42.744162Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":"a7f03a83-65ed-495c-9295-ad87e6539976","year":2024},"citing_paper":{"arxiv_id":"2604.08519","last_updated":"2026-04-09T17:55:50Z","snapshot_observed_at":"2026-07-06T22:57:35.435713Z","submitted_at":"2026-04-09T17:55:50Z","title":"Cram Less to Fit More: Training Data Pruning Improves Memorization of Facts","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-10T17:42:31.465077Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2604.08519"},"observation_digest":"sha256:4fee93aa5c2e261b125e16c7fa7e8fb2f7980988f2582122a2ba35986241277b","observation_id":"0d149e41-d79b-4367-b40d-873594ffca1c","resolution":{"observed_at":"2026-05-11T06:15:59.174998Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":"2309.14316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-04T08:59:42.744162Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":"a7f03a83-65ed-495c-9295-ad87e6539976","year":2024},"citing_paper":{"arxiv_id":"2605.10129","last_updated":"2026-05-11T07:40:39Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:39Z","title":"Synthetic Pre-Pre-Training Improves Language Model Robustness to Noisy Pre-Training Data","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-12T03:38:39.738401Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2605.10129"},"observation_digest":"sha256:309f5456ffe7c73c1163ba572c301a6e78b05dd6ebb82f5dc64f8db8ad243945","observation_id":"0d35ce35-d6a4-488b-9bc9-9718ee2571b9","resolution":{"observed_at":"2026-05-12T07:11:25.715025Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":"2309.14316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-04T08:59:42.744162Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":"a7f03a83-65ed-495c-9295-ad87e6539976","year":2024},"citing_paper":{"arxiv_id":"2605.24657","last_updated":"2026-05-23T16:57:25Z","snapshot_observed_at":"2026-08-06T05:01:59.502000Z","submitted_at":"2026-05-23T16:57:25Z","title":"Beyond Inference-Only Deployment: Comparing Weight-Based Consolidation Against Cascading Compaction","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-30T13:31:42.793977Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2605.24657"},"observation_digest":"sha256:c0896d3c7072836c9b56049e8c0e22b3ef730d2f9d02fc0e4e5c1fa32ccef6ca","observation_id":"1e9812dc-c5cf-49bb-8cc5-a021564dc63b","resolution":{"observed_at":"2026-06-30T13:34:40.310277Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":"2309.14316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-04T08:59:42.744162Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":"a7f03a83-65ed-495c-9295-ad87e6539976","year":2024},"citing_paper":{"arxiv_id":"2606.01849","last_updated":"2026-06-02T02:54:59Z","snapshot_observed_at":"2026-08-03T22:14:13.638836Z","submitted_at":"2026-06-01T08:00:01Z","title":"ContinuousBench: Can Differentially Private Synthetic Text Improve Capabilities?","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-28T15:37:10.765798Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2606.01849"},"observation_digest":"sha256:baec6e8879981ebc22696782386b5263d17a94eda370aef74f37926fb5e4d8fa","observation_id":"f9dc1876-1315-42eb-a70e-37313af8be3e","resolution":{"observed_at":"2026-07-01T22:16:16.121924Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":"2309.14316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-04T08:59:42.744162Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":"a7f03a83-65ed-495c-9295-ad87e6539976","year":2024},"citing_paper":{"arxiv_id":"2606.05054","last_updated":"2026-06-03T16:12:30Z","snapshot_observed_at":"2026-07-06T23:45:06.925235Z","submitted_at":"2026-06-03T16:12:30Z","title":"Boosting Self-Consistency with Ranking","version":1},"reference_index":127,"source":"arxiv_source","source_observed_at":"2026-06-28T06:49:58.051659Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2606.05054"},"observation_digest":"sha256:ea0ee7518a286c08cf683d7f9d197ccc19f3af4227e78a63500932670ac1979e","observation_id":"0086058b-d21d-472a-ad3d-e604b4311b0c","resolution":{"observed_at":"2026-07-02T07:36:45.216921Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":"2309.14316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-04T08:59:42.744162Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":"a7f03a83-65ed-495c-9295-ad87e6539976","year":2024},"citing_paper":{"arxiv_id":"2606.07568","last_updated":"2026-05-26T02:19:47Z","snapshot_observed_at":"2026-07-06T23:47:10.030985Z","submitted_at":"2026-05-26T02:19:47Z","title":"A Systematic Study of Behavioral Cloning for Scientific Data Annotation","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-06-29T16:23:08.402194Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2606.07568"},"observation_digest":"sha256:a308cb0356fd11483b9b4a1022d357dfd2ef5f77faab7fef187ce7c8d7a6db5f","observation_id":"4eac9d82-b66b-4d3b-808a-03cae0034208","resolution":{"observed_at":"2026-06-29T16:23:39.223523Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":"2309.14316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-04T08:59:42.744162Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":"a7f03a83-65ed-495c-9295-ad87e6539976","year":2024},"citing_paper":{"arxiv_id":"2606.08705","last_updated":"2026-06-07T16:03:14Z","snapshot_observed_at":"2026-08-06T10:14:38.045879Z","submitted_at":"2026-06-07T16:03:14Z","title":"Analyzing the Correlation Between Hallucinations and Knowledge Conflicts in Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T18:43:58.988270Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2606.08705"},"observation_digest":"sha256:8f3b888a4d0858553d6efe5fd48084f76c9982366f1f1ddba887fa7d6c1290ae","observation_id":"5a64b775-b431-4ced-adfa-1ccf4612a6a4","resolution":{"observed_at":"2026-07-02T22:37:26.446606Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":"2309.14316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-04T08:59:42.744162Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":"a7f03a83-65ed-495c-9295-ad87e6539976","year":2024},"citing_paper":{"arxiv_id":"2606.22376","last_updated":"2026-06-21T07:53:54Z","snapshot_observed_at":"2026-08-02T13:42:52.378665Z","submitted_at":"2026-06-21T07:53:54Z","title":"Vibe Calibration: Autonomous Bring-up of a 112-Qubit Superconducting Quantum Processor by a Skill-Orchestrating Language Agent","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-26T10:43:19.166363Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2606.22376"},"observation_digest":"sha256:c83fcb0a3d69f325dca069aec0e29eb6ecf2567d2a081c0464c72665159ff311","observation_id":"68f26107-f188-4cfe-9904-814bd661a774","resolution":{"observed_at":"2026-07-04T08:59:42.745595Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":"2309.14316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-04T08:59:42.744162Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":"a7f03a83-65ed-495c-9295-ad87e6539976","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T01:16:16.834861Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:fe5f89c41fee96899ede999c9f2f9e1b4a5b6367b80145deb7774dd3adc42756","observation_id":"63d121ab-ed6a-4016-b7c5-8fc73cf12221","resolution":{"observed_at":"2026-07-01T15:45:47.645860Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":"2309.14316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-04T08:59:42.744162Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":"a7f03a83-65ed-495c-9295-ad87e6539976","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:ff49e7ec6343c044890021aaf8e8df794cde42a4248d98a9b1ce5677288e81b7","observation_id":"760d78d4-c1c1-4d09-a3b5-52df8b41f577","resolution":{"observed_at":"2026-07-02T21:17:24.222155Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":"2309.14316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-04T08:59:42.744162Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":"a7f03a83-65ed-495c-9295-ad87e6539976","year":2024},"citing_paper":{"arxiv_id":"2606.28898","last_updated":"2026-06-27T13:02:13Z","snapshot_observed_at":"2026-08-06T05:16:31.950828Z","submitted_at":"2026-06-27T13:02:13Z","title":"PASTA: A Paraphrasing And Self-Training Approach for Knowledge Updating in LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T09:42:40.357949Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2606.28898"},"observation_digest":"sha256:dcbe0e9ad806d901d2737c741bbd0e4733bd6e5a4c09cc14f73e598189d93b19","observation_id":"7ae9752e-c276-4c75-b5e6-9ae65f6e2b00","resolution":{"observed_at":"2026-06-30T09:44:37.509680Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":"2309.14316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-04T08:59:42.744162Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":"a7f03a83-65ed-495c-9295-ad87e6539976","year":2024},"citing_paper":{"arxiv_id":"2606.32002","last_updated":"2026-06-30T17:35:14Z","snapshot_observed_at":"2026-08-02T13:47:40.317163Z","submitted_at":"2026-06-30T17:35:14Z","title":"Self-Study Reconsidered: The Hidden Fragility of Learning from Self-Generated QA","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-01T05:07:58.441326Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2606.32002"},"observation_digest":"sha256:c216af4a91bc9a8aa20ae91be87e655be0e686b5e9d87061bdcb0718f4ac193e","observation_id":"17855db5-24bc-462a-b7b3-f156567f9fa2","resolution":{"observed_at":"2026-07-01T10:45:42.782791Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-11T12:36:24.747752Z","title":"Allen-Zhu and Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04846","last_updated":"2026-07-06T09:18:35Z","snapshot_observed_at":"2026-08-06T17:39:48.725788Z","submitted_at":"2026-07-06T09:18:35Z","title":"Pretraining Curricula Enable Selective Fine-tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T12:36:24.747752Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2607.04846"},"observation_digest":"sha256:94049bc7e30a9840034f45029270c13b49d4c4e3a04a4efc46df175f835dcdee","observation_id":"83fa583d-eb4d-4911-9ba7-a6608002e0ce","resolution":{"observed_at":"2026-07-11T12:36:24.747752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-14T07:36:43.499258Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction.arXiv preprint arXiv:2309.14316,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11020","last_updated":"2026-07-14T05:59:33Z","snapshot_observed_at":"2026-08-08T18:22:25.527933Z","submitted_at":"2026-07-13T02:39:38Z","title":"Can a Language Model Learn Facts Continually in Its Weights?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T07:36:43.499258Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2607.11020"},"observation_digest":"sha256:2552f6f11422d0a18ea26b0e290b326035c29248b1312a017b004e5cbbd252dc","observation_id":"6a8ec8be-4cad-46e1-a6cd-4faf57159eb2","resolution":{"observed_at":"2026-07-14T07:36:43.499258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-01T06:29:14.601748Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21861","last_updated":"2026-07-23T23:14:59Z","snapshot_observed_at":"2026-08-07T01:31:36.362218Z","submitted_at":"2026-07-23T23:14:59Z","title":"Data Quality over Capacity: Internalizing Documents into LoRA Adapters for Closed-Book QA","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T06:29:14.601748Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2607.21861"},"observation_digest":"sha256:60e0358ef2d288e92d8f74aaec307a2d9ffba9d390c8f466e42e32bd33673b1d","observation_id":"6de07f33-b54a-42df-adf9-1837139d1baa","resolution":{"observed_at":"2026-08-01T06:29:14.601748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-01T06:05:52.644358Z","title":"arXiv preprint arXiv:2309.14316 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-06T10:51:59.521588Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:52.644358Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:7d03edc42b571d336bb3859f1746c4e268b1974f49e3a2268625055155e6db2d","observation_id":"eba78512-6d08-45be-ac40-6aad70068da7","resolution":{"observed_at":"2026-08-01T06:05:52.644358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2309.14316/citation-record","integrity":"/paper/2309.14316/integrity","json":"/paper/2309.14316/citation-record.json","paper":"/paper/2309.14316"},"outbound":[],"paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 33 inbound Pith citation observations for arXiv:2309.14316."}