{"as_of":"2026-08-14T19:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a5c131d82213648e0fdc02562ef786320fc043b8e2d055b23f344eb9f7904e47","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":18,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T20:05:49.324883Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile","version":1},"cited_work":{"arxiv_id":"2201.07311","doi":"10.48550/arxiv.2201.07311","metadata_source":"arxiv_reference","pith_arxiv_id":"2201.07311","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Datasheet for the pile","venue":"arXiv (Cornell University)","work_id":"20da0ec8-989b-4d4e-ae7a-486228e0b542","year":2022},"citing_paper":{"arxiv_id":"2204.06745","last_updated":"2022-04-14T04:00:27Z","snapshot_observed_at":"2026-08-13T14:54:27.001192Z","submitted_at":"2022-04-14T04:00:27Z","title":"GPT-NeoX-20B: An Open-Source Autoregressive Language Model","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-24T12:33:37.701655Z"},"links":{"cited_paper":"/paper/2201.07311","citing_paper":"/paper/2204.06745"},"observation_digest":"sha256:1a33ffa1dad9c11c4d8296f1ae303ea9a9ed7745806ff6659c6f8548f91fecd6","observation_id":"f659b00b-286f-4880-8e92-eccbbff8a65d","resolution":{"observed_at":"2026-05-24T12:34:28.272558Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile","version":1},"cited_work":{"arxiv_id":"2201.07311","doi":"10.48550/arxiv.2201.07311","metadata_source":"arxiv_reference","pith_arxiv_id":"2201.07311","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Datasheet for the pile","venue":"arXiv (Cornell University)","work_id":"20da0ec8-989b-4d4e-ae7a-486228e0b542","year":2022},"citing_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"reference_index":204,"source":"arxiv_source","source_observed_at":"2026-05-12T00:51:10.919818Z"},"links":{"cited_paper":"/paper/2201.07311","citing_paper":"/paper/2211.05100"},"observation_digest":"sha256:3d76f7fb597ba7c2604d0f174b1c156833eb27a206ca90bfebc658deae2ed94e","observation_id":"1349a911-70f1-4dc6-8793-0f22d37aa3fb","resolution":{"observed_at":"2026-05-12T00:51:11.513290Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile","version":1},"cited_work":{"arxiv_id":"2201.07311","doi":"10.48550/arxiv.2201.07311","metadata_source":"arxiv_reference","pith_arxiv_id":"2201.07311","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Datasheet for the pile","venue":"arXiv (Cornell University)","work_id":"20da0ec8-989b-4d4e-ae7a-486228e0b542","year":2022},"citing_paper":{"arxiv_id":"2303.08112","last_updated":"2025-11-11T01:13:28Z","snapshot_observed_at":"2026-08-14T11:50:41.917778Z","submitted_at":"2023-03-14T17:47:09Z","title":"Eliciting Latent Predictions from Transformers with the Tuned Lens","version":6},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-12T16:54:37.382049Z"},"links":{"cited_paper":"/paper/2201.07311","citing_paper":"/paper/2303.08112"},"observation_digest":"sha256:8a1a1518abccb7c9126900f0ac4eb7999cca794a4ea88b810c7916974852c07d","observation_id":"d444a3ea-780e-4e04-8fb5-42aa481a4e27","resolution":{"observed_at":"2026-05-12T16:54:37.443534Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile","version":1},"cited_work":{"arxiv_id":"2201.07311","doi":"10.48550/arxiv.2201.07311","metadata_source":"arxiv_reference","pith_arxiv_id":"2201.07311","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Datasheet for the pile","venue":"arXiv (Cornell University)","work_id":"20da0ec8-989b-4d4e-ae7a-486228e0b542","year":2022},"citing_paper":{"arxiv_id":"2304.01373","last_updated":"2023-05-31T17:54:07Z","snapshot_observed_at":"2026-08-07T23:49:29.478548Z","submitted_at":"2023-04-03T20:58:15Z","title":"Pythia: A Suite for Analyzing Large Language Models Across Training and Scaling","version":2},"reference_index":130,"source":"arxiv_source","source_observed_at":"2026-05-15T17:45:17.540282Z"},"links":{"cited_paper":"/paper/2201.07311","citing_paper":"/paper/2304.01373"},"observation_digest":"sha256:640db43d79a8ace20b5214990b97182bd3b8e25c630d0de775b1e3431e069d06","observation_id":"fef56d72-964c-4800-96c3-3924df644eb3","resolution":{"observed_at":"2026-05-15T17:45:17.814330Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile","version":1},"cited_work":{"arxiv_id":"2201.07311","doi":"10.48550/arxiv.2201.07311","metadata_source":"arxiv_reference","pith_arxiv_id":"2201.07311","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Datasheet for the pile","venue":"arXiv (Cornell University)","work_id":"20da0ec8-989b-4d4e-ae7a-486228e0b542","year":2022},"citing_paper":{"arxiv_id":"2310.10631","last_updated":"2024-03-15T19:14:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-16T17:54:07Z","title":"Llemma: An Open Language Model For Mathematics","version":3},"reference_index":127,"source":"arxiv_source","source_observed_at":"2026-05-19T08:17:46.055279Z"},"links":{"cited_paper":"/paper/2201.07311","citing_paper":"/paper/2310.10631"},"observation_digest":"sha256:059ff6a3dfcb0e502420f836bf840d3423c3c69b6b181b227a01283015a83723","observation_id":"f6228a3f-b8ae-4df2-b901-ba7942d1e47c","resolution":{"observed_at":"2026-05-19T08:17:46.315699Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile","version":1},"cited_work":{"arxiv_id":"2201.07311","doi":"10.48550/arxiv.2201.07311","metadata_source":"arxiv_reference","pith_arxiv_id":"2201.07311","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Datasheet for the pile","venue":"arXiv (Cornell University)","work_id":"20da0ec8-989b-4d4e-ae7a-486228e0b542","year":2022},"citing_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-08-12T13:10:06.472493Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T18:00:53.389420Z"},"links":{"cited_paper":"/paper/2201.07311","citing_paper":"/paper/2404.06395"},"observation_digest":"sha256:0d8ebea15fddc4d72ad24b11f8406bdea00989deb4c904231c5411b397b923ab","observation_id":"cf4c3bba-bde4-4f88-bc74-4653bf7052a0","resolution":{"observed_at":"2026-05-13T18:00:53.436829Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.07311","snapshot_observed_at":"2026-08-12T20:05:49.324883Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.10069","last_updated":"2024-11-15T09:33:47Z","snapshot_observed_at":"2026-08-14T11:12:55.799039Z","submitted_at":"2024-11-15T09:33:47Z","title":"Layer Importance and Hallucination Analysis in Large Language Models via Enhanced Activation Variance-Sparsity","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T20:05:49.324883Z"},"links":{"cited_paper":"/paper/2201.07311","citing_paper":"/paper/2411.10069"},"observation_digest":"sha256:456d85b96ce40cafae790564149744e340bf7e823c3dd02a5f595e15d5fde1c6","observation_id":"96c76790-c756-46eb-b1e1-c4b1c201e488","resolution":{"observed_at":"2026-08-12T20:05:49.324883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.07311","snapshot_observed_at":"2026-08-09T18:17:21.001188Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00641","last_updated":"2025-02-11T13:12:16Z","snapshot_observed_at":"2026-08-14T13:03:47.760526Z","submitted_at":"2025-02-02T03:07:45Z","title":"Evaluating Small Language Models for News Summarization: Implications and Factors Influencing Performance","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T18:17:21.001188Z"},"links":{"cited_paper":"/paper/2201.07311","citing_paper":"/paper/2502.00641"},"observation_digest":"sha256:717c28d3f008c1c44a55f3f7007e546e51b898137109e897c01dab1b3c3b302d","observation_id":"3166eccf-bab7-43bd-b4e8-c6a82c07cfe8","resolution":{"observed_at":"2026-08-09T18:17:21.001188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.07311","snapshot_observed_at":"2026-08-07T11:15:41.951527Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03149","last_updated":"2025-06-03T17:59:47Z","snapshot_observed_at":"2026-08-13T08:42:14.239103Z","submitted_at":"2025-06-03T17:59:47Z","title":"Causal Estimation of Tokenisation Bias","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:15:41.951527Z"},"links":{"cited_paper":"/paper/2201.07311","citing_paper":"/paper/2506.03149"},"observation_digest":"sha256:a3306f7e7807fee6f151444077fa75e410ea3ab1527383df4897a1535e07f8bb","observation_id":"9bcacca9-43ee-4d34-a589-3b2af07f19e0","resolution":{"observed_at":"2026-08-07T11:15:41.951527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.07311","snapshot_observed_at":"2026-08-06T10:26:17.860591Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.00128","last_updated":"2025-07-31T19:28:31Z","snapshot_observed_at":"2026-08-13T14:13:05.511528Z","submitted_at":"2025-07-31T19:28:31Z","title":"How Quantization Impacts Privacy Risk on LLMs for Code?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T10:26:17.860591Z"},"links":{"cited_paper":"/paper/2201.07311","citing_paper":"/paper/2508.00128"},"observation_digest":"sha256:958aa36b94a85bba8fc66a501c3cb95dd7cd8ae381c34e78004462f58d68e292","observation_id":"3a43926e-a476-4278-81bd-6ce874bb9213","resolution":{"observed_at":"2026-08-06T10:26:17.860591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.07311","snapshot_observed_at":"2026-08-05T12:58:36.214919Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.01093","last_updated":"2025-09-01T03:32:50Z","snapshot_observed_at":"2026-08-10T23:19:43.399126Z","submitted_at":"2025-09-01T03:32:50Z","title":"Natural Context Drift Undermines the Natural Language Understanding of Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T12:58:36.214919Z"},"links":{"cited_paper":"/paper/2201.07311","citing_paper":"/paper/2509.01093"},"observation_digest":"sha256:43d441cec88c228c5158fdf2bc91ffb62385812427f523f9784a5aabfed06a47","observation_id":"04c7cc6f-5d7c-4c3d-b1fd-5d54b8d41a41","resolution":{"observed_at":"2026-08-05T12:58:36.214919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile","version":1},"cited_work":{"arxiv_id":"2201.07311","doi":"10.48550/arxiv.2201.07311","metadata_source":"arxiv_reference","pith_arxiv_id":"2201.07311","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Datasheet for the pile","venue":"arXiv (Cornell University)","work_id":"20da0ec8-989b-4d4e-ae7a-486228e0b542","year":2022},"citing_paper":{"arxiv_id":"2605.04116","last_updated":"2026-05-05T08:19:17Z","snapshot_observed_at":"2026-08-02T11:04:20.947325Z","submitted_at":"2026-05-05T08:19:17Z","title":"Membership Inference Attacks for Retrieval Based In-Context Learning for Document Question Answering","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T18:43:09.015367Z"},"links":{"cited_paper":"/paper/2201.07311","citing_paper":"/paper/2605.04116"},"observation_digest":"sha256:24032afc818b87df39384ef624411e9b6b0327d87ff5dd5bd54752769d5f5a60","observation_id":"a1d71b5a-060a-460e-b1fa-389a9f3e1971","resolution":{"observed_at":"2026-05-09T06:15:38.247332Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile","version":1},"cited_work":{"arxiv_id":"2201.07311","doi":"10.48550/arxiv.2201.07311","metadata_source":"arxiv_reference","pith_arxiv_id":"2201.07311","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Datasheet for the pile","venue":"arXiv (Cornell University)","work_id":"20da0ec8-989b-4d4e-ae7a-486228e0b542","year":2022},"citing_paper":{"arxiv_id":"2605.04952","last_updated":"2026-05-06T14:15:10Z","snapshot_observed_at":"2026-08-11T00:51:15.346895Z","submitted_at":"2026-05-06T14:15:10Z","title":"Adaptive Inverted-Index Routing for Granular Mixtures-of-Experts","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-08T17:58:10.323354Z"},"links":{"cited_paper":"/paper/2201.07311","citing_paper":"/paper/2605.04952"},"observation_digest":"sha256:602dc5a7c748469d6567ccef80038a9b6c88cf65c492fc1611009e48fccb780c","observation_id":"04e9ca33-37fe-4f7d-afcd-ea90ad7f858b","resolution":{"observed_at":"2026-05-09T06:55:43.515467Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile","version":1},"cited_work":{"arxiv_id":"2201.07311","doi":"10.48550/arxiv.2201.07311","metadata_source":"arxiv_reference","pith_arxiv_id":"2201.07311","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Datasheet for the pile","venue":"arXiv (Cornell University)","work_id":"20da0ec8-989b-4d4e-ae7a-486228e0b542","year":2022},"citing_paper":{"arxiv_id":"2605.06901","last_updated":"2026-05-07T20:02:53Z","snapshot_observed_at":"2026-08-12T17:41:37.399548Z","submitted_at":"2026-05-07T20:02:53Z","title":"Reflections and New Directions for Human-Centered Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-11T01:25:46.378350Z"},"links":{"cited_paper":"/paper/2201.07311","citing_paper":"/paper/2605.06901"},"observation_digest":"sha256:23c53f5d969fc235e10309677f27e52a0bf9c54f099b5a3fa1f06bae33ef288f","observation_id":"c377312d-1657-4f1b-8a15-6348689428b9","resolution":{"observed_at":"2026-05-11T04:25:56.831348Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile","version":1},"cited_work":{"arxiv_id":"2201.07311","doi":"10.48550/arxiv.2201.07311","metadata_source":"arxiv_reference","pith_arxiv_id":"2201.07311","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Datasheet for the pile","venue":"arXiv (Cornell University)","work_id":"20da0ec8-989b-4d4e-ae7a-486228e0b542","year":2022},"citing_paper":{"arxiv_id":"2605.20105","last_updated":"2026-05-19T16:56:56Z","snapshot_observed_at":"2026-08-14T10:15:44.943268Z","submitted_at":"2026-05-19T16:56:56Z","title":"Optimal Representation Size: High-Dimensional Analysis of Pretraining and Linear Probing","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-20T06:53:16.925588Z"},"links":{"cited_paper":"/paper/2201.07311","citing_paper":"/paper/2605.20105"},"observation_digest":"sha256:6765c4d92c7c436838dcedc985dd0e60ba20ee87802b5d4d11d1b75f754dcb56","observation_id":"680f3e0b-2c46-4e14-be9e-251e5ad15489","resolution":{"observed_at":"2026-05-20T06:53:22.898855Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile","version":1},"cited_work":{"arxiv_id":"2201.07311","doi":"10.48550/arxiv.2201.07311","metadata_source":"arxiv_reference","pith_arxiv_id":"2201.07311","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Datasheet for the pile","venue":"arXiv (Cornell University)","work_id":"20da0ec8-989b-4d4e-ae7a-486228e0b542","year":2022},"citing_paper":{"arxiv_id":"2606.18587","last_updated":"2026-06-17T01:27:33Z","snapshot_observed_at":"2026-07-06T23:53:59.519305Z","submitted_at":"2026-06-17T01:27:33Z","title":"Dual Dimensionality for Local and Global Attention","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T21:22:05.095209Z"},"links":{"cited_paper":"/paper/2201.07311","citing_paper":"/paper/2606.18587"},"observation_digest":"sha256:57a3ebf0a44d5d7676df91ec4311cd447422029dc732a7c6660f8eeecb442652","observation_id":"dc6e986a-86d0-456d-b1ac-9c79d5b3b49a","resolution":{"observed_at":"2026-07-04T00:19:13.102670Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.07311","snapshot_observed_at":"2026-07-11T17:58:26.517874Z","title":"Datasheet for the pile.arXiv preprint arXiv:2201.07311,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04525","last_updated":"2026-07-05T22:16:22Z","snapshot_observed_at":"2026-08-10T07:29:54.096296Z","submitted_at":"2026-07-05T22:16:22Z","title":"Language Models Represent and Transform Concepts with Shared Geometry","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-11T17:58:26.517874Z"},"links":{"cited_paper":"/paper/2201.07311","citing_paper":"/paper/2607.04525"},"observation_digest":"sha256:61bd62d9bee3acfed46caaa09aebfb3a81d7b4d4c386cde13c5263eda09db852","observation_id":"faae5644-bbd6-452e-b3eb-27f5cc944606","resolution":{"observed_at":"2026-07-11T17:58:26.517874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.07311","snapshot_observed_at":"2026-08-11T23:46:08.558757Z","title":"Datasheet for the Pile.arXiv preprint arXiv:2201.07311, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.09093","last_updated":"2026-08-10T03:43:30Z","snapshot_observed_at":"2026-08-14T07:29:24.314644Z","submitted_at":"2026-08-10T03:43:30Z","title":"The Announcement Carries the Cue: Markup, Boundaries, and the Notation of Pre-Training Corpora","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T23:46:08.558757Z"},"links":{"cited_paper":"/paper/2201.07311","citing_paper":"/paper/2608.09093"},"observation_digest":"sha256:6c5d3fe4f8ab6a6610eb801e58b17d38a642c6d48a708e23b7a0782890db55b2","observation_id":"2f9d920d-da0f-464f-9bd6-bbb8cda7e9ab","resolution":{"observed_at":"2026-08-11T23:46:08.558757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2201.07311/citation-record","integrity":"/paper/2201.07311/integrity","json":"/paper/2201.07311/citation-record.json","paper":"/paper/2201.07311"},"outbound":[],"paper":{"arxiv_id":"2201.07311","last_updated":"2022-01-13T23:45:24Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T16:59:27.224776Z","submitted_at":"2022-01-13T23:45:24Z","title":"Datasheet for the Pile"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 18 inbound Pith citation observations for arXiv:2201.07311."}