{"as_of":"2026-08-09T15:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:04d6a0c160e0424fbc1e6966a0404a26bc71a9bbb95c0d94f10c4f13750d6d4c","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T01:45:19.127391Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.14306/citation-record","integrity":"/paper/2607.14306/integrity","json":"/paper/2607.14306/citation-record.json","paper":"/paper/2607.14306"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-04T01:45:18.540645Z","title":"The pile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-09T11:09:07.053763Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.540645Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:8e0b31ac53c76e08b568e46f84cb5a05f6d2807022d586088ecf7c4e3bd091b3","observation_id":"aa6f2505-82ca-46f3-a3ac-67c21dfb0bc3","resolution":{"observed_at":"2026-08-04T01:45:18.540645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.29548","last_updated":"2026-06-01T17:29:35Z","snapshot_observed_at":"2026-08-02T17:41:19.598860Z","submitted_at":"2026-05-28T08:02:11Z","title":"Why Larger Models Learn More: Effects of Capacity, Interference, and Rare-Task Retention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.29548","snapshot_observed_at":"2026-08-04T01:45:18.695606Z","title":"Why larger models learn more: Effects of capacity, interference, and rare-task retention.arXiv preprint arXiv:2605.29548,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-09T11:09:07.053763Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.695606Z"},"links":{"cited_paper":"/paper/2605.29548","citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:0f411e851b9d7ce21952d809a2e64e2193c9b7298a5c0f7c9117ed51c4aebf07","observation_id":"150c4578-eaf8-4766-b1d3-ced5db3b2652","resolution":{"observed_at":"2026-08-04T01:45:18.695606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-04T01:45:18.749882Z","title":"In-context learning and induction heads.arXiv preprint arXiv:2209.11895,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-09T11:09:07.053763Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.749882Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:70324913f7492e5348bb1680fd80c29beefc263ac0832ed69c3275d2ee9dfa9b","observation_id":"780bf20f-282f-46c5-85ef-4a661bf8fd7a","resolution":{"observed_at":"2026-08-04T01:45:18.749882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:45:18.821579Z","title":"Backtracking mathematical reasoning of language models to the pretraining data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-09T11:09:07.053763Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.821579Z"},"links":{"citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:25056cd7955e06ec9c3cf9fa4afbb26cf19481f30e159b37a72c9050fffbe474","observation_id":"0cf14fd0-76dc-4043-90c9-9f4180ce1986","resolution":{"observed_at":"2026-08-04T01:45:18.821579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:45:18.971744Z","title":"Polypythias: Stability and outliers across fifty language model pre-training runs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-09T11:09:07.053763Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.971744Z"},"links":{"citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:86e34981a03212fbcfa2520710d5bede7e5ab94b683b59eff65358da2ace3cba","observation_id":"46f28f8b-a6e8-48f7-bf91-c2189e23b6f3","resolution":{"observed_at":"2026-08-04T01:45:18.971744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:45:19.127391Z","title":"Jiasheng Ye, Peiju Liu, Tianxiang Sun, Jun Zhan, Yunhua Zhou, and Xipeng Qiu","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-09T11:09:07.053763Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:19.127391Z"},"links":{"citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:4d15ec8f762cb82e5ee18128ffd359d28ca3657282e81d32c1d8f1582f4d26b8","observation_id":"3676417d-e443-41f8-927c-9cc3d4a0c35f","resolution":{"observed_at":"2026-08-04T01:45:19.127391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03296","last_updated":"2023-08-07T04:47:42Z","snapshot_observed_at":"2026-08-09T11:08:40.708986Z","submitted_at":"2023-08-07T04:47:42Z","title":"Studying Large Language Model Generalization with Influence Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03296","snapshot_observed_at":"2026-08-04T01:45:18.619376Z","title":"Studying large language model generalization with influence functions.arXiv preprint arXiv:2308.03296,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-09T11:09:07.053763Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.619376Z"},"links":{"cited_paper":"/paper/2308.03296","citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:2f5e9a81460db56255dbb4cd17a295cb2ec88b0fc21477bd3847ea8363e24235","observation_id":"5838fa0b-fa07-42dd-8f97-28d6d0efeb9d","resolution":{"observed_at":"2026-08-04T01:45:18.619376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06634","last_updated":"2024-07-09T17:44:00Z","snapshot_observed_at":"2026-07-06T17:42:33.242895Z","submitted_at":"2024-03-11T11:46:12Z","title":"Stealing Part of a Production Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06634","snapshot_observed_at":"2026-08-04T01:45:18.338994Z","title":"Stealing part of a production language model.arXiv preprint arXiv:2403.06634,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-09T11:09:07.053763Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.338994Z"},"links":{"cited_paper":"/paper/2403.06634","citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:687c68ab6ad347f207f386ad59ff27760632e29dd5aefa5db34bae7c6a368d5d","observation_id":"13dc8bbc-f492-4229-9cb5-4ada2d9b8f04","resolution":{"observed_at":"2026-08-04T01:45:18.338994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:45:18.298168Z","title":"Language contamination helps explains the cross-lingual capabilities of english pretrained models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-09T11:09:07.053763Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.298168Z"},"links":{"citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:1e4d1f43fd73b781a2ad88d3080d26cf84aae2334daf42668b807fd67be0c68c","observation_id":"90fcf031-a76e-4a02-b970-b99ba6125a6a","resolution":{"observed_at":"2026-08-04T01:45:18.298168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:45:18.393265Z","title":"Pretraining data statistics shape the phases of learning entity comparison in language models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-09T11:09:07.053763Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.393265Z"},"links":{"citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:1057f5bd2432dfd16b1fd76ff017ba4f736b021dc33429e392b88161d163a43e","observation_id":"c3aec7f0-926f-49ce-8ecf-62598d29d059","resolution":{"observed_at":"2026-08-04T01:45:18.393265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:45:19.044382Z","title":"Jason Wei, Dan Garrette, Tal Linzen, and Ellie Pavlick","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-09T11:09:07.053763Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:19.044382Z"},"links":{"citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:36aeaab4fb84ed1ddd087528485719d435d60e28cc83f73aa90155636580f507","observation_id":"08e6c2ee-e8ef-488e-968a-145f1d8e271b","resolution":{"observed_at":"2026-08-04T01:45:19.044382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.14251","last_updated":"2023-03-24T07:18:59Z","snapshot_observed_at":"2026-08-02T02:24:26.318853Z","submitted_at":"2022-07-28T17:36:24Z","title":"Measuring Causal Effects of Data Statistics on Language Model's `Factual' Predictions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.14251","snapshot_observed_at":"2026-08-04T01:45:18.458866Z","title":"Measuring causal effects of data statistics on language model’sfactual’predictions.arXiv preprint arXiv:2207.14251,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","snapshot_observed_at":"2026-08-09T11:09:07.053763Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-04T01:45:18.458866Z"},"links":{"cited_paper":"/paper/2207.14251","citing_paper":"/paper/2607.14306"},"observation_digest":"sha256:7383bdeadb5bfb7de6ace71a01f889c48d73adcdae520f98d897ebe764d9b853","observation_id":"df60d6c8-5a36-4e5f-9d43-e4f19ada691b","resolution":{"observed_at":"2026-08-04T01:45:18.458866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.14306","last_updated":"2026-08-01T03:22:14Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T11:09:07.053763Z","submitted_at":"2026-07-15T19:11:54Z","title":"Tracing LLM Behavior to the Training Data with Empirical Next-Token Distributions"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:2607.14306."}