{"as_of":"2026-08-20T13:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c8d8f8ca03528938541dcad165854eac9b163246eb8c2f7d3883f0736ac9d180","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:59:04.660958Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-03T17:54:31.856386Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T17:58:46.704232Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"cited_work":{"arxiv_id":"2506.15553","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.15553","snapshot_observed_at":"2026-07-03T17:58:46.704232Z","title":"X.; Yin, J","venue":null,"work_id":"8f751a22-8165-4ef7-aae2-18137cbfd201","year":null},"citing_paper":{"arxiv_id":"2607.01686","last_updated":"2026-07-02T04:27:45Z","snapshot_observed_at":"2026-08-09T02:25:47.839654Z","submitted_at":"2026-07-02T04:27:45Z","title":"WARP: Weight-Space Analysis for Recovering Training Data Portfolios","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-03T17:54:31.856386Z"},"links":{"cited_paper":"/paper/2506.15553","citing_paper":"/paper/2607.01686"},"observation_digest":"sha256:e43f1661cd1b2de3997b1b377adcb407ca2f5a8da7161ac2d74a3f6dbcdadcb9","observation_id":"73d46ce7-8313-4b21-9bf5-ead3aaaaf5d2","resolution":{"observed_at":"2026-07-03T17:58:46.706324Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.15553/citation-record","integrity":"/paper/2506.15553/integrity","json":"/paper/2506.15553/citation-record.json","paper":"/paper/2506.15553"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:58:57.897397Z","title":"Dbpedia: A nucleus for a web of open data, 2007","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:57.897397Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:83ad5d57ff8d155d983028d006a6f887f9091ad739bad0923daa17ad7262775b","observation_id":"fdfa3b40-b820-4042-98e4-bace57be755b","resolution":{"observed_at":"2026-08-06T23:58:57.897397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.09268","last_updated":"2018-10-31T14:46:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-11-28T18:14:11Z","title":"MS MARCO: A Human Generated MAchine Reading COmprehension Dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.09268","snapshot_observed_at":"2026-08-06T23:58:58.012122Z","title":"Ms marco: A human generated machine reading comprehension dataset, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.012122Z"},"links":{"cited_paper":"/paper/1611.09268","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:ffdb9fe13eff5720f717bdb3dec862eda9ab593be946147ea027a78cc0b0604f","observation_id":"fbf335a2-7b14-4a0d-8c7d-e41ea3bc3db0","resolution":{"observed_at":"2026-08-06T23:58:58.012122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.04845","last_updated":"2022-04-25T12:53:14Z","snapshot_observed_at":"2026-08-16T17:28:38.008000Z","submitted_at":"2022-01-13T09:19:25Z","title":"Reconstructing Training Data with Informed Adversaries","version":2},"cited_work":{"arxiv_id":"2201.04845","doi":null,"metadata_source":"pith","pith_arxiv_id":"2201.04845","snapshot_observed_at":"2026-08-06T23:59:07.641212Z","title":"Reconstructing Training Data with Informed Adversaries","venue":"cs.CR","work_id":"577ac9be-3d62-4c91-9e80-b6cebe5ce9d6","year":2022},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.113238Z"},"links":{"cited_paper":"/paper/2201.04845","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:1b1ddef4cc6b3aa112036b5eafc8fb1d41a58e40a5bcf95751d4b4eb1c76cf14","observation_id":"d5872ccb-fdce-452b-96e9-d7e21300b18f","resolution":{"observed_at":"2026-08-06T23:59:07.808516Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:09.507363Z","title":"Coresets via bilevel optimization for continual learning and streaming","venue":null,"work_id":"071f0b86-0647-41f8-aeb1-bf0be34bb9fc","year":2020},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.225141Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:24ed29d7679b705cc7928a0ebf0ea5db6c6f9803b0a77741e7f0cf8c87984bcb","observation_id":"882d2219-1c48-4406-b242-62e33507d74b","resolution":{"observed_at":"2026-08-06T23:59:09.607367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01827","last_updated":"2023-11-02T20:05:44Z","snapshot_observed_at":"2026-08-20T13:10:47.273881Z","submitted_at":"2023-07-04T17:09:49Z","title":"Deconstructing Data Reconstruction: Multiclass, Weight Decay and General Losses","version":2},"cited_work":{"arxiv_id":"2307.01827","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.01827","snapshot_observed_at":"2026-08-06T23:59:07.272228Z","title":"Deconstructing Data Reconstruction: Multiclass, Weight Decay and General Losses","venue":"cs.LG","work_id":"796cf2d6-e3f2-4ddc-9619-5e86b0e86202","year":2023},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.316530Z"},"links":{"cited_paper":"/paper/2307.01827","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:d348011caf21d772d73c34a20e7d896d326ad90e29db38fdc8acfb4ddce7961d","observation_id":"d6171dfb-ab40-4209-8f4d-a2f1c58727ca","resolution":{"observed_at":"2026-08-06T23:59:07.432903Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-19T14:44:27.585280Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-06T23:58:58.403904Z","title":"Extracting training data from large language models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.403904Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:17e500136ab1f649cc2cf6875da9d4ce853aeb432c9d4270032d3241debe8c7d","observation_id":"63487873-dc3e-4722-88fe-87cac685c658","resolution":{"observed_at":"2026-08-06T23:58:58.403904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:58:58.545251Z","title":"Quantifying memorization across neural language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.545251Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:364a8463f5ef281a356bc8181bf2ad87b58ee1115c37a2ae6001f679f5559303","observation_id":"0517969b-9f8a-4e21-a65e-6da80e19aef2","resolution":{"observed_at":"2026-08-06T23:58:58.545251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06634","last_updated":"2024-07-09T17:44:00Z","snapshot_observed_at":"2026-08-16T14:11:01.433444Z","submitted_at":"2024-03-11T11:46:12Z","title":"Stealing Part of a Production Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06634","snapshot_observed_at":"2026-08-06T23:58:58.659790Z","title":"Feder Cooper, Katherine Lee, Matthew Jagielski, Milad Nasr, Arthur Conmy, Itay Yona, Eric Wallace, David Rolnick, and Florian Tramèr","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.659790Z"},"links":{"cited_paper":"/paper/2403.06634","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:9b49a6225936ee75f1c5c95388af5457b8355826946006db557c03fe191fcda4","observation_id":"381bac5a-b44b-42a5-9686-fd745ce10bd0","resolution":{"observed_at":"2026-08-06T23:58:58.659790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11932","last_updated":"2022-03-22T17:58:59Z","snapshot_observed_at":"2026-08-16T17:12:35.427997Z","submitted_at":"2022-03-22T17:58:59Z","title":"Dataset Distillation by Matching Training Trajectories","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11932","snapshot_observed_at":"2026-08-06T23:58:58.787017Z","title":"Efros, and Jun-Yan Zhu","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.787017Z"},"links":{"cited_paper":"/paper/2203.11932","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:ba08c0431a5d9fb2088efb9fb2367e2c0ca39ce67ecf0202527ac4303b92b51d","observation_id":"2e1c84ec-1c7a-4119-b983-1c025c8a6116","resolution":{"observed_at":"2026-08-06T23:58:58.787017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1203.3472","last_updated":"2012-03-15T11:17:56Z","snapshot_observed_at":"2026-08-15T08:54:57.050408Z","submitted_at":"2012-03-15T11:17:56Z","title":"Super-Samples from Kernel Herding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1203.3472","snapshot_observed_at":"2026-08-06T23:58:58.927044Z","title":"Super-samples from kernel herding","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.927044Z"},"links":{"cited_paper":"/paper/1203.3472","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:2c19800f2755ebf7fda12540a0ded9f8dd77cea9c4808ca6d17bc7969ccfdd07","observation_id":"5b4e2cf0-fa80-4443-9f72-af8a22f73c3c","resolution":{"observed_at":"2026-08-06T23:58:58.927044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10586","last_updated":"2023-10-31T19:28:40Z","snapshot_observed_at":"2026-08-16T16:14:57.121619Z","submitted_at":"2022-11-19T04:46:03Z","title":"Scaling Up Dataset Distillation to ImageNet-1K with Constant Memory","version":4},"cited_work":{"arxiv_id":"2211.10586","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.10586","snapshot_observed_at":"2026-08-06T23:59:06.884929Z","title":"Scaling Up Dataset Distillation to ImageNet-1K with Constant Memory","venue":"cs.CV","work_id":"8bbb1a90-22ed-4918-a7c7-f3255b9c3a8c","year":2022},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:59.037986Z"},"links":{"cited_paper":"/paper/2211.10586","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:676af36e803773ffa1f13cf2671895a4f0ab91d9c761bf805bcb356c58f00af9","observation_id":"69f3cd9f-f318-4d54-8ef4-c16c60d02c69","resolution":{"observed_at":"2026-08-06T23:59:07.046779Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:58:59.183925Z","title":"Sinkhorn distances: Lightspeed computation of optimal transport","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:59.183925Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:4a744aeb44e8f7feb9ee8330e0d29e92a8ba7494a865ee5e1f20d547bd67de90","observation_id":"335db460-6d08-44d7-be94-c37bd35296d1","resolution":{"observed_at":"2026-08-06T23:58:59.183925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T23:58:59.294471Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:59.294471Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:82f51d98c3b5a1ce854045c033a8681a45d2126d48c4b60aee01a60b62b49b81","observation_id":"280a3a48-41d0-4ebc-967b-4e9ef647e72e","resolution":{"observed_at":"2026-08-06T23:58:59.294471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12926","last_updated":"2024-01-23T17:22:00Z","snapshot_observed_at":"2026-08-16T14:25:07.499144Z","submitted_at":"2024-01-23T17:22:00Z","title":"DsDm: Model-Aware Dataset Selection with Datamodels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12926","snapshot_observed_at":"2026-08-06T23:58:59.399365Z","title":"Dsdm: Model-aware dataset selection with datamodels, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:59.399365Z"},"links":{"cited_paper":"/paper/2401.12926","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:58f0696184f35838edfd7d399d243b229e9364e05bb4f43796abe8375fb0c3f4","observation_id":"4de0d262-14d4-461d-9963-64712db86c6f","resolution":{"observed_at":"2026-08-06T23:58:59.399365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10951","last_updated":"2022-10-26T01:05:51Z","snapshot_observed_at":"2026-08-16T16:22:41.557626Z","submitted_at":"2022-10-20T01:45:02Z","title":"Automatic Document Selection for Efficient Encoder Pretraining","version":2},"cited_work":{"arxiv_id":"2210.10951","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.10951","snapshot_observed_at":"2026-08-06T23:59:06.556454Z","title":"Automatic Document Selection for Efficient Encoder Pretraining","venue":"cs.CL","work_id":"ddbc8037-3ee7-4196-b3f2-41b458f40923","year":2022},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:59.498674Z"},"links":{"cited_paper":"/paper/2210.10951","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:78af6669a0d10964154839ae13f896c212dfa4410c69e0dfaea992e20757d354","observation_id":"049658bc-669e-46b3-bf0c-cbd2f98e67e4","resolution":{"observed_at":"2026-08-06T23:59:06.675641Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09539","last_updated":"2024-11-08T18:56:41Z","snapshot_observed_at":"2026-08-20T11:48:57.001359Z","submitted_at":"2024-03-14T16:27:49Z","title":"Logits of API-Protected LLMs Leak Proprietary Information","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09539","snapshot_observed_at":"2026-08-06T23:58:59.628645Z","title":"Logits of api-protected llms leak proprietary information, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:59.628645Z"},"links":{"cited_paper":"/paper/2403.09539","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:fa1a1349513047824ff86e1c991e5cac65a03f30a67ac8c0251b6854cb594ef4","observation_id":"ae09eb1b-53dd-426a-9948-9b070d39cd72","resolution":{"observed_at":"2026-08-06T23:58:59.628645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05773","last_updated":"2024-03-18T11:44:06Z","snapshot_observed_at":"2026-08-19T09:33:03.214341Z","submitted_at":"2023-10-09T14:57:41Z","title":"Towards Lossless Dataset Distillation via Difficulty-Aligned Trajectory Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05773","snapshot_observed_at":"2026-08-06T23:58:59.733364Z","title":"Towards lossless dataset distillation via difficulty-aligned trajectory matching, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:59.733364Z"},"links":{"cited_paper":"/paper/2310.05773","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:b17709d0263e53eb3ae1363f4946ca22961db1664d37eb98f12a45ca80c24fff","observation_id":"848806e4-4cf2-41f8-a7a8-4bdebfd89c33","resolution":{"observed_at":"2026-08-06T23:58:59.733364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07758","last_updated":"2022-12-05T14:49:34Z","snapshot_observed_at":"2026-08-16T16:52:43.124495Z","submitted_at":"2022-06-15T18:35:16Z","title":"Reconstructing Training Data from Trained Neural Networks","version":3},"cited_work":{"arxiv_id":"2206.07758","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.07758","snapshot_observed_at":"2026-08-06T23:59:06.257917Z","title":"Reconstructing Training Data from Trained Neural Networks","venue":"cs.LG","work_id":"7eeb19bb-7f68-40c0-ab6f-66b8f539abcd","year":2022},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:59.848265Z"},"links":{"cited_paper":"/paper/2206.07758","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:7a56fb6f7020d01f1d816ba529aa2d6d9edd9848ecc05f7b1d4871257e6800b3","observation_id":"30567002-d23c-401b-bd37-c7434841a361","resolution":{"observed_at":"2026-08-06T23:59:06.361080Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:00.004638Z","title":"Can we infer confidential properties of training data from llms?, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:00.004638Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:5e397f37fcecd8bc6c56d943281d6e9542d50b09b50888886db9babcb6b0f6e5","observation_id":"95c9a9b6-db3c-47f6-9ab2-acb73e48fa84","resolution":{"observed_at":"2026-08-06T23:59:00.004638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:09.277970Z","title":"D-optimality for regression designs: a review","venue":null,"work_id":"790f388f-ffed-4223-8d1c-4ae291861c3b","year":1975},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:00.151281Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:2e98bd0a532bf5b7b5f7a75a90460c374cc74b088fd65904b3f9e8118a44d0fa","observation_id":"58f4fcca-546c-42cb-81b8-087e72d355d0","resolution":{"observed_at":"2026-08-06T23:59:09.376383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:00.268925Z","title":"Johnson and Joram Lindenstrauss","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:00.268925Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:021a071e4c19859c4bf7dbef2edd5e21973232caafbb7a2349a7c6017d156fdf","observation_id":"0e70ed92-8804-442b-b8dd-91421c4ce91f","resolution":{"observed_at":"2026-08-06T23:59:00.268925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:09.011051Z","title":"Grad-match: Gradient matching based data subset selection for efficient deep model training","venue":null,"work_id":"64d2dc4a-4c53-4ad6-802a-39a9d1b31fa9","year":2021},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:00.429419Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:1cecbc55794131c6d65f0f91fe1cac2d095be0552b2f590372f7f766eafa49c5","observation_id":"9718a7e9-6240-4b8d-9800-84734bcb4650","resolution":{"observed_at":"2026-08-06T23:59:09.132945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:08.797087Z","title":"Glister: Generalization based data subset selection for efficient and robust learning","venue":null,"work_id":"cbaad918-a99e-4bb9-be35-d4a8be748f9a","year":2021},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:00.583625Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:29968c1a2ce6ff1d3eef21c771673d7e1ef6a01f085f21b5474ee290183e3f0c","observation_id":"ec40b26f-58ae-4bbb-ae88-64b6979cd733","resolution":{"observed_at":"2026-08-06T23:59:08.908064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T23:59:00.718253Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:00.718253Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:3e9b599d0e00a6bbccd8e2dd967519b3032df2d74c63af28ad5f0e7ed623232c","observation_id":"5fe28127-6b58-442a-b10b-b5e21a07d82e","resolution":{"observed_at":"2026-08-06T23:59:00.718253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:08.508824Z","title":"From word embeddings to document distances","venue":null,"work_id":"fc796dd0-087f-4947-bcaa-ffeac2d5e26b","year":2015},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:00.898223Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:0779dc0dca42444a03f9f29622183f24b41a13605ec113398984231bca6ab5b7","observation_id":"424fc9c5-e403-413d-a85c-c03467e1a799","resolution":{"observed_at":"2026-08-06T23:59:08.655593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:01.010339Z","title":"Dai, Jakob Uszkoreit, Quoc Le, and Slav Petrov","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:01.010339Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:b1214364cbfbeee8b5fa02c05588d8520ffc4998f3c69ba98be3c18495648593","observation_id":"7e87c0ad-7046-49ad-a2ed-624b11c00dbb","resolution":{"observed_at":"2026-08-06T23:59:01.010339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20111","last_updated":"2023-10-31T01:08:34Z","snapshot_observed_at":"2026-08-16T14:47:24.478010Z","submitted_at":"2023-10-31T01:08:34Z","title":"Making Large Language Models Better Data Creators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20111","snapshot_observed_at":"2026-08-06T23:59:01.173754Z","title":"Making large language models better data creators","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:01.173754Z"},"links":{"cited_paper":"/paper/2310.20111","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:fb588ce7c126a57ab3943c947fc91fcc5813b3a09c2021bf24547091209987ae","observation_id":"c3ba1c5e-50b3-4d04-9b84-57ac7e9733d8","resolution":{"observed_at":"2026-08-06T23:59:01.173754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05679","last_updated":"2022-11-10T18:42:34Z","snapshot_observed_at":"2026-08-18T05:31:13.731058Z","submitted_at":"2021-10-12T01:45:27Z","title":"Large Language Models Can Be Strong Differentially Private Learners","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05679","snapshot_observed_at":"2026-08-06T23:59:01.305802Z","title":"Large language models can be strong differentially private learners, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:01.305802Z"},"links":{"cited_paper":"/paper/2110.05679","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:5a114f895d347496f6c2c25a334dad5506fbd5593c947ad88f0227afc8fb3b16","observation_id":"71d640f6-0d1f-4b9b-ac11-125c19e8d0dc","resolution":{"observed_at":"2026-08-06T23:59:01.305802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.20110","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:05.807938Z","title":"Efficient model development through fine-tuning transfer, 2025","venue":null,"work_id":"ca0b9521-b3d1-46db-bd0b-64230209bc80","year":2025},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:01.452910Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:a0d058fe1615cf2194465de34016e4bf33484c86412d1d3d14a56c381123aa17","observation_id":"4ef1e7fe-f22b-4232-b7c6-0365d4fbf836","resolution":{"observed_at":"2026-08-06T23:59:05.972463Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-18T18:18:37.449517Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T23:59:01.628222Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:01.628222Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:5f12e4f8b1fcc34b1675e93684501ee46b9dd461dd541768a113ecc8c57714a8","observation_id":"f32a1e12-6f3f-4801-a977-3345b5a12a0a","resolution":{"observed_at":"2026-08-06T23:59:01.628222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00264","last_updated":"2024-03-30T06:40:54Z","snapshot_observed_at":"2026-08-16T14:05:03.017624Z","submitted_at":"2024-03-30T06:40:54Z","title":"DiLM: Distilling Dataset into Language Model for Text-level Dataset Distillation","version":1},"cited_work":{"arxiv_id":"2404.00264","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.00264","snapshot_observed_at":"2026-08-06T23:59:05.385249Z","title":"DiLM: Distilling Dataset into Language Model for Text-level Dataset Distillation","venue":"cs.CL","work_id":"554af822-a0e4-42c5-81fb-ef24f7955163","year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:01.783356Z"},"links":{"cited_paper":"/paper/2404.00264","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:d55d008df021d3c5b99c5c7ef12e2adc0795e97c72b0fb5364df227d6d341227","observation_id":"43d2f168-00cc-40c8-9e15-91fdfdb406be","resolution":{"observed_at":"2026-08-06T23:59:05.548663Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T23:59:01.963392Z","title":"The llama 3 herd of models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:01.963392Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:9ac5ea269c60fc062ffe30b2a8f3941f738b23166acf97716b2a293db23c4a32","observation_id":"7d54b2b6-e4cc-4351-a1fe-ea6513ac22c0","resolution":{"observed_at":"2026-08-06T23:59:01.963392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:08.233001Z","title":"Coresets for robust training of deep neural networks against noisy labels","venue":null,"work_id":"ddb6b2c8-f84b-4ee5-aae0-d514b404e6eb","year":2020},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:02.139584Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:1850e7915b38956b3829e1989d9d0e242a6e4f6fa6aed3cf4d2f8a695a8a5ea8","observation_id":"cdc8614b-9460-4c68-8d0e-329cd8e5df60","resolution":{"observed_at":"2026-08-06T23:59:08.329164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:02.243562Z","title":"Twenty Newsgroups","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:02.243562Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:2daa4e644b24ea1f0bbe3445fa99ee9c7285b88dd052c0a867259bc13a6b8bc4","observation_id":"a9259e47-3708-4978-90d2-250f46b8bc60","resolution":{"observed_at":"2026-08-06T23:59:02.243562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13647","last_updated":"2023-11-22T19:04:04Z","snapshot_observed_at":"2026-08-16T14:41:04.018351Z","submitted_at":"2023-11-22T19:04:04Z","title":"Language Model Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13647","snapshot_observed_at":"2026-08-06T23:59:02.503431Z","title":"Morris, Wenting Zhao, Justin T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:02.503431Z"},"links":{"cited_paper":"/paper/2311.13647","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:49bc4829fe30e013762d0c034a12c33733993acf1e6422c2a00e0cd3e63185f6","observation_id":"67848785-9880-4729-8fba-e2a0548ab204","resolution":{"observed_at":"2026-08-06T23:59:02.503431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24832","last_updated":"2025-06-18T15:27:03Z","snapshot_observed_at":"2026-08-15T05:45:43.601041Z","submitted_at":"2025-05-30T17:34:03Z","title":"How much do language models memorize?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24832","snapshot_observed_at":"2026-08-06T23:59:02.626543Z","title":"Morris, Chawin Sitawarin, Chuan Guo, Narine Kokhlikyan, G","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:02.626543Z"},"links":{"cited_paper":"/paper/2505.24832","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:a3c524e8cc889c4360976c91c071b97f0dbd9f262a4f33a95dd7814cf4af25b9","observation_id":"71335e31-71e3-47e8-84ca-71cfd9d979ce","resolution":{"observed_at":"2026-08-06T23:59:02.626543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17035","last_updated":"2023-11-28T18:47:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T18:47:03Z","title":"Scalable Extraction of Training Data from (Production) Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17035","snapshot_observed_at":"2026-08-06T23:59:02.760712Z","title":"Feder Cooper, Daphne Ippolito, Christopher A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:02.760712Z"},"links":{"cited_paper":"/paper/2311.17035","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:b1dbc93e2989d2e3755368871caaf7337a19572dc3911989e263933ed582bdd3","observation_id":"db648e96-6e9c-4040-be16-00146c2ae2b6","resolution":{"observed_at":"2026-08-06T23:59:02.760712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:02.910601Z","title":null,"venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:02.910601Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:ad8a5a5436faa870206215b0196cddd5a8afc7b2ffcf504876008eb8d40ad923","observation_id":"a8c24dff-b8b3-4395-900e-3ad2923ed06d","resolution":{"observed_at":"2026-08-06T23:59:02.910601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17607","last_updated":"2025-06-06T19:43:38Z","snapshot_observed_at":"2026-08-19T12:08:22.045763Z","submitted_at":"2025-02-24T19:49:15Z","title":"Synthetic Text Generation for Training Large Language Models via Gradient Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17607","snapshot_observed_at":"2026-08-06T23:59:03.031567Z","title":"Synthetic text generation for training large language models via gradient matching, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:03.031567Z"},"links":{"cited_paper":"/paper/2502.17607","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:de47919859abed00689e06f40f5cde175f08c51231f805ee2f412db2c511c63f","observation_id":"5571f04f-54f5-4128-b128-4ada8f854d24","resolution":{"observed_at":"2026-08-06T23:59:03.031567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:03.164482Z","title":"Estimating training data influence by tracing gradient descent","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:03.164482Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:c1e68fb160d8451e79aa883c13a2a029446bf174937bd448d29205e74a242c1e","observation_id":"ac246015-d88c-4c48-8076-7b413a25751b","resolution":{"observed_at":"2026-08-06T23:59:03.164482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:03.264122Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:03.264122Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:ff5be1a3716d1cff0b262727cd0b02d45d14a9a2b3c14bd55c986afb7070f4d7","observation_id":"3039758f-80b8-490c-a8ae-8429c7f967d7","resolution":{"observed_at":"2026-08-06T23:59:03.264122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08544","last_updated":"2024-12-11T17:00:29Z","snapshot_observed_at":"2026-08-18T08:58:35.459205Z","submitted_at":"2024-12-11T17:00:29Z","title":"Training Data Reconstruction: Privacy due to Uncertainty?","version":1},"cited_work":{"arxiv_id":"2412.08544","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.08544","snapshot_observed_at":"2026-08-06T23:59:04.964213Z","title":"Training Data Reconstruction: Privacy due to Uncertainty?","venue":"cs.LG","work_id":"a1ad0f47-9194-44bf-b88c-75da8df5d430","year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:03.367720Z"},"links":{"cited_paper":"/paper/2412.08544","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:3f9ad20a791437d8a8c0a2e84d5ac67d1fc1331575431c991bf4b5b44e294d9a","observation_id":"91d15c3e-f10f-48b4-86a5-48b4bec7eb0c","resolution":{"observed_at":"2026-08-06T23:59:05.085352Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.10959","last_updated":"2020-02-24T23:25:50Z","snapshot_observed_at":"2026-08-18T06:11:01.992422Z","submitted_at":"2018-11-27T13:17:45Z","title":"Dataset Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.10959","snapshot_observed_at":"2026-08-06T23:59:03.562990Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:03.562990Z"},"links":{"cited_paper":"/paper/1811.10959","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:2883789799acdfdc2704d200c148098a021200380a09a60c14a3b3e3ce857063","observation_id":"75cc5f64-cb2f-4299-8a0e-067d162f76e8","resolution":{"observed_at":"2026-08-06T23:59:03.562990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-06T23:59:03.711431Z","title":"Less: Selecting influential data for targeted instruction tuning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:03.711431Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:ab1c80fad3de0048c25e8d7b362f5d4f9b7363340efc220c6d62a0da88a0a672","observation_id":"86930eeb-2581-4feb-8996-c825a2b0a21e","resolution":{"observed_at":"2026-08-06T23:59:03.711431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:03.837866Z","title":"Data selection for language models via importance resampling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:03.837866Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:e9e2748e02ee348657c3b51b1510d95b5637e926ea6f6e2bd0778cf06a52d4ec","observation_id":"5a1c75ae-a5d5-4da6-9577-fd123feecb0a","resolution":{"observed_at":"2026-08-06T23:59:03.837866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16208","last_updated":"2025-04-07T18:16:42Z","snapshot_observed_at":"2026-08-18T13:42:22.425136Z","submitted_at":"2024-10-21T17:11:21Z","title":"Compute-Constrained Data Selection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16208","snapshot_observed_at":"2026-08-06T23:59:03.977103Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:03.977103Z"},"links":{"cited_paper":"/paper/2410.16208","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:18e5d919dcb90f82162868c3644bda613a7c1252f823caf35ea1915c04301268","observation_id":"aecf3c81-523d-4fce-af6f-0980670db00f","resolution":{"observed_at":"2026-08-06T23:59:03.977103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13092","last_updated":"2024-02-11T20:34:51Z","snapshot_observed_at":"2026-08-18T10:16:43.029202Z","submitted_at":"2023-06-22T17:59:58Z","title":"Squeeze, Recover and Relabel: Dataset Condensation at ImageNet Scale From A New Perspective","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13092","snapshot_observed_at":"2026-08-06T23:59:04.118690Z","title":"Squeeze, recover and relabel: Dataset condensation at imagenet scale from a new perspective, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:04.118690Z"},"links":{"cited_paper":"/paper/2306.13092","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:dc44a122426332985fa313f4c73bb0860c70c3bca0bb91e6307e7df9199e69cb","observation_id":"a0944248-4c16-4dc6-8729-1a0cff764c0c","resolution":{"observed_at":"2026-08-06T23:59:04.118690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.01626","last_updated":"2016-04-04T02:34:30Z","snapshot_observed_at":"2026-08-17T07:53:50.742745Z","submitted_at":"2015-09-04T22:31:53Z","title":"Character-level Convolutional Networks for Text Classification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.01626","snapshot_observed_at":"2026-08-06T23:59:04.278430Z","title":"Character-level convolutional networks for text classification, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:04.278430Z"},"links":{"cited_paper":"/paper/1509.01626","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:3bd45eff5088b0ade9d9a4e4d70a1546b7d69077b607052dc88cc96266ef133d","observation_id":"3f63f595-2720-4c1e-a243-943ded2ecdff","resolution":{"observed_at":"2026-08-06T23:59:04.278430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.05929","last_updated":"2021-03-08T13:31:22Z","snapshot_observed_at":"2026-08-09T10:26:02.821053Z","submitted_at":"2020-06-10T16:30:52Z","title":"Dataset Condensation with Gradient Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.05929","snapshot_observed_at":"2026-08-06T23:59:04.416765Z","title":"Dataset condensation with gradient matching, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:04.416765Z"},"links":{"cited_paper":"/paper/2006.05929","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:dcd522d241d3e42fe19ffa35749ee55810cb24bead3701ff710f8e7cefbc8c09","observation_id":"47ce09c5-d399-44c2-8303-d59882e02e31","resolution":{"observed_at":"2026-08-06T23:59:04.416765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:07.963591Z","title":"Dataset distillation using neural feature regression","venue":null,"work_id":"14578b69-ce1e-4262-b356-d8aa2dee98ba","year":2022},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:04.555823Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:331b815314eb1c1cb706fc1011e0d7e98ece46a3356b1dfa70b86f819f098d91","observation_id":"3546edc5-6224-4098-a92a-d5a40d1de66c","resolution":{"observed_at":"2026-08-06T23:59:08.070508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:04.660958Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:04.660958Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:874c6f8f6070ca7ddee0c4873dbafa4f962eef469c926fe67919ca48962f0ad4","observation_id":"20e572c3-a858-4cc0-86ba-c4522f835769","resolution":{"observed_at":"2026-08-06T23:59:04.660958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":8,"verified_fuzzy":7},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 1 inbound Pith citation observation for arXiv:2506.15553."}