{"as_of":"2026-08-09T10:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5d90e15cb97de61d2e98e9e2a63357e141e06343df50760b15b04ab9308e1230","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":51,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:37:25.072025Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":275,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-10T21:35:18.513342Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2101.00027"},"observation_digest":"sha256:936f0861e500d066e97cf9162077ce1beaba939d608a52b01d2fb9a9923e4011","observation_id":"1f249adc-febb-4812-a104-ac684d731332","resolution":{"observed_at":"2026-05-10T21:35:18.749655Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2107.06499","last_updated":"2022-03-24T19:29:45Z","snapshot_observed_at":"2026-08-05T18:30:13.997811Z","submitted_at":"2021-07-14T06:06:52Z","title":"Deduplicating Training Data Makes Language Models Better","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-24T13:36:55.210708Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2107.06499"},"observation_digest":"sha256:938b0396db7dc887143220dbafe4f5e7c95f8342d51d8557791bcbe7e887aa5b","observation_id":"a001a767-4dd2-40a8-909e-e78e492c4507","resolution":{"observed_at":"2026-05-24T13:39:31.714001Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2112.04359","last_updated":"2021-12-08T16:09:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T16:09:48Z","title":"Ethical and social risks of harm from Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-11T18:24:28.835688Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2112.04359"},"observation_digest":"sha256:e601abb49d0f82455bf076fd185e12ffcc1bee7aad4cc7c7894eda723c9d756e","observation_id":"5d360aae-b923-4573-b2ad-60a12b397e5b","resolution":{"observed_at":"2026-05-11T18:24:29.952856Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2201.08239","last_updated":"2022-02-10T16:30:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-20T15:44:37Z","title":"LaMDA: Language Models for Dialog Applications","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-12T03:17:32.272353Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2201.08239"},"observation_digest":"sha256:3d66e574682846707cf518f363130e22b3f32e3810450dea337c633a167c353f","observation_id":"3da7c7d4-035e-4215-a99a-aa3bd6df49c2","resolution":{"observed_at":"2026-05-12T03:17:32.518336Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2202.07646","last_updated":"2023-03-06T06:28:18Z","snapshot_observed_at":"2026-08-03T19:51:05.627063Z","submitted_at":"2022-02-15T18:48:31Z","title":"Quantifying Memorization Across Neural Language Models","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T22:04:59.678438Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2202.07646"},"observation_digest":"sha256:89046e2cbdceb59bfbcec9fed4d510991a93fdf14e54f1e409120c289005b87b","observation_id":"0e12e445-3aea-4195-bc41-e52d725cb488","resolution":{"observed_at":"2026-05-13T22:04:59.731563Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2205.10487","last_updated":"2022-05-21T02:14:27Z","snapshot_observed_at":"2026-08-04T13:21:32.121470Z","submitted_at":"2022-05-21T02:14:27Z","title":"Scaling Laws and Interpretability of Learning from Repeated Data","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-17T15:52:40.335080Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2205.10487"},"observation_digest":"sha256:2d6a518fadcf3b6e950c515d531d931448ba4659780d379e7c112afebfb56443","observation_id":"78f2a4f4-10c0-4085-a8cd-f4364edeca01","resolution":{"observed_at":"2026-05-17T15:52:40.461771Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T01:38:08.362920Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2209.07858"},"observation_digest":"sha256:8970f07e3fe1d1b1f6f60971847e338cd7b85bc04bac777fe3ea890587ed32df","observation_id":"862123b6-3250-4082-8f30-c978da3b3fc5","resolution":{"observed_at":"2026-05-12T01:38:08.468054Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2301.11325","last_updated":"2023-01-26T18:58:53Z","snapshot_observed_at":"2026-07-06T14:45:00.730733Z","submitted_at":"2023-01-26T18:58:53Z","title":"MusicLM: Generating Music From Text","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T14:27:05.198402Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2301.11325"},"observation_digest":"sha256:9e15edc612bbd16fd164b1ce6ed6740cf917f1265e8068e5624e0a877931a255","observation_id":"54ae7179-ff65-4628-80c9-4d5bd6586ed9","resolution":{"observed_at":"2026-05-13T14:27:06.256783Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2402.16391","last_updated":"2026-04-28T07:39:39Z","snapshot_observed_at":"2026-08-01T03:48:12.462157Z","submitted_at":"2024-02-26T08:31:45Z","title":"Industry Practitioners Perspectives on AI Model Quality: Perceptions, Challenges, and Solutions","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-24T04:21:49.775278Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2402.16391"},"observation_digest":"sha256:cb6d69dbba97e3f78bf7cec8378b5478c3bdb076f217e3221d64ff17793a5acc","observation_id":"ae0ef567-9f81-41fc-a125-e94baeaec035","resolution":{"observed_at":"2026-05-24T04:23:52.895916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2403.07691","last_updated":"2024-03-14T07:47:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T14:34:08Z","title":"ORPO: Monolithic Preference Optimization without Reference Model","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-16T09:34:04.394588Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2403.07691"},"observation_digest":"sha256:c68f84dd9ec6a2129e3c6126c30441d7c23245c2d0498ba70d70b6feb364946a","observation_id":"8fd242df-c7e3-41f4-83a3-3354df4306fa","resolution":{"observed_at":"2026-05-16T09:34:04.740850Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2501.02407","last_updated":"2026-05-20T14:04:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-05T00:03:18Z","title":"Towards the Anonymization of the Language Modeling","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-23T06:28:16.975305Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2501.02407"},"observation_digest":"sha256:a65cfbc6f8d835ccf38a9463c910c643dc26b5123f70457e30f93f4c29db21f2","observation_id":"07b45183-d87e-42d3-aee1-ba78389b23f1","resolution":{"observed_at":"2026-05-23T06:32:39.434987Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"reference_index":253,"source":"arxiv_source","source_observed_at":"2026-05-17T02:11:36.932541Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2502.03387"},"observation_digest":"sha256:37923eca85dd87adef4540b9a5875e308d3ea3b285ecc44d21855b046c082f87","observation_id":"62fcb607-fd74-4d3c-ad40-67c0d7f50894","resolution":{"observed_at":"2026-05-17T02:11:37.303275Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-07T15:37:25.072025Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.072025Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:aa849bedc54e735d94645e056a3206b47b8ab9f9ee259ad4a8dfb5878cec5d24","observation_id":"73256e9c-8ad7-463d-8010-e673d7e5b027","resolution":{"observed_at":"2026-08-07T15:37:25.072025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2505.18853","last_updated":"2026-05-15T15:40:33Z","snapshot_observed_at":"2026-07-06T21:29:55.740715Z","submitted_at":"2025-05-24T20:02:14Z","title":"Smoothie: Smoothing Diffusion on Token Embeddings for Text Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T01:34:21.657999Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2505.18853"},"observation_digest":"sha256:8294b6e00b8b378e56c4a511a79682322438b0c70975de762e1f17f2f0a6a1e6","observation_id":"65626d80-068e-4c69-a336-5968e501f862","resolution":{"observed_at":"2026-05-22T01:34:30.348594Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-06T23:58:58.403904Z","title":"Extracting training data from large language models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-08T20:05:57.585673Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.403904Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:66e120d7b056ad4f65c4794c1766f80f1da7cb5d098bec3af260be502dcb9a03","observation_id":"63487873-dc3e-4722-88fe-87cac685c658","resolution":{"observed_at":"2026-08-06T23:58:58.403904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-06T23:49:10.559721Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.16170","last_updated":"2025-08-15T18:12:41Z","snapshot_observed_at":"2026-08-09T02:08:40.327116Z","submitted_at":"2025-06-19T09:44:25Z","title":"From Teacher to Student: Tracking Memorization Through Model Distillation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:10.559721Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2506.16170"},"observation_digest":"sha256:5cf499746efc0a06c3acd22f958d46f33647b24aa806fb28f9c2bfd022b05a32","observation_id":"337899db-b046-4a2b-9411-196bf7d67a2e","resolution":{"observed_at":"2026-08-06T23:49:10.559721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-06T20:44:58.634485Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01844","last_updated":"2025-07-02T15:58:51Z","snapshot_observed_at":"2026-08-08T14:54:47.103236Z","submitted_at":"2025-07-02T15:58:51Z","title":"Low-Perplexity LLM-Generated Sequences and Where To Find Them","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T20:44:58.634485Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2507.01844"},"observation_digest":"sha256:1724fe894b73398b3f5ef5ae22be136c4f0df668363d3b806abbd41c8d83078b","observation_id":"42bf4c06-3c92-4a00-9aa0-b9d9be79d119","resolution":{"observed_at":"2026-08-06T20:44:58.634485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-06T19:48:55.141023Z","title":"Extracting Training Data from Large Language Models,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.04478","last_updated":"2025-07-06T17:24:17Z","snapshot_observed_at":"2026-08-09T09:03:10.672526Z","submitted_at":"2025-07-06T17:24:17Z","title":"Model Inversion Attacks on Llama 3: Extracting PII from Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:48:55.141023Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2507.04478"},"observation_digest":"sha256:3352c632dc7c8b0cddc2e92915b77ab4c8a2cca9b771a2ef160044499975dbdf","observation_id":"6ea55d67-c336-4e53-831c-47d55a3e9ae5","resolution":{"observed_at":"2026-08-06T19:48:55.141023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-06T19:31:00.983161Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05441","last_updated":"2025-07-07T19:45:46Z","snapshot_observed_at":"2026-08-09T08:00:50.011224Z","submitted_at":"2025-07-07T19:45:46Z","title":"Adversarial Machine Learning Attacks on Financial Reporting via Maximum Violated Multi-Objective Attack","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:31:00.983161Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2507.05441"},"observation_digest":"sha256:81322fdf12301ea1248f268096139553aab1a3c0ab31f34b316c970a310ac1c5","observation_id":"e941e346-f608-4269-aa6c-193a4c956cbc","resolution":{"observed_at":"2026-08-06T19:31:00.983161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-06T17:35:00.426132Z","title":"Extracting training data from large language models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-08T02:32:07.680586Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.426132Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:0bcaacabc720a1e83fa1ee0ab63c3385a824393d717578d5e132ad332b4a8a6a","observation_id":"77948df8-f2ae-4a6a-9eeb-3f0a4ab7d5c2","resolution":{"observed_at":"2026-08-06T17:35:00.426132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-06T15:46:55.618154Z","title":"Extracting training data from large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.15104","last_updated":"2026-06-15T19:35:17Z","snapshot_observed_at":"2026-08-06T23:38:35.977969Z","submitted_at":"2025-07-20T19:57:07Z","title":"AnalogFed: Privacy-Preserving Discovery of Analog Circuits at Scale with Federated Generative AI","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T15:46:55.618154Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2507.15104"},"observation_digest":"sha256:d9191ef598f150dff5da657cce2c7f81afd044a74e6ba4d6fe252d3d3ccb80a4","observation_id":"aa9c0ed5-5f41-4d48-941c-dccbe7fe0fdc","resolution":{"observed_at":"2026-08-06T15:46:55.618154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T20:31:43.822425Z","title":"Extracting training data from large language models","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2508.10404","last_updated":"2025-08-14T07:12:44Z","snapshot_observed_at":"2026-08-08T02:31:17.622343Z","submitted_at":"2025-08-14T07:12:44Z","title":"Layer-Wise Perturbations via Sparse Autoencoders for Adversarial Text Generation","version":1},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-08-05T20:31:43.822425Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2508.10404"},"observation_digest":"sha256:969a0fadfe3749d01d4de34356b5f7a9b153ccc3a1063fc4d954dd1d0558f3fd","observation_id":"45843fde-c633-4720-a317-5c86e2576e11","resolution":{"observed_at":"2026-08-05T20:31:43.822425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T16:50:19.605008Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17767","last_updated":"2025-09-13T01:49:58Z","snapshot_observed_at":"2026-08-06T11:47:39.038660Z","submitted_at":"2025-08-25T08:04:20Z","title":"ISACL: Internal State Analyzer for Copyrighted Training Data Leakage","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T16:50:19.605008Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2508.17767"},"observation_digest":"sha256:7b4e5082fa6bfda668d5cfb1d480c7ef82acdd6653791b6b001db6b7808d4774","observation_id":"cd504875-9749-41af-a9f8-8cfebb784e8d","resolution":{"observed_at":"2026-08-05T16:50:19.605008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T15:09:03.247046Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2508.20452","last_updated":"2025-08-28T05:57:47Z","snapshot_observed_at":"2026-08-06T16:29:22.774856Z","submitted_at":"2025-08-28T05:57:47Z","title":"Evaluating Differentially Private Generation of Domain-Specific Text","version":1},"reference_index":2650,"source":"pdf_text","source_observed_at":"2026-08-05T15:09:03.247046Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2508.20452"},"observation_digest":"sha256:dfe89199272c8e144df22a87688f13bd41727227c1f7cd8a3a4baae6a4d21cb6","observation_id":"5a4074d2-053f-4fce-b7a7-fa03fb5fe38e","resolution":{"observed_at":"2026-08-05T15:09:03.247046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T04:46:41.159734Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.07022","last_updated":"2025-09-07T08:43:39Z","snapshot_observed_at":"2026-08-06T03:39:54.422946Z","submitted_at":"2025-09-07T08:43:39Z","title":"Preventing Another Tessa: Modular Safety Middleware For Health-Adjacent AI Assistants","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T04:46:41.159734Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2509.07022"},"observation_digest":"sha256:206456f9836d14463614c79cc78988f8071685fcae29786b884601df487d2bca","observation_id":"178f3650-d0a3-4e33-8ccd-087eef77de7b","resolution":{"observed_at":"2026-08-05T04:46:41.159734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2509.14594","last_updated":"2026-05-07T08:05:08Z","snapshot_observed_at":"2026-07-31T18:59:02.315833Z","submitted_at":"2025-09-18T03:57:50Z","title":"SynBench: A Benchmark for Differentially Private Text Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T16:46:22.479895Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2509.14594"},"observation_digest":"sha256:1938a0df7a9c7ae2c406c5a93153468fa9b6e468f6f55186f0ea7656b459650d","observation_id":"ffe1c536-0a58-4f78-b42e-25b0318b13be","resolution":{"observed_at":"2026-05-18T16:46:37.468783Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2512.08875","last_updated":"2026-05-08T19:19:07Z","snapshot_observed_at":"2026-08-07T07:00:38.303140Z","submitted_at":"2025-12-09T18:06:31Z","title":"When Tables Leak: Attacking String Memorization in LLM-Based Tabular Data Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T23:47:31.667427Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2512.08875"},"observation_digest":"sha256:e92afc8eb95e8df2ef4aa34749cda188fcee9aad207e0bd0b4b2351cc4ddf3f2","observation_id":"1b70cc15-f9fc-40f1-864b-0fc5c61e68b4","resolution":{"observed_at":"2026-05-16T23:48:41.851547Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2604.05872","last_updated":"2026-04-07T13:29:34Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T13:29:34Z","title":"Swiss-Bench 003: Evaluating LLM Reliability and Adversarial Security for Swiss Regulatory Contexts","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T19:44:26.931344Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2604.05872"},"observation_digest":"sha256:cf425db2f20d0b3f88019c593f527658899a6d680d1e2bc324fb767f6fda6f2b","observation_id":"a00801a1-c0c0-4373-9b48-aa540bf3dae9","resolution":{"observed_at":"2026-05-10T22:35:48.805002Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2604.21571","last_updated":"2026-04-23T11:51:31Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T11:51:31Z","title":"Separable Expert Architecture: Toward Privacy-Preserving LLM Personalization via Composable Adapters and Deletable User Proxies","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-09T22:26:34.487400Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2604.21571"},"observation_digest":"sha256:66cc2d01a84d02108b901a50307bab778badc86edbb82823f97393644ea8c2f1","observation_id":"6dc63095-16dc-4a9c-bda3-7ae3027a0fea","resolution":{"observed_at":"2026-05-09T22:34:07.373969Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2604.23338","last_updated":"2026-05-06T17:17:02Z","snapshot_observed_at":"2026-08-06T19:46:39.219000Z","submitted_at":"2026-04-25T14:57:15Z","title":"A Systematic Survey of Security Threats and Defenses in LLM-Based AI Agents: A Layered Attack Surface Framework","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-08T07:53:13.746141Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2604.23338"},"observation_digest":"sha256:e70877b69a3425b08f662ba2c355d989744928555f2bbebedd4c8e22b52b2c75","observation_id":"5b4fee91-8675-4ad1-9c0a-12203b86194f","resolution":{"observed_at":"2026-05-11T20:51:09.389604Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2604.25200","last_updated":"2026-04-28T04:10:04Z","snapshot_observed_at":"2026-07-06T23:11:07.254460Z","submitted_at":"2026-04-28T04:10:04Z","title":"Making AI-Assisted Grant Evaluation Auditable without Exposing the Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-07T16:12:20.534893Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2604.25200"},"observation_digest":"sha256:ff0af8da14b1195d6036f9c117b835b9f1bdb12563a2eb2c53de6991f8e4b07d","observation_id":"89517f86-bac3-429d-b231-14029185edba","resolution":{"observed_at":"2026-05-11T23:51:17.879632Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2605.06865","last_updated":"2026-05-07T19:06:35Z","snapshot_observed_at":"2026-07-06T23:19:15.382283Z","submitted_at":"2026-05-07T19:06:35Z","title":"Dataset Watermarking for Closed LLMs with Provable Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-11T00:53:42.185498Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2605.06865"},"observation_digest":"sha256:4858a7a6c1fc76e43a4b27ede5ac01b2694b4621c588b558d7387ac5a9c6d842","observation_id":"4f74794c-9c4d-4e90-b0d3-ef5718da6854","resolution":{"observed_at":"2026-05-11T05:00:57.288375Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2605.22786","last_updated":"2026-05-21T17:42:12Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:42:12Z","title":"LCGuard: Latent Communication Guard for Safe KV Sharing in Multi-Agent Systems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T04:58:37.780195Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2605.22786"},"observation_digest":"sha256:df5f901f4bdf69999610487f2423b297da8c616eeb9cf3b9efb32a7f5a78f2c1","observation_id":"57b34014-a152-497f-914f-558789c1199b","resolution":{"observed_at":"2026-05-22T05:01:05.960115Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2605.25902","last_updated":"2026-06-02T12:10:15Z","snapshot_observed_at":"2026-08-06T08:37:43.958488Z","submitted_at":"2026-05-25T14:29:36Z","title":"Reading the Finetuning Prior: Verbatim Content Recovery via Contrastive Decoding Diffing","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-29T22:37:02.708284Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2605.25902"},"observation_digest":"sha256:ebf330aeb998fcdd34f7ca041f6f31a388ad8d5fae894893a802c037b1d08446","observation_id":"f9fbb4f0-4061-4a72-9d45-69a78e5d0c7e","resolution":{"observed_at":"2026-06-29T22:44:01.664060Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2605.27825","last_updated":"2026-05-27T01:31:40Z","snapshot_observed_at":"2026-08-02T19:56:32.199762Z","submitted_at":"2026-05-27T01:31:40Z","title":"MRMMIA: Membership Inference Attacks on Memory in Chat Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T12:04:53.511344Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2605.27825"},"observation_digest":"sha256:81f18040f1c5ccf2e0120f0c4b30990e881ff7f16c018fb1b76b5ada89350494","observation_id":"40c45581-7f6a-4603-a973-ad6231aaf9b3","resolution":{"observed_at":"2026-06-29T12:13:27.072292Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.02822","last_updated":"2026-06-01T19:39:25Z","snapshot_observed_at":"2026-07-06T23:43:07.940839Z","submitted_at":"2026-06-01T19:39:25Z","title":"Which Defense Closes Which Threat? Attributing OWASP-LLM-Top-10 Coverage and Its Brittleness Under Paraphrasing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T13:49:47.542697Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.02822"},"observation_digest":"sha256:071164e020172deec5ec6bea78fed8636429743ac5e757135c48a3aa6cd3535d","observation_id":"d64b9315-cf10-4cbb-b788-e426d461e0a9","resolution":{"observed_at":"2026-07-01T23:56:23.234607Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.05936","last_updated":"2026-06-04T09:38:55Z","snapshot_observed_at":"2026-07-06T23:45:51.910263Z","submitted_at":"2026-06-04T09:38:55Z","title":"Epistemic Injustice in Language Models: An Audit of Pretraining Filters and Guardrails","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T02:06:31.341519Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.05936"},"observation_digest":"sha256:47857e63bf2eb69a2bdc74aafac01346e2e06fbd7d910a76c33c20f9d4c34663","observation_id":"1468ffd0-0d5b-4fbc-8846-251fc95b7cbf","resolution":{"observed_at":"2026-07-02T12:26:57.057543Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.06286","last_updated":"2026-06-04T15:25:24Z","snapshot_observed_at":"2026-08-05T07:06:45.210601Z","submitted_at":"2026-06-04T15:25:24Z","title":"LLMs Can Leak Training Data But Do They Want To? A Propensity-Aware Evaluation of Memorization in LLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-28T01:40:53.284131Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.06286"},"observation_digest":"sha256:5d160f6a9148a57286302b1927da89bcd37691b8e1a06c15a0c04714b98226d2","observation_id":"80ad5aa8-0703-40ed-8ccb-81d3bd7d3de1","resolution":{"observed_at":"2026-07-02T12:56:57.468052Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.07996","last_updated":"2026-06-06T06:27:54Z","snapshot_observed_at":"2026-07-31T22:22:12.944552Z","submitted_at":"2026-06-06T06:27:54Z","title":"MC-PDD: Masked Corpus-Level Pretraining Data Detection for Black-Box Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:50.169589Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.07996"},"observation_digest":"sha256:33ee5359c50fda83ab590ebfa5296b92c6a034329d4d91d276e7efc7784edeec","observation_id":"f30c694f-27ce-46d4-9fc0-2cd79110ae11","resolution":{"observed_at":"2026-07-02T20:57:23.357949Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.09038","last_updated":"2026-06-08T05:10:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-08T05:10:05Z","title":"Personalization Meets Safety:Mechanisms,Risks,and Mitigations in Personalized LLMs","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-06-27T16:49:14.243931Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.09038"},"observation_digest":"sha256:75736c6cc813ff7b57b71891c94dfbe9b85cee89ec1d2ad4979184a2f93873cc","observation_id":"b6dac66e-c769-457e-8edf-e64ccde2034f","resolution":{"observed_at":"2026-07-03T01:07:30.231259Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.09844","last_updated":"2026-04-26T18:38:46Z","snapshot_observed_at":"2026-07-06T23:49:08.412079Z","submitted_at":"2026-04-26T18:38:46Z","title":"The Interlocutor Effect: Why LLMs Leak More Personal Data to Agents Than Humans","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-01T09:00:23.558245Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.09844"},"observation_digest":"sha256:0aa677fa21c729358bbc0c2dc0e59c483b21a76aa38cd9fbb8a61ef9d76b61da","observation_id":"e2d36494-b0a8-4b0d-8507-d9c8ae0a36cb","resolution":{"observed_at":"2026-07-01T09:05:36.687299Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.12341","last_updated":"2026-06-10T17:13:35Z","snapshot_observed_at":"2026-07-06T23:51:17.719874Z","submitted_at":"2026-06-10T17:13:35Z","title":"OCELOT: Inference-Leakage Budgets for Privacy-Preserving LLM Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T09:11:42.204778Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.12341"},"observation_digest":"sha256:3ecd2cbc55395032aeff16391a3e8d80805ae334534386ed24b16d5a350a79c1","observation_id":"48cfd250-1281-4f89-a3b2-72bd4189fdcf","resolution":{"observed_at":"2026-07-03T11:58:06.926713Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.17168","last_updated":"2026-06-20T10:01:32Z","snapshot_observed_at":"2026-08-08T12:13:21.907844Z","submitted_at":"2026-06-15T18:06:59Z","title":"RepSelect: Robust LLM Unlearning via Representation Selectivity","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-27T03:34:32.388152Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.17168"},"observation_digest":"sha256:e2487924076105a11708333b52f4a7149b7cf4a115d8bb9fab5d2294c7a522cd","observation_id":"fb4f126f-1954-4a98-80d7-4e31d24dede2","resolution":{"observed_at":"2026-07-03T17:58:47.182482Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.23276","last_updated":"2026-06-24T01:41:10Z","snapshot_observed_at":"2026-08-03T00:58:42.253085Z","submitted_at":"2026-06-22T12:53:54Z","title":"Exposing the Illusion of Erasure in Knowledge Editing for LLMs","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T09:10:39.422141Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.23276"},"observation_digest":"sha256:54c8eafec345afbc75a7724505692ead54c111ebb0e42e44fcdea463007a7526","observation_id":"99fef884-5b0d-4d97-9e02-13ed9e2c4cf6","resolution":{"observed_at":"2026-07-04T10:09:44.276219Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.26627","last_updated":"2026-06-25T05:44:18Z","snapshot_observed_at":"2026-08-02T09:36:56.612724Z","submitted_at":"2026-06-25T05:44:18Z","title":"Agents That Know Too Much: A Data-Centric Survey of Privacy in LLM Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T04:29:16.386339Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.26627"},"observation_digest":"sha256:2211d4c1a2f5a719b0eb0b9ec21bfab5020df27fc16e38b1c228cc2bf9a9b70b","observation_id":"ec1a872e-ec30-4beb-b1a3-9eb6d7dd83c7","resolution":{"observed_at":"2026-07-04T14:09:53.281660Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2607.00527","last_updated":"2026-07-03T14:06:15Z","snapshot_observed_at":"2026-07-12T09:30:07.403501Z","submitted_at":"2026-07-01T07:16:11Z","title":"AI Native Games: A Survey and Roadmap","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-07-02T12:59:20.908659Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2607.00527"},"observation_digest":"sha256:a6068585106644a0800c2e474974211d66cc7fa59908ddb47238a66725fd53b9","observation_id":"ffdbb1a8-433a-472a-900d-5d4097d0fa7d","resolution":{"observed_at":"2026-07-02T13:06:58.758903Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-07-12T09:30:07.729486Z","title":"Available: https://arxiv.org/abs/2012.07805","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.00527","last_updated":"2026-07-03T14:06:15Z","snapshot_observed_at":"2026-07-12T09:30:07.403501Z","submitted_at":"2026-07-01T07:16:11Z","title":"AI Native Games: A Survey and Roadmap","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-07-12T09:30:07.729486Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2607.00527"},"observation_digest":"sha256:f0035c4ab8141986f2dfb2ab0e24eaba1e9b2cc255b25d734e7ab9ead58db7d4","observation_id":"4d8c8d02-19f8-4a42-88a7-cde6e538eab4","resolution":{"observed_at":"2026-07-12T09:30:07.729486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2607.00605","last_updated":"2026-07-01T08:30:28Z","snapshot_observed_at":"2026-08-01T23:01:34.713435Z","submitted_at":"2026-07-01T08:30:28Z","title":"Auditing Forgetting in Limited Memory Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-02T13:09:34.491580Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2607.00605"},"observation_digest":"sha256:858ed07b55bcc1ba2fde356134c4fbfa8017e86cf806e6cdc47abfa25d3e890a","observation_id":"41d6405e-1aa9-43f1-8a6a-e244df868e0e","resolution":{"observed_at":"2026-07-02T13:16:58.312170Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-01T14:11:43.482286Z","title":"Nicholas Carlini, Steve Chien, Milad Nasr, Shuang Song, Andreas Terzis, and Florian Tramer","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.19442","last_updated":"2026-07-21T08:59:54Z","snapshot_observed_at":"2026-08-07T14:23:11.137618Z","submitted_at":"2026-07-21T08:59:54Z","title":"Unlearning as Distribution Restoration: A Controlled Counterfactual Study, a Validated Selective Screen, and the Limits of Oracle-Free Certification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T14:11:43.482286Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2607.19442"},"observation_digest":"sha256:0e3d1442fada4fd3c278a3a1c6bf02ee5a9c699b7a62bb9dfa0315c21088509f","observation_id":"724b7aaa-782d-4928-b56a-e74cdf712e32","resolution":{"observed_at":"2026-08-01T14:11:43.482286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-07-31T23:33:49.808882Z","title":"arXiv preprint arXiv:2012.07805 , year=","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.23934","last_updated":"2026-07-27T02:11:58Z","snapshot_observed_at":"2026-08-07T14:21:47.373100Z","submitted_at":"2026-07-27T02:11:58Z","title":"DECAF: De-Clustering for Adaptive Representational Unlearning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-31T23:33:49.808882Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2607.23934"},"observation_digest":"sha256:21f9f90ea1f7f5dc85a5ec6d5f630e98de99759ad94330ef8bf5e493cc0db2a7","observation_id":"9c1c3df4-b145-41bb-a08f-62af760ed21c","resolution":{"observed_at":"2026-07-31T23:33:49.808882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-01T02:28:36.726398Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.25451","last_updated":"2026-07-28T08:41:31Z","snapshot_observed_at":"2026-08-08T06:37:42.685863Z","submitted_at":"2026-07-28T08:41:31Z","title":"Bits and Memories: Measuring Verbatim Extraction Across LLM Quantization","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T02:28:36.726398Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2607.25451"},"observation_digest":"sha256:4b17e8d5e24c51fc8747d52bafdc5f8c219c099e0ac016ccf618a68fe4e19067","observation_id":"c08c5f00-e512-4bec-91e8-c1bbee4adaf8","resolution":{"observed_at":"2026-08-01T02:28:36.726398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2012.07805/citation-record","integrity":"/paper/2012.07805/integrity","json":"/paper/2012.07805/citation-record.json","paper":"/paper/2012.07805"},"outbound":[],"paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","latest_version":2,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 51 inbound Pith citation observations for arXiv:2012.07805."}