{"as_of":"2026-08-20T08:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a0620e607a20a3bdb1de718047277288c2ad00ee026f74871a9a650d9f155431","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:15:21.466217Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.16414/citation-record","integrity":"/paper/2507.16414/integrity","json":"/paper/2507.16414/citation-record.json","paper":"/paper/2507.16414"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:17.084177Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.084177Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:33fa59dda195a6609231a02d19d3cd837c3520f2c1eaa7fc80f1a2c1b17bade5","observation_id":"8144160a-2914-48fc-a7d9-2e7d8b3cd0e8","resolution":{"observed_at":"2026-08-06T15:15:17.084177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:17.138656Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.138656Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:f3b458d42368b15ce436846d733086f0befcae12ff2cd4eb810f6f5a94bc6258","observation_id":"c87933e2-06b5-4f30-bf97-4cb3d7dcf7c5","resolution":{"observed_at":"2026-08-06T15:15:17.138656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.886133Z","title":null,"venue":null,"work_id":"9d3f06ef-35c0-4b7b-a8f7-9d113b7a53f4","year":2016},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.199733Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:13098f56fc8ffe2fb92bb2c3172ba5e711921a3485ac83df4f6433ee547ae465","observation_id":"6f4c17df-c22f-4417-aa20-d332fd73fce5","resolution":{"observed_at":"2026-08-06T15:15:22.901254Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T15:15:17.287649Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.287649Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:559558f45d11e4910dfe9d14b912a007c636a606111d6e75c78be301557c2860","observation_id":"fbb54b05-598a-4ebd-ad6c-1000b9ed04a8","resolution":{"observed_at":"2026-08-06T15:15:17.287649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-06T15:15:17.373299Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.373299Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:c89376d19159286a3b61f5156c0bf276bf25c68dab68b53ff9ac454d484f3888","observation_id":"1135129c-f8a5-4c67-8fbf-9907836dd7fa","resolution":{"observed_at":"2026-08-06T15:15:17.373299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:17.447239Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.447239Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:117db2ae6184b7e05884abec1ac1b01b8e17b81cc631ffb531a105988e683a74","observation_id":"eab82540-ef32-4634-beeb-25ecd1037d10","resolution":{"observed_at":"2026-08-06T15:15:17.447239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.849149Z","title":null,"venue":null,"work_id":"980d5123-0725-4bf5-99e2-e8e97ac2201d","year":2021},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.545600Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:7d02c94b0f4c294a0b503b98d235aa5acf5db5fadfc6b7a86d8333573d7db338","observation_id":"b94792c4-3610-4758-838f-57fb799a7471","resolution":{"observed_at":"2026-08-06T15:15:22.853804Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:17.610114Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.610114Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:7d3750cb59d739395d357b0ef4b264ff3d2c79c4dee22faf6f6f0b5565621a51","observation_id":"37117ec8-c6e8-4eb6-a31c-267e0d3b1666","resolution":{"observed_at":"2026-08-06T15:15:17.610114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.811556Z","title":null,"venue":null,"work_id":"99205a4d-3c97-4bb8-b965-54efe01be0cc","year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.682374Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:2273a9b3a547981e55292dffbc740a504d1fe396a4d0153140ca32934812abbd","observation_id":"1481e8fd-88f5-464b-b5c5-1a3ffb6a0701","resolution":{"observed_at":"2026-08-06T15:15:22.817152Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.00118","last_updated":"2023-10-20T21:23:21Z","snapshot_observed_at":"2026-08-19T11:33:04.678525Z","submitted_at":"2023-04-28T22:35:03Z","title":"Speak, Memory: An Archaeology of Books Known to ChatGPT/GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.00118","snapshot_observed_at":"2026-08-06T15:15:17.773210Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.773210Z"},"links":{"cited_paper":"/paper/2305.00118","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:82966bb6d5f3644ba014a6e1e492441e76a16774da1ed6cab9d7b50e83819129","observation_id":"025d5f51-e5a6-4821-b71c-50fdb4c62278","resolution":{"observed_at":"2026-08-06T15:15:17.773210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.792742Z","title":null,"venue":null,"work_id":"65a0d866-ab4a-4321-9eff-c68f67215756","year":2020},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.853493Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:a202e20bee18917d07340acc98538ffcbd43b9efd6de8a81564049ecd797a002","observation_id":"5faa0212-ee17-4295-a32f-756285f56ba1","resolution":{"observed_at":"2026-08-06T15:15:22.798133Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.772290Z","title":null,"venue":null,"work_id":"18710bd6-6b2a-431c-82dc-ec645604c019","year":2021},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.924884Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:bb5ec54ada412093b917eca71497733697d1f899df6f068dd55f4e0dda8ab9b6","observation_id":"987e16f8-f7e8-4ec2-be42-2cae58252370","resolution":{"observed_at":"2026-08-06T15:15:22.779455Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05335","last_updated":"2023-04-11T16:53:54Z","snapshot_observed_at":"2026-08-16T15:41:14.308965Z","submitted_at":"2023-04-11T16:53:54Z","title":"Toxicity in ChatGPT: Analyzing Persona-assigned Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05335","snapshot_observed_at":"2026-08-06T15:15:17.984754Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.984754Z"},"links":{"cited_paper":"/paper/2304.05335","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:339aa350856d96e7d56b9f1f0c0a70d29b01e8600cc5a5500872aaa50f5e616c","observation_id":"d0a38afe-6aa1-4af0-86c3-74970dcba164","resolution":{"observed_at":"2026-08-06T15:15:17.984754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:18.045952Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:18.045952Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:a8572a7cc4b43e2d08ecc3c7ac26690d4e0f215dc64e3459074dbf96ff0818f0","observation_id":"76911d89-6aab-483a-b405-bddcb24fdd25","resolution":{"observed_at":"2026-08-06T15:15:18.045952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07841","last_updated":"2024-09-16T13:18:23Z","snapshot_observed_at":"2026-08-16T14:19:15.347006Z","submitted_at":"2024-02-12T17:52:05Z","title":"Do Membership Inference Attacks Work on Large Language Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07841","snapshot_observed_at":"2026-08-06T15:15:18.142763Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:18.142763Z"},"links":{"cited_paper":"/paper/2402.07841","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:3f899a984bf2274e892215e1f32562e08037a96a3b9dabd2a2b3f530c0f9f637","observation_id":"40fd2cbc-f0cf-464c-afea-9b1f38bfd8ba","resolution":{"observed_at":"2026-08-06T15:15:18.142763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.727191Z","title":null,"venue":null,"work_id":"61aa2440-88d5-4fd5-b31f-701e00a548c8","year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:18.252796Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:3495903e9a0e0136f39a0646dbe2b3d02051e9725eb08365e095cd4658407d2c","observation_id":"395913aa-cc76-442d-b2df-617c841b8709","resolution":{"observed_at":"2026-08-06T15:15:22.733774Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09910","last_updated":"2024-06-25T10:33:41Z","snapshot_observed_at":"2026-08-18T17:44:34.424107Z","submitted_at":"2024-02-15T12:17:15Z","title":"DE-COP: Detecting Copyrighted Content in Language Models Training Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09910","snapshot_observed_at":"2026-08-06T15:15:18.313771Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:18.313771Z"},"links":{"cited_paper":"/paper/2402.09910","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:9615fa58b1a47d70e37345fb0188a3c597ea51b44333b61c350f192c237dadcb","observation_id":"d7c1395e-899e-4af7-9412-f6c2b33f51fb","resolution":{"observed_at":"2026-08-06T15:15:18.313771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03738","last_updated":"2023-11-13T17:50:22Z","snapshot_observed_at":"2026-08-19T00:13:01.523553Z","submitted_at":"2023-04-07T17:14:00Z","title":"Should ChatGPT be Biased? Challenges and Risks of Bias in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03738","snapshot_observed_at":"2026-08-06T15:15:18.466696Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:18.466696Z"},"links":{"cited_paper":"/paper/2304.03738","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:4ead59d1e86cf82ef4058a14f4e841d09e0921e57353161d69d67c030c94712c","observation_id":"bc02a5e6-873b-464e-bc47-27d0e7a17e36","resolution":{"observed_at":"2026-08-06T15:15:18.466696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-06T15:15:18.651918Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:18.651918Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:cb5ccc92bdc77af8ed6dfc359e480f8dad28759b35a72614e851d57eb07ccaae","observation_id":"692c2af9-c2a7-4706-9c96-3f5dca66df41","resolution":{"observed_at":"2026-08-06T15:15:18.651918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11462","last_updated":"2020-09-25T20:22:26Z","snapshot_observed_at":"2026-08-18T05:13:24.803705Z","submitted_at":"2020-09-24T03:17:19Z","title":"RealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.11462","snapshot_observed_at":"2026-08-06T15:15:18.772021Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:18.772021Z"},"links":{"cited_paper":"/paper/2009.11462","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:a821eb853ed8aff72f72237160064473555642db647e05244f348cd4f7d37230","observation_id":"2af41a3d-b36d-4aa4-9a50-7cacef7c2023","resolution":{"observed_at":"2026-08-06T15:15:18.772021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.701211Z","title":null,"venue":null,"work_id":"d690a664-b21e-4437-aa97-48e95e2138a9","year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:18.863401Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:1781b6cff2965658a92bb6032b3aca1036ad8a765533e4f3531d2f27832e7acc","observation_id":"8651eff8-19a0-4d8f-bde4-0e1396b0e912","resolution":{"observed_at":"2026-08-06T15:15:22.708309Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:19.010658Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:19.010658Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:9cb4582bfd8430ee176ac43b929b09db8e2f1ebabdc1910eca898b23feaad8ed","observation_id":"f0f231f3-d5ae-467e-bdfe-2cc316b417f9","resolution":{"observed_at":"2026-08-06T15:15:19.010658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.678004Z","title":null,"venue":null,"work_id":"ecb807ce-6b43-4654-a6eb-115f167bf1ca","year":2008},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:19.109984Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:853a4de9824c924c823214e648cca14e466b38e558d1a9de61015be0071d13e3","observation_id":"4874d50f-37e0-4d0b-9d45-d446bf0b1a3b","resolution":{"observed_at":"2026-08-06T15:15:22.685604Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.658082Z","title":null,"venue":null,"work_id":"fcda4645-3953-4532-a8d8-78e850db4b03","year":2022},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:19.278980Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:d91fa9dd5e22c7f347e5abc68a23f61b7b7bb2049bfda6c43d99439144570377","observation_id":"781c780b-f77e-4b81-bcc7-4369180cf863","resolution":{"observed_at":"2026-08-06T15:15:22.663814Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.634232Z","title":null,"venue":null,"work_id":"ae7ff80c-f98f-4495-bb38-0847b2c00923","year":2019},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:19.407680Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:c6bec24671ec29a4534fd792036d6a27a049c289eae0a2dc97df2a3ccc5821b8","observation_id":"29b9541b-1985-471d-8136-cec0e4a67d46","resolution":{"observed_at":"2026-08-06T15:15:22.640112Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-06T15:15:19.553442Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:19.553442Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:22673bcbe95028d232b5f13da6b0fdc69a58d3a6309a9c438729c251a636c881","observation_id":"3f449154-a1c9-4add-86fc-362537ba6154","resolution":{"observed_at":"2026-08-06T15:15:19.553442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:19.713705Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:19.713705Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:b694c0c09e80df176888195c31c3bbf36ab1d4136d67d4478e9c2a51a7d56226","observation_id":"b3614382-b290-4911-96bc-be4357897221","resolution":{"observed_at":"2026-08-06T15:15:19.713705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:19.864453Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:19.864453Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:d62809ec3a4440aae1727e867660e085aba94e66ef87a3e5711557d7365fa866","observation_id":"139f2341-6de8-461f-90fd-aec325a98e46","resolution":{"observed_at":"2026-08-06T15:15:19.864453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.596175Z","title":null,"venue":null,"work_id":"d1b6bc16-f98b-4a11-8d8e-695080992abd","year":2021},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:20.019031Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:6fb326d9a134cc614885a21a203be568feef93ec9f50ada4303fc762c5c8d7f8","observation_id":"b738dd76-661e-46b2-995a-8d9b1fa54e26","resolution":{"observed_at":"2026-08-06T15:15:22.603324Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-18T15:24:37.105582Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-06T15:15:20.119238Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:20.119238Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:518a3cae3955e02cfdc8d41a6fcd5c6ee771540f8bba3e0fae231053fdf428ca","observation_id":"6dd825a6-8241-4e40-9fc7-d789cffa74ad","resolution":{"observed_at":"2026-08-06T15:15:20.119238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18041","last_updated":"2024-02-28T04:35:51Z","snapshot_observed_at":"2026-08-16T14:14:41.005231Z","submitted_at":"2024-02-28T04:35:51Z","title":"Datasets for Large Language Models: A Comprehensive Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18041","snapshot_observed_at":"2026-08-06T15:15:20.243366Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:20.243366Z"},"links":{"cited_paper":"/paper/2402.18041","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:33a84a92182199e6df888173a506b8bec51599b1d8250e46cb871fb5e41717b0","observation_id":"ad3912c7-80c3-47f6-90b1-1d3898063494","resolution":{"observed_at":"2026-08-06T15:15:20.243366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.573573Z","title":null,"venue":null,"work_id":"ca02613d-7e80-4a79-a30e-0d9f96d6d999","year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:20.388002Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:0dbca7f704516a9a802491a6db04a91fef4d4f7d636c72ebdffc43288085bab8","observation_id":"c0305eca-9b7c-4de4-87fe-14710a4ff3f4","resolution":{"observed_at":"2026-08-06T15:15:22.581279Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.544939Z","title":null,"venue":null,"work_id":"6184b994-b427-48f8-a90b-1530a799541e","year":2022},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:20.543238Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:3660a13ca7f284d44960b012972d19e5499a3476be6e0dc4747d2b69aae127ad","observation_id":"baff0da6-c466-49e9-98f9-5e6e90c3dc74","resolution":{"observed_at":"2026-08-06T15:15:22.554674Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.519610Z","title":null,"venue":null,"work_id":"c36ce04c-3d72-46e7-a15c-9de00e4e838d","year":2025},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:20.640744Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:baa95d836257cfcb8923e079afa7258e83c4dea5c2d620c9deca39a99355fd70","observation_id":"8dd09ae9-d9d2-4bc6-94e7-98c67cad3591","resolution":{"observed_at":"2026-08-06T15:15:22.525642Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18462","last_updated":"2023-08-07T06:32:56Z","snapshot_observed_at":"2026-08-18T17:46:17.118167Z","submitted_at":"2023-05-29T07:06:03Z","title":"Membership Inference Attacks against Language Models via Neighbourhood Comparison","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18462","snapshot_observed_at":"2026-08-06T15:15:20.774106Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:20.774106Z"},"links":{"cited_paper":"/paper/2305.18462","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:2002fe7040db8beb0f2eb4323cb4e41e30847754421e56ca0643ab8556016d87","observation_id":"23c460cb-3729-4bac-8d8a-5b6c16654f02","resolution":{"observed_at":"2026-08-06T15:15:20.774106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.495016Z","title":null,"venue":null,"work_id":"75cd88cc-7212-4c09-af20-a71d074f4bb2","year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:20.928493Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:31337d6c39effa395e1f7fcc4ed4f6d79fde859a6744c16c7ef9ec7f935addb6","observation_id":"cad612e0-a611-4f7e-9e32-3f25ffb9f4e2","resolution":{"observed_at":"2026-08-06T15:15:22.502090Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03929","last_updated":"2022-11-04T02:47:37Z","snapshot_observed_at":"2026-08-16T17:16:13.720022Z","submitted_at":"2022-03-08T08:50:34Z","title":"Quantifying Privacy Risks of Masked Language Models Using Membership Inference Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.03929","snapshot_observed_at":"2026-08-06T15:15:21.088346Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.088346Z"},"links":{"cited_paper":"/paper/2203.03929","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:787bbf0a276582409314396f978564b29eb25fce7d027c3863700f75664b2703","observation_id":"48a1f3ee-32bc-4984-b236-b03b208ae675","resolution":{"observed_at":"2026-08-06T15:15:21.088346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.460620Z","title":null,"venue":null,"work_id":"28176263-fc10-4512-b2a8-892a5dbf1463","year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.210084Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:c9df25d349a0e80bf920804757c9bbd869490ed99e9f4a69c9afe4b8a8caf0b0","observation_id":"08dba54b-6ee3-43c8-9d51-d4b1c33d78a7","resolution":{"observed_at":"2026-08-06T15:15:22.467285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12833","last_updated":"2023-08-24T14:45:50Z","snapshot_observed_at":"2026-08-17T15:44:15.419588Z","submitted_at":"2023-08-24T14:45:50Z","title":"Use of LLMs for Illicit Purposes: Threats, Prevention Measures, and Vulnerabilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12833","snapshot_observed_at":"2026-08-06T15:15:21.317329Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.317329Z"},"links":{"cited_paper":"/paper/2308.12833","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:0cfd3c99bb930893a949b5beb5c41ff11afa0f6dd5c97b0038c9a3ec7b65afe2","observation_id":"7587ae3b-1737-4ace-ae01-7df9eb24a1e6","resolution":{"observed_at":"2026-08-06T15:15:21.317329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17035","last_updated":"2023-11-28T18:47:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T18:47:03Z","title":"Scalable Extraction of Training Data from (Production) Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17035","snapshot_observed_at":"2026-08-06T15:15:21.323446Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.323446Z"},"links":{"cited_paper":"/paper/2311.17035","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:06921c8194067d06c3675bb918b01583a269a63fd9b268d03ab69f3c9b6db027","observation_id":"8d63d4f0-abe0-4ea2-8fc1-97a8109754db","resolution":{"observed_at":"2026-08-06T15:15:21.323446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.435665Z","title":null,"venue":null,"work_id":"a777845c-a258-473b-832f-f215f1165470","year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.328780Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:e8b4ced090c721ad667981280450fcb8312a8ee054e41cbc0403cc1c0fbd0b11","observation_id":"15bdd3fb-174d-432b-b0a1-776c63e982c9","resolution":{"observed_at":"2026-08-06T15:15:22.443203Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.412048Z","title":null,"venue":null,"work_id":"1d5a757f-d5cc-449a-ad16-88b6e62bfac7","year":2020},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.334535Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:3c780b6e2327e7e3c0c766ed16deab35a54b68560a126d2df72b83099a123f8d","observation_id":"d89d0385-fad5-4282-ad54-00aa53f94bd9","resolution":{"observed_at":"2026-08-06T15:15:22.420533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.06145","last_updated":"2017-11-29T11:47:25Z","snapshot_observed_at":"2026-08-14T20:40:18.972494Z","submitted_at":"2017-08-21T10:50:24Z","title":"Knock Knock, Who's There? Membership Inference on Aggregate Location Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.06145","snapshot_observed_at":"2026-08-06T15:15:21.342344Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.342344Z"},"links":{"cited_paper":"/paper/1708.06145","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:b4bbbebc9e30f59ed3adecec8f1db8c54123bb2ad9abe121d383c7476abf3c13","observation_id":"fd0302b5-eff2-46e5-b927-9088ed65d887","resolution":{"observed_at":"2026-08-06T15:15:21.342344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.388727Z","title":null,"venue":null,"work_id":"903b4c76-03fd-469e-a061-37bc963702ad","year":2019},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.350065Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:75127317a0d6cb5039aa6d97504bc61c91a260a0044ac5f014c874043b4c383c","observation_id":"7ecb1209-9b63-42a9-b3b6-fe5c38f80e9f","resolution":{"observed_at":"2026-08-06T15:15:22.395410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.01246","last_updated":"2018-12-14T19:39:43Z","snapshot_observed_at":"2026-08-17T05:42:15.030047Z","submitted_at":"2018-06-04T17:38:42Z","title":"ML-Leaks: Model and Data Independent Membership Inference Attacks and Defenses on Machine Learning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.01246","snapshot_observed_at":"2026-08-06T15:15:21.355346Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.355346Z"},"links":{"cited_paper":"/paper/1806.01246","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:8ee17890b92deeda05bb88bbc73ced57554bcfa553a5f2480f1ad0b416ebec93","observation_id":"0dcaf560-7be9-4129-b7ab-e3ef41fe4b1f","resolution":{"observed_at":"2026-08-06T15:15:21.355346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16789","last_updated":"2024-03-09T22:26:06Z","snapshot_observed_at":"2026-08-08T18:07:29.632928Z","submitted_at":"2023-10-25T17:21:23Z","title":"Detecting Pretraining Data from Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16789","snapshot_observed_at":"2026-08-06T15:15:21.359622Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.359622Z"},"links":{"cited_paper":"/paper/2310.16789","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:bf501fb86187edbc31db2b33990a328e3b1208923cfa0061d0bba92377b97eb2","observation_id":"941a7ee8-a499-4769-a8e8-35812a52994f","resolution":{"observed_at":"2026-08-06T15:15:21.359622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.371699Z","title":null,"venue":null,"work_id":"6c125ea8-7245-4322-a4bc-3da15cc7245e","year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.364917Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:8d22b171e26d145fcde0f33b478d75c56bc6594357657e154860eeec648d11a5","observation_id":"81b06794-b492-495e-9d06-c06d4e28da54","resolution":{"observed_at":"2026-08-06T15:15:22.376821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.353519Z","title":null,"venue":null,"work_id":"74987a44-f607-4f89-8720-045d05b2d819","year":2017},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.371003Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:96103cac1f7fd83c8a9643ec46087f6d5427c122aa46459d96171b30acc2997b","observation_id":"83ea9fa1-8233-4ae4-b98f-381d1aa2ef77","resolution":{"observed_at":"2026-08-06T15:15:22.359031Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.331581Z","title":"o rg Tiedemann, Mikko Aulamo, Daria Bakshandaeva, Michele Boggia, Stig-Arne Gr \\","venue":null,"work_id":"a158bc53-756f-4fbb-a303-14b761f55293","year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.376328Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:924eb5e826a69683a01ac2f62fb4af1ce08dae65f0d33e4608a4d5fb99275565","observation_id":"15477c2e-63db-41a7-bacc-54e161ec2a59","resolution":{"observed_at":"2026-08-06T15:15:22.337142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:21.381344Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.381344Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:990ab7b087e5511bd5a52e6613c14e1491b419ea3d538be327df9b8f03671fef","observation_id":"5f59f0fe-b27d-4939-afed-c38db0274ce0","resolution":{"observed_at":"2026-08-06T15:15:21.381344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10969","last_updated":"2024-07-24T14:57:48Z","snapshot_observed_at":"2026-08-18T15:21:23.766359Z","submitted_at":"2024-07-15T17:59:29Z","title":"Q-Sparse: All Large Language Models can be Fully Sparsely-Activated","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10969","snapshot_observed_at":"2026-08-06T15:15:21.387745Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.387745Z"},"links":{"cited_paper":"/paper/2407.10969","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:299e287500eafa16b3e4d98dac3937fd5f3b27dae0cfabad6626930981b7d10d","observation_id":"d48a10fb-c0ee-4a3d-8ee3-d0842025ec77","resolution":{"observed_at":"2026-08-06T15:15:21.387745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.08440","last_updated":"2022-04-11T09:23:43Z","snapshot_observed_at":"2026-08-18T20:02:37.684810Z","submitted_at":"2021-11-15T12:32:20Z","title":"On the Importance of Difficulty Calibration in Membership Inference Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.08440","snapshot_observed_at":"2026-08-06T15:15:21.392711Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.392711Z"},"links":{"cited_paper":"/paper/2111.08440","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:90b95babd7219fbb9638caca719098c089ee6dd66972db1ac45bd45aa2769ea9","observation_id":"c6fc312a-8422-42c6-8614-90c873970e16","resolution":{"observed_at":"2026-08-06T15:15:21.392711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04244","last_updated":"2024-06-06T16:41:39Z","snapshot_observed_at":"2026-08-17T14:15:23.870937Z","submitted_at":"2024-06-06T16:41:39Z","title":"Benchmark Data Contamination of Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04244","snapshot_observed_at":"2026-08-06T15:15:21.400435Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.400435Z"},"links":{"cited_paper":"/paper/2406.04244","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:5e52fd1a1573dc2d57eaea070ff84fb23d405f08590616f1613586352eb840c8","observation_id":"54687662-3ac0-4b9a-af5e-f2e9e59178b6","resolution":{"observed_at":"2026-08-06T15:15:21.400435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.295679Z","title":null,"venue":null,"work_id":"5089a8a3-0ebc-41ab-b62c-edfc75b03ffc","year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.405660Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:363e318770e75f4cb7337134861194296e091674bfb81fc67e25aa007791c76f","observation_id":"ec7c574a-b0ab-41a7-8dad-170a87bfaf48","resolution":{"observed_at":"2026-08-06T15:15:22.301790Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.276197Z","title":null,"venue":null,"work_id":"b13813e1-bd11-428d-8e09-4a790d5af1b9","year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.411144Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:4bbb53a663e6d95c0bb729caabf7e67a8d1bd07a90d1c0f7efea50efaeb27b3d","observation_id":"88badfd7-2710-490f-b840-365823371139","resolution":{"observed_at":"2026-08-06T15:15:22.281475Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.257192Z","title":null,"venue":null,"work_id":"aab09b80-2b74-49a3-9e22-24ab2d7ab760","year":2018},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.416693Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:f29f2adb284cf6c117bb3de4739da38f941ba5cb6e96d92775c7dc95b0d1dd35","observation_id":"f139b92d-d25e-4c50-891b-9883eb40ad1c","resolution":{"observed_at":"2026-08-06T15:15:22.263314Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19798","last_updated":"2025-03-07T14:20:23Z","snapshot_observed_at":"2026-08-16T13:14:20.695452Z","submitted_at":"2024-09-29T21:49:32Z","title":"Membership Inference Attacks Cannot Prove that a Model Was Trained On Your Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19798","snapshot_observed_at":"2026-08-06T15:15:21.422233Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.422233Z"},"links":{"cited_paper":"/paper/2409.19798","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:8bfb64d5664955bfcd2746a55476337a0b17bf70b6a94403f660c3a302f2663a","observation_id":"21032e1b-e41d-4d7a-bfb3-785fb5e58b9e","resolution":{"observed_at":"2026-08-06T15:15:21.422233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02936","last_updated":"2025-02-12T04:41:34Z","snapshot_observed_at":"2026-08-18T19:04:38.405489Z","submitted_at":"2024-04-03T04:25:01Z","title":"Min-K%++: Improved Baseline for Detecting Pre-Training Data from Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02936","snapshot_observed_at":"2026-08-06T15:15:21.428831Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.428831Z"},"links":{"cited_paper":"/paper/2404.02936","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:87e8fb338c3bab8aaaeee7204aedabf790a6e5ededb4228dcb062d38a13bb8d7","observation_id":"27c22f6c-8553-4cf2-9002-a8896860bd67","resolution":{"observed_at":"2026-08-06T15:15:21.428831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02385","last_updated":"2024-06-04T02:05:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T17:54:59Z","title":"TinyLlama: An Open-Source Small Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02385","snapshot_observed_at":"2026-08-06T15:15:21.435568Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.435568Z"},"links":{"cited_paper":"/paper/2401.02385","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:831968f7f9decdc8340593b6a81cbbf96db0fdc807a9bba32fe699793a0a1633","observation_id":"7972e3e3-bc8b-4329-aac6-c5a90b069a0a","resolution":{"observed_at":"2026-08-06T15:15:21.435568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-06T15:15:21.443099Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.443099Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:c91dcdd250c49a58f47928e2f86e0b5c198e59acea0e925fff555d9bf7be9e89","observation_id":"3b6d82fc-fe0e-48da-befa-c406b312725c","resolution":{"observed_at":"2026-08-06T15:15:21.443099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14781","last_updated":"2025-05-21T03:41:29Z","snapshot_observed_at":"2026-08-16T13:16:21.847439Z","submitted_at":"2024-09-23T07:55:35Z","title":"Pretraining Data Detection for Large Language Models: A Divergence-based Calibration Method","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14781","snapshot_observed_at":"2026-08-06T15:15:21.454509Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.454509Z"},"links":{"cited_paper":"/paper/2409.14781","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:ef40fe5881482c51bce119ba0cff97d6e6bcc0f92f71ebc673f617222fbe8354","observation_id":"637cefb0-2249-407d-885f-c228f6cf9551","resolution":{"observed_at":"2026-08-06T15:15:21.454509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:21.466217Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.466217Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:a7409aec97af9527ebe8e47af76aa4f6787b0024de8704bc9fcca9935c428f37","observation_id":"2da56f65-d7db-4481-a430-15bd819d647f","resolution":{"observed_at":"2026-08-06T15:15:21.466217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":61,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2507.16414."}