{"as_of":"2026-08-15T14:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e890065b4b433cd4999f0f24aa02d36556e26700c07499ed3dc87693f39b77c9","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:05:56.921126Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:59:51.621664Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T19:59:54.681611Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"cited_work":{"arxiv_id":"2506.00688","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00688","snapshot_observed_at":"2026-08-06T19:59:54.681611Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","venue":"cs.LG","work_id":"097b0db3-43ea-4dfa-99fd-61b46cbed2da","year":2025},"citing_paper":{"arxiv_id":"2507.04219","last_updated":"2026-06-17T16:48:46Z","snapshot_observed_at":"2026-08-12T19:03:19.005271Z","submitted_at":"2025-07-06T03:08:49Z","title":"Model Collapse Is Not a Bug but a Feature in Machine Unlearning for LLMs","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:51.621664Z"},"links":{"cited_paper":"/paper/2506.00688","citing_paper":"/paper/2507.04219"},"observation_digest":"sha256:7b6a2dd3759f0228af6c3f2bcf1061160ca9b71c7ba018ecbd0485a6a9658450","observation_id":"cacc932b-c9e3-42f4-b8a4-a2b303386651","resolution":{"observed_at":"2026-08-06T19:59:54.745064Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00688/citation-record","integrity":"/paper/2506.00688/integrity","json":"/paper/2506.00688/citation-record.json","paper":"/paper/2506.00688"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:51.572953Z","title":"Are aligned neural networks adversarially aligned?Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:51.572953Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:10c704f000b219cc0abf8b03b0a09d2f8fb004b89bf189c181d78414a9e32bca","observation_id":"ff707d62-44fc-480d-800a-0dc80713fde2","resolution":{"observed_at":"2026-08-07T12:05:51.572953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:06:00.275606Z","title":"Rethinking machine unlearning for large language models.Nature Machine Intelligence, pages 1–14, 2025","venue":null,"work_id":"fb13a14c-bf19-419b-83c8-4b7ad122f8bd","year":2025},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:51.655030Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:15bd6a76e9963de873fb89ba1dce7568a21cd8cff190c8665f651edfee52f852","observation_id":"f98b6eca-868f-4d71-aee7-50f5265849f6","resolution":{"observed_at":"2026-08-07T12:06:00.384033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03218","last_updated":"2024-05-15T19:16:09Z","snapshot_observed_at":"2026-08-15T06:18:34.739211Z","submitted_at":"2024-03-05T18:59:35Z","title":"The WMDP Benchmark: Measuring and Reducing Malicious Use With Unlearning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03218","snapshot_observed_at":"2026-08-07T12:05:51.766247Z","title":"The wmdp benchmark: Measuring and reducing malicious use with unlearning.arXiv preprint arXiv:2403.03218, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:51.766247Z"},"links":{"cited_paper":"/paper/2403.03218","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:10e32d6d6949057ad2039e029b20823e8d4e518422ed8adc045ad856488ab4b1","observation_id":"704d0e38-1681-42cb-90bf-082a31d18d0d","resolution":{"observed_at":"2026-08-07T12:05:51.766247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05868","last_updated":"2024-10-10T22:00:41Z","snapshot_observed_at":"2026-07-06T17:57:27.510162Z","submitted_at":"2024-04-08T21:05:42Z","title":"Negative Preference Optimization: From Catastrophic Collapse to Effective Unlearning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05868","snapshot_observed_at":"2026-08-07T12:05:51.844289Z","title":"Negative preference optimization: From catastrophic collapse to effective unlearning.arXiv preprint arXiv:2404.05868, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:51.844289Z"},"links":{"cited_paper":"/paper/2404.05868","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:d48f91927e2b240f5021b94e560315025c44c7719026507b3ed23ffce4fb1f98","observation_id":"b40dc7ac-ded5-4a71-9527-9005cb32af62","resolution":{"observed_at":"2026-08-07T12:05:51.844289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:06:00.098239Z","title":"Model manipulation attacks enable more rigorous evaluations of llm capabilities","venue":null,"work_id":"5966e0a8-aa13-45a6-9464-1c01c7cf898c","year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:51.954245Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:ea3fd971e5b7ea21bbe30b3df71906f52b5c8c58563eafe1edb39b255668d26b","observation_id":"ed586202-c046-4069-a8b9-3cad2ae29c10","resolution":{"observed_at":"2026-08-07T12:06:00.165529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18025","last_updated":"2025-05-31T19:22:41Z","snapshot_observed_at":"2026-08-15T04:19:50.533654Z","submitted_at":"2024-09-26T16:32:19Z","title":"An Adversarial Perspective on Machine Unlearning for AI Safety","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18025","snapshot_observed_at":"2026-08-07T12:05:52.023421Z","title":"An adversarial perspective on machine unlearning for ai safety.arXiv preprint arXiv:2409.18025, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:52.023421Z"},"links":{"cited_paper":"/paper/2409.18025","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:5080bedcd2bff6d73bc58b2a98086bf6b133f030d7f254989f2b083f760e4203","observation_id":"519bc41e-0dcb-4c33-8e15-b3338189d42c","resolution":{"observed_at":"2026-08-07T12:05:52.023421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15146","last_updated":"2024-11-11T19:47:16Z","snapshot_observed_at":"2026-08-13T15:57:02.054302Z","submitted_at":"2024-04-23T15:49:37Z","title":"Rethinking LLM Memorization through the Lens of Adversarial Compression","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15146","snapshot_observed_at":"2026-08-07T12:05:52.120036Z","title":"Rethinking llm memorization through the lens of adversarial compression.arXiv preprint arXiv:2404.15146, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:52.120036Z"},"links":{"cited_paper":"/paper/2404.15146","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:e9e8b0f17f56c26540dae32b16cd7fb55ac97034ad1de3caf668ef5de54541f8","observation_id":"6e88bdd6-2a6c-4927-89cf-0ce6d10d836f","resolution":{"observed_at":"2026-08-07T12:05:52.120036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:52.249120Z","title":"Machine unlearning: Solutions and challenges","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:52.249120Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:8b8312e60849627b1a63f43d7e8ab0c426ce40a27ce89d8994695ed4258c0e93","observation_id":"8a71b73c-bb07-48a4-9b9d-98a0cfc6a2b0","resolution":{"observed_at":"2026-08-07T12:05:52.249120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:59.958666Z","title":"On the necessity of auditable algorithmic definitions for machine unlearning","venue":null,"work_id":"e6b9d3f7-b2b9-4116-b89b-72455e7852cd","year":2022},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:52.339173Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:d1e50f5ebe08e950001ebe54e68e7671614c3e46ba7b64ccfbc8d2b0df088bfb","observation_id":"8df5076b-e95c-4178-b086-4714ef621573","resolution":{"observed_at":"2026-08-07T12:05:59.995260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:52.462069Z","title":"Arcane: An efficient architecture for exact machine unlearning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:52.462069Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:601c56823f80bd586b007a7d1e670b5a2b8ed3ef51d043fa1b9e22ec26fe5ccf","observation_id":"d63ed356-3913-4242-962b-683dce0f9f0f","resolution":{"observed_at":"2026-08-07T12:05:52.462069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.03030","last_updated":"2023-11-08T03:57:25Z","snapshot_observed_at":"2026-08-15T07:57:47.753668Z","submitted_at":"2019-11-08T03:57:41Z","title":"Certified Data Removal from Machine Learning Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.03030","snapshot_observed_at":"2026-08-07T12:05:52.568143Z","title":"Certified data removal from machine learning models.arXiv preprint arXiv:1911.03030, 2019","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:52.568143Z"},"links":{"cited_paper":"/paper/1911.03030","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:b68d5fea00cfda21a1bc9666517494bdaa491295378357371dc9a669498d9def","observation_id":"f80afe54-171c-43b7-80ce-8e8ba7e26c2a","resolution":{"observed_at":"2026-08-07T12:05:52.568143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:52.736911Z","title":"Amnesiac machine learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:52.736911Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:4eaf723fa6933fe87d57300f74acc6fcd525193a8ab2f65d9475cf679ac4fb43","observation_id":"e9204cbc-2532-4d49-9e4e-e266e13ef43b","resolution":{"observed_at":"2026-08-07T12:05:52.736911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:59.817468Z","title":"Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744, 2022","venue":null,"work_id":"1f6faf77-37cf-4ce0-803e-8fe9acdb41ab","year":2022},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:52.863014Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:5bea9d21209634e446f6c494777a75af79edf253641c7b38b829bf6570430ec1","observation_id":"0147fd8c-4e39-4fd1-a844-f63bfb74ece0","resolution":{"observed_at":"2026-08-07T12:05:59.863998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02879","last_updated":"2025-04-08T17:18:21Z","snapshot_observed_at":"2026-08-12T22:31:20.074438Z","submitted_at":"2024-10-03T18:07:25Z","title":"Position: LLM Unlearning Benchmarks are Weak Measures of Progress","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02879","snapshot_observed_at":"2026-08-07T12:05:52.922677Z","title":"Position: Llm unlearning benchmarks are weak measures of progress.arXiv preprint arXiv:2410.02879, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:52.922677Z"},"links":{"cited_paper":"/paper/2410.02879","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:fecf7e2ef58a3897c4e4b0bd19a31010ea3bd4ed9cea5190ab422a7336c393ef","observation_id":"53739170-9478-45d9-ab81-0fe1a5c102e9","resolution":{"observed_at":"2026-08-07T12:05:52.922677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03523","last_updated":"2025-03-01T11:51:16Z","snapshot_observed_at":"2026-08-12T22:30:38.384137Z","submitted_at":"2024-10-04T15:44:23Z","title":"A Probabilistic Perspective on Unlearning and Alignment for Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03523","snapshot_observed_at":"2026-08-07T12:05:53.002524Z","title":"A probabilistic perspective on unlearning and alignment for large language models.arXiv preprint arXiv:2410.03523, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.002524Z"},"links":{"cited_paper":"/paper/2410.03523","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:d56be0a09dd05797b021992785b79ec6a1682fb9cf9b81986c556464e4a07680","observation_id":"d9c58f53-d6d7-4332-8e4c-5de37f7d0bdd","resolution":{"observed_at":"2026-08-07T12:05:53.002524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:53.151845Z","title":"Regulation (eu) 2016/679 of the european parliament and of the council","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.151845Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:ae68e3dbbb49a8e4d139652c8c3c5eb1a171b16ee04b97a9b4badbc06c77aa6d","observation_id":"ecd16d61-77a1-42e0-876a-809b36c4e673","resolution":{"observed_at":"2026-08-07T12:05:53.151845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:59.669395Z","title":"UK General Data Protection Regulation (UK GDPR), 2021","venue":null,"work_id":"0199b688-a79e-4efe-bac2-19c9608babb6","year":2021},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.264350Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:18949cd6659a578e9c05b21e5af4e512cbc4fec9d1738e62bcd8e938673cfa12","observation_id":"bbad220d-79b2-4982-b824-b40a48065d49","resolution":{"observed_at":"2026-08-07T12:05:59.718947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:59.516096Z","title":"Ccpa regulations: Final regulation text.Office of the Attorney General, California Department of Justice, 2021","venue":null,"work_id":"4b0d1fd0-a2d7-4b8d-8feb-25bb9249cc6b","year":2021},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.350332Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:f68c9e3205c88f35bfc63a480480b19e57c105d7120552ab04a1bb49b933511c","observation_id":"d188f6ad-6f9e-4d2f-8da3-3478197b30bd","resolution":{"observed_at":"2026-08-07T12:05:59.574448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:59.360124Z","title":"Bill C-27: Digital Charter Implementation Act, 2022 – Consumer Privacy Protection Act (CPPA), 2022","venue":null,"work_id":"e248100c-f1a9-41a0-a3d2-2046408655f3","year":2022},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.436906Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:b6ddf340a59b162ffea3d61f159f7ce253aa0c72c72aaece7a5220ca6a2ba2a4","observation_id":"5f14058e-993b-4af9-94a4-fe348c6c5c51","resolution":{"observed_at":"2026-08-07T12:05:59.430991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:53.529994Z","title":"Machine unlearning via algorithmic stability","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.529994Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:1928c2b231d754fc53ece8049cfdfc0165c99f13cf4a09f513115b002f48c6b1","observation_id":"ba6e05a5-65e4-4879-b2cc-3a16b5747e45","resolution":{"observed_at":"2026-08-07T12:05:53.529994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:59.135844Z","title":"Machine unlearning","venue":null,"work_id":"b324be31-0f12-48a8-bc66-524bf32ba6eb","year":2021},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.653852Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:7dd153a008576d0b71d1235a691493d981f738af60f6dfca6e01c2c6b99e6935","observation_id":"c40f6bfd-3fec-45fa-8739-a12d418da566","resolution":{"observed_at":"2026-08-07T12:05:59.233072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:58.942783Z","title":"Forgetting outside the box: Scrubbing deep networks of information accessible from input-output observations","venue":null,"work_id":"1745226b-5a0b-4b09-86d8-7b135468cc7f","year":2020},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.763170Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:647b3d4ec39e2854c4b4f94efae9cc003bea23908cddbc0a9926cec955b2d42c","observation_id":"6e098255-a136-44a3-b54c-9085396652b5","resolution":{"observed_at":"2026-08-07T12:05:59.005799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:58.784959Z","title":"Making ai forget you: Data deletion in machine learning.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":"929c2bf1-bebc-4bae-ba56-268c0bb8da41","year":2019},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.889403Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:259646e1aa460e60c29e27f8b2ee40b020d1ef1c89f590e22b88c54dc1859d66","observation_id":"896cf14d-407c-441a-b87b-541bf7c292d0","resolution":{"observed_at":"2026-08-07T12:05:58.852576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:53.990449Z","title":"The algorithmic foundations of differential privacy.Founda- tions and Trends® in Theoretical Computer Science, 9(3–4):211–407, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.990449Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:6ed428ca4f0a1bc525fa282f1c93c21a350e9bc178ca34bdfc84ca89b6e596fd","observation_id":"127de00a-e182-44b7-a0f8-9b8e544c3df7","resolution":{"observed_at":"2026-08-07T12:05:53.990449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:58.588708Z","title":"Approximate data deletion from machine learning models","venue":null,"work_id":"ac2a91ee-303d-453f-b094-a3ae1a1eee31","year":2008},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.039587Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:4bf4762e9169dbc33f532124ce00ef92d951a952ab484aecf8199e72cd2df231","observation_id":"ed4f35cb-41be-4c86-b659-a0ccc94ac5b4","resolution":{"observed_at":"2026-08-07T12:05:58.630231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:54.109894Z","title":"Remember what you want to forget: Algorithms for machine unlearning.Advances in Neural Information Processing Systems, 34:18075–18086, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.109894Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:68e0c6a805496bdda4151bee895fb7b7e89ba5acf485be9e7c3c003ca30d0672","observation_id":"b9b3f8db-d4a4-444f-bf52-1fc94e50c7b8","resolution":{"observed_at":"2026-08-07T12:05:54.109894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02238","last_updated":"2023-10-04T05:20:19Z","snapshot_observed_at":"2026-08-13T05:58:13.172138Z","submitted_at":"2023-10-03T17:48:14Z","title":"Who's Harry Potter? Approximate Unlearning in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02238","snapshot_observed_at":"2026-08-07T12:05:54.154286Z","title":"Who’s harry potter? approximate unlearning in llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.154286Z"},"links":{"cited_paper":"/paper/2310.02238","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:c7d0b6d088e30895e9cb4ae4ba3a0a0d4545f6a3587233c6d3fa5a3836b33c36","observation_id":"359706bb-e0d8-4104-90dd-4ab92dd09261","resolution":{"observed_at":"2026-08-07T12:05:54.154286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06121","last_updated":"2024-01-11T18:57:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-11T18:57:12Z","title":"TOFU: A Task of Fictitious Unlearning for LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06121","snapshot_observed_at":"2026-08-07T12:05:54.220256Z","title":"Tofu: A task of fictitious unlearning for llms.arXiv preprint arXiv:2401.06121, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.220256Z"},"links":{"cited_paper":"/paper/2401.06121","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:2549e0a1eb2a88c15aeb0f91a95e900b606da724426f39b90576c6d8791c879f","observation_id":"1b68dbd7-1972-40db-8609-c9c35585ad50","resolution":{"observed_at":"2026-08-07T12:05:54.220256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03554","last_updated":"2025-03-07T16:05:19Z","snapshot_observed_at":"2026-08-12T22:06:53.336080Z","submitted_at":"2024-11-05T23:26:10Z","title":"Benchmarking Vision Language Model Unlearning via Fictitious Facial Identity Dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.03554","snapshot_observed_at":"2026-08-07T12:05:54.289150Z","title":"Benchmarking vision language model unlearning via fictitious facial identity dataset, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.289150Z"},"links":{"cited_paper":"/paper/2411.03554","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:2e2a1c25e9e80d1840950758bd017954aad6d5bcccc108e1649842776962847d","observation_id":"83307a50-4f39-4cfc-be06-983fd0dceb4c","resolution":{"observed_at":"2026-08-07T12:05:54.289150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06460","last_updated":"2024-07-14T20:14:02Z","snapshot_observed_at":"2026-08-12T23:26:16.124574Z","submitted_at":"2024-07-08T23:47:29Z","title":"MUSE: Machine Unlearning Six-Way Evaluation for Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06460","snapshot_observed_at":"2026-08-07T12:05:54.371943Z","title":"Muse: Machine unlearning six-way evaluation for language models.arXiv preprint arXiv:2407.06460, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.371943Z"},"links":{"cited_paper":"/paper/2407.06460","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:0b59e6ac48e05e24e065a5e91d065832a33c3d07aa6d22a7858d39ec12b56ff4","observation_id":"f6532211-495d-4c8c-b26b-ee0b292edd2b","resolution":{"observed_at":"2026-08-07T12:05:54.371943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10890","last_updated":"2024-06-16T10:47:21Z","snapshot_observed_at":"2026-08-12T23:41:48.083922Z","submitted_at":"2024-06-16T10:47:21Z","title":"RWKU: Benchmarking Real-World Knowledge Unlearning for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10890","snapshot_observed_at":"2026-08-07T12:05:54.452560Z","title":"Rwku: Benchmarking real-world knowledge unlearning for large language models.arXiv preprint arXiv:2406.10890, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.452560Z"},"links":{"cited_paper":"/paper/2406.10890","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:488727809f533684d42ebd4f5c47930b0332b5d553cb35bf18e8564e568271e8","observation_id":"49027b76-8cff-46ae-8ccd-55664d8e891d","resolution":{"observed_at":"2026-08-07T12:05:54.452560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04952","last_updated":"2025-01-09T03:59:10Z","snapshot_observed_at":"2026-08-15T06:27:30.398438Z","submitted_at":"2025-01-09T03:59:10Z","title":"Open Problems in Machine Unlearning for AI Safety","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04952","snapshot_observed_at":"2026-08-07T12:05:54.573267Z","title":"Open problems in machine unlearning for ai safety.arXiv preprint arXiv:2501.04952, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.573267Z"},"links":{"cited_paper":"/paper/2501.04952","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:3e44db34f5d85b4199069b992cb122b039710521cd12da11c6472008b01f8fc8","observation_id":"3c44d985-63a4-4ab2-98f1-ef23c5ab4aba","resolution":{"observed_at":"2026-08-07T12:05:54.573267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-11T16:28:21.917686Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01318","snapshot_observed_at":"2026-08-07T12:05:54.648339Z","title":"Jailbreakbench: An open robustness benchmark for jailbreaking large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.648339Z"},"links":{"cited_paper":"/paper/2404.01318","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:fc8952d99e863a0c5de29b04d86705b77b616d06e5758bbb1aa025131faf0cc3","observation_id":"8435d17c-0dd1-4e7b-a12d-ac356aaf2191","resolution":{"observed_at":"2026-08-07T12:05:54.648339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:54.737706Z","title":"Simplicity prevails: Rethinking negative preference optimization for llm unlearning.arXiv preprint arXiv:2410.07163, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.737706Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:4356ddcba67197d3471f248b2c0c50a2865959bc0587af03dc39913c3b85f23e","observation_id":"7d675994-9cf1-4f64-9ed4-ae586d70774a","resolution":{"observed_at":"2026-08-07T12:05:54.737706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:58.448978Z","title":"Improving alignment and robustness with circuit breakers","venue":null,"work_id":"cc2d464d-8f41-4f7d-9776-6b3882e97341","year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.829278Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:111d8ec23e6df5a971d819f98742471df8a5e822f494b23940978329e5872b9a","observation_id":"c4757677-a82c-4a4d-8c0f-d12f75ddbeda","resolution":{"observed_at":"2026-08-07T12:05:58.521120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:58.257701Z","title":"Fast yet effective machine unlearning.IEEE Transactions on Neural Networks and Learning Systems, 2023","venue":null,"work_id":"d9f2ac1f-af47-499c-8d44-423350369cdd","year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.970209Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:3dc708fc290940099236329b09b07e459e1bd0d4acccdf8c4be1fd9b097c3e64","observation_id":"9906bf18-f0d5-411e-a1c2-b98515473022","resolution":{"observed_at":"2026-08-07T12:05:58.355396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:55.042258Z","title":"Self- destructing models: Increasing the costs of harmful dual uses of foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.042258Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:c12c5ed80c8da6acd060bad16d916205b6717ca90c098ca6b4dae607da0f880a","observation_id":"5d754615-cb60-48b8-8f88-5c1c149654ee","resolution":{"observed_at":"2026-08-07T12:05:55.042258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00761","last_updated":"2025-02-10T18:26:14Z","snapshot_observed_at":"2026-08-12T23:10:02.039675Z","submitted_at":"2024-08-01T17:59:12Z","title":"Tamper-Resistant Safeguards for Open-Weight LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00761","snapshot_observed_at":"2026-08-07T12:05:55.125060Z","title":"Tamper-resistant safeguards for open-weight llms.arXiv preprint arXiv:2408.00761, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.125060Z"},"links":{"cited_paper":"/paper/2408.00761","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:d3697c726c995198c0db98d46cf635926572ca3efbaf237d95915c534cd7f92b","observation_id":"cedf324f-8abb-4e10-95c4-f2a870cba0f3","resolution":{"observed_at":"2026-08-07T12:05:55.125060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08827","last_updated":"2025-02-07T16:27:48Z","snapshot_observed_at":"2026-08-12T22:25:25.060362Z","submitted_at":"2024-10-11T14:06:58Z","title":"Do Unlearning Methods Remove Information from Language Model Weights?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08827","snapshot_observed_at":"2026-08-07T12:05:55.186590Z","title":"Do unlearning methods remove information from language model weights?arXiv preprint arXiv:2410.08827, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.186590Z"},"links":{"cited_paper":"/paper/2410.08827","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:89ec562172f662d03d8dc6ebf286cc5346c4324e2ca087802807a19608bf9d28","observation_id":"d4357c90-8381-4d3c-957e-8dd7f44a1ee9","resolution":{"observed_at":"2026-08-07T12:05:55.186590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16835","last_updated":"2024-02-26T18:57:37Z","snapshot_observed_at":"2026-08-13T04:09:47.568146Z","submitted_at":"2024-02-26T18:57:37Z","title":"Eight Methods to Evaluate Robust Unlearning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16835","snapshot_observed_at":"2026-08-07T12:05:55.328390Z","title":"Eight methods to evaluate robust unlearning in llms.arXiv preprint arXiv:2402.16835, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.328390Z"},"links":{"cited_paper":"/paper/2402.16835","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:c0e4d33afc807875a7176a9553426cb750e1404236b635bc7c38b52a07684a0f","observation_id":"2765cbc7-1e9a-44c4-8c2f-9b208adf5640","resolution":{"observed_at":"2026-08-07T12:05:55.328390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15221","last_updated":"2024-09-04T00:58:59Z","snapshot_observed_at":"2026-08-15T07:52:32.620818Z","submitted_at":"2024-08-27T17:33:30Z","title":"LLM Defenses Are Not Robust to Multi-Turn Human Jailbreaks Yet","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15221","snapshot_observed_at":"2026-08-07T12:05:55.420996Z","title":"Llm defenses are not robust to multi-turn human jailbreaks yet.arXiv preprint arXiv:2408.15221, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.420996Z"},"links":{"cited_paper":"/paper/2408.15221","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:c01296ecf08ca8a8f8792c48ee4edb685414b389526c7d4592d9f835a4ad1753","observation_id":"0795bf9e-e8f0-4fc9-b33f-0846d3705edb","resolution":{"observed_at":"2026-08-07T12:05:55.420996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17035","last_updated":"2023-11-28T18:47:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T18:47:03Z","title":"Scalable Extraction of Training Data from (Production) Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17035","snapshot_observed_at":"2026-08-07T12:05:55.549481Z","title":"Scalable extraction of training data from (production) language models.arXiv preprint arXiv:2311.17035, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.549481Z"},"links":{"cited_paper":"/paper/2311.17035","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:e5bc07e9993caff5bce1250bc5933fd0072c70704edd65d50b27e5d66cd5d34c","observation_id":"f813e603-6622-497b-b82f-a6eb0e307f39","resolution":{"observed_at":"2026-08-07T12:05:55.549481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:58.051117Z","title":"Preventing generation of verba- tim memorization in language models gives a false sense of privacy","venue":null,"work_id":"972a62e3-f469-4bb0-a001-39accd81c03b","year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.630893Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:f7268157dbbb7b5f2c9cf98c5b0c06e4ba42e3509f819b4336ae779a27d15265","observation_id":"13ce2125-4e36-4fa8-9186-6d7942e9153a","resolution":{"observed_at":"2026-08-07T12:05:58.146074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13356","last_updated":"2025-03-17T07:46:49Z","snapshot_observed_at":"2026-08-12T23:39:24.139822Z","submitted_at":"2024-06-19T09:03:21Z","title":"Unlearning or Obfuscating? Jogging the Memory of Unlearned LLMs via Benign Relearning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13356","snapshot_observed_at":"2026-08-07T12:05:55.709463Z","title":"Unlearning or Obfuscating? Jogging the Memory of Unlearned LLMs via Benign Relearning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.709463Z"},"links":{"cited_paper":"/paper/2406.13356","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:a2468fc6a3bd098624ed4f6445a536f69d3d89744f756855bdae8e1edb59e33e","observation_id":"485c88b7-155e-4942-bd14-ab77ccebbffb","resolution":{"observed_at":"2026-08-07T12:05:55.709463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-08-12T12:29:45.113982Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-07T12:05:55.788297Z","title":"Jailbreaking black box large language models in twenty queries.arXiv preprint arXiv:2310.08419, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.788297Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:9f25f5096634c175a0ac30fe6f6db01b2b4d398cc1e83c4077542fa8d39a8c08","observation_id":"fece8aae-3c51-4d92-bf7a-a10a4ac90f65","resolution":{"observed_at":"2026-08-07T12:05:55.788297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T12:05:55.906495Z","title":"Universal and transferable adversarial attacks on aligned language models.arXiv preprint arXiv:2307.15043, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.906495Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:9deb8cce70531f1af2b6d26530d84634d6a1b0ae3d01ad7b00be36ea450dab69","observation_id":"07ca54f4-756a-4d46-a6b3-22e0c3b4126a","resolution":{"observed_at":"2026-08-07T12:05:55.906495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13691","last_updated":"2024-11-09T20:00:07Z","snapshot_observed_at":"2026-08-12T22:20:49.564427Z","submitted_at":"2024-10-17T15:55:36Z","title":"Jailbreaking LLM-Controlled Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13691","snapshot_observed_at":"2026-08-07T12:05:55.960498Z","title":"Jailbreaking llm-controlled robots.arXiv preprint arXiv:2410.13691, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.960498Z"},"links":{"cited_paper":"/paper/2410.13691","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:857695ee0a188c5e1223846c94eac81b1b44f668b14a15c80d439d6956c90f70","observation_id":"2c7872c0-9e3f-4ff1-b7d1-43bcb9bc69d5","resolution":{"observed_at":"2026-08-07T12:05:55.960498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17447","last_updated":"2024-10-01T17:39:09Z","snapshot_observed_at":"2026-08-12T23:15:27.375645Z","submitted_at":"2024-07-24T17:23:18Z","title":"FLRT: Fluent Student-Teacher Redteaming","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17447","snapshot_observed_at":"2026-08-07T12:05:56.083076Z","title":"Flrt: Fluent student-teacher redteaming.arXiv preprint arXiv:2407.17447, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.083076Z"},"links":{"cited_paper":"/paper/2407.17447","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:b8908e5c70f821dfa46d213a2b4bcf69e46565c46b7e95e0f83a4f8f7982a671","observation_id":"928a6c23-7649-46db-85db-6a604084190f","resolution":{"observed_at":"2026-08-07T12:05:56.083076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:56.130896Z","title":"Rush, and Thomas Wolf","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.130896Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:36948d6ea44ea1731b0c2f7549ea778a619189c1292c04cd5eda9b474406ec08","observation_id":"7aa478b5-448e-4df2-8276-a7b5318ed947","resolution":{"observed_at":"2026-08-07T12:05:56.130896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05463","last_updated":"2023-09-11T14:01:45Z","snapshot_observed_at":"2026-08-02T22:47:03.212781Z","submitted_at":"2023-09-11T14:01:45Z","title":"Textbooks Are All You Need II: phi-1.5 technical report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05463","snapshot_observed_at":"2026-08-07T12:05:56.208500Z","title":"Textbooks are all you need ii: phi-1.5 technical report, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.208500Z"},"links":{"cited_paper":"/paper/2309.05463","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:f75de379932120d87f965920f3819fecb399c62aaa79df1eb7744d5ac5d5bd46","observation_id":"3ca46dc5-1a51-4180-bf1f-d96d1b4cfc0c","resolution":{"observed_at":"2026-08-07T12:05:56.208500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T12:05:56.277372Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.277372Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:ded7ebd755fc257d016d486d332f8abae6bdd906b9294cbd68f51ebad760b01c","observation_id":"86ca618a-a163-4bac-b187-b1beac9c5f8a","resolution":{"observed_at":"2026-08-07T12:05:56.277372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.10077","last_updated":"2020-02-25T03:12:57Z","snapshot_observed_at":"2026-08-14T11:38:04.558916Z","submitted_at":"2019-12-20T19:49:32Z","title":"Are Transformers universal approximators of sequence-to-sequence functions?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.10077","snapshot_observed_at":"2026-08-07T12:05:56.351628Z","title":"Are transformers universal approximators of sequence-to-sequence functions?arXiv preprint arXiv:1912.10077, 2019","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.351628Z"},"links":{"cited_paper":"/paper/1912.10077","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:419962e0b3be18c69df96ad45edecc223a40e10181a28e36d531d4e047665d04","observation_id":"a2084ee9-b7bd-45a0-8515-4d9860c7f7c7","resolution":{"observed_at":"2026-08-07T12:05:56.351628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15299","last_updated":"2025-08-06T13:42:41Z","snapshot_observed_at":"2026-08-14T22:17:11.912635Z","submitted_at":"2025-03-19T15:21:48Z","title":"Inside-Out: Hidden Factual Knowledge in LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15299","snapshot_observed_at":"2026-08-07T12:05:56.438082Z","title":"Inside-out: Hidden factual knowledge in llms.arXiv preprint arXiv:2503.15299, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.438082Z"},"links":{"cited_paper":"/paper/2503.15299","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:07beb17d79782fde8c169fc0f9aafdde51044a2ea433222df88b6ea650679d59","observation_id":"64a9edca-15b9-4bf1-bfba-02c9d176ce4b","resolution":{"observed_at":"2026-08-07T12:05:56.438082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.03061","last_updated":"2020-05-22T21:58:58Z","snapshot_observed_at":"2026-08-04T09:46:11.579002Z","submitted_at":"2020-04-07T01:06:36Z","title":"Information-Theoretic Probing for Linguistic Structure","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.03061","snapshot_observed_at":"2026-08-07T12:05:56.506312Z","title":"Information-theoretic probing for linguistic structure.arXiv preprint arXiv:2004.03061, 2020","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.506312Z"},"links":{"cited_paper":"/paper/2004.03061","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:181545c133f9e0e5c8645810765c2e2ee97bae48184806c8895160717bc4b853","observation_id":"97545fc3-8b39-467e-b691-9dab13b78728","resolution":{"observed_at":"2026-08-07T12:05:56.506312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12617","last_updated":"2024-12-18T03:03:08Z","snapshot_observed_at":"2026-08-13T00:03:10.461647Z","submitted_at":"2024-05-21T09:12:20Z","title":"Quantifying Semantic Emergence in Language Models","version":2},"cited_work":{"arxiv_id":"2405.12617","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.12617","snapshot_observed_at":"2026-08-07T12:05:57.146058Z","title":"Quantifying Semantic Emergence in Language Models","venue":"cs.CL","work_id":"1a629718-1106-4f57-84c2-38904584eddc","year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.612126Z"},"links":{"cited_paper":"/paper/2405.12617","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:4739a9dddc99acb22756b0d6508ee3c6452a2a6936608a4c631ca8eadf3a9dce","observation_id":"2c3b377a-ec42-4c72-bf5e-87202cc538ee","resolution":{"observed_at":"2026-08-07T12:05:57.239317Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:57.919119Z","title":"Measuring and modifying factual knowledge in large language models","venue":null,"work_id":"3eee2cdf-d758-45f5-9340-4818bc1de261","year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.685470Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:ab551a0277acf36c69c48420a28012e03fd632961c10356a9c6d6bad2f7c3749","observation_id":"4610c999-c621-45b3-bfd6-2721d8619e66","resolution":{"observed_at":"2026-08-07T12:05:57.956958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11324","last_updated":"2024-07-01T22:28:01Z","snapshot_observed_at":"2026-08-12T15:05:30.306144Z","submitted_at":"2023-10-17T15:03:30Z","title":"Quantifying Language Models' Sensitivity to Spurious Features in Prompt Design or: How I learned to start worrying about prompt formatting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11324","snapshot_observed_at":"2026-08-07T12:05:56.757190Z","title":"Quantifying language models’ sensitivity to spurious features in prompt design or: How i learned to start worrying about prompt formatting.arXiv preprint arXiv:2310.11324, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.757190Z"},"links":{"cited_paper":"/paper/2310.11324","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:30f4334055a2b046c5778d8af83db6328f2a645a5ecdaf3363e2b73c91d1e9f9","observation_id":"b7b88fb4-20ef-490b-a7e5-975aef909afc","resolution":{"observed_at":"2026-08-07T12:05:56.757190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03882","last_updated":"2024-02-22T01:40:35Z","snapshot_observed_at":"2026-08-15T09:16:07.428258Z","submitted_at":"2023-09-07T17:44:56Z","title":"Large Language Models Are Not Robust Multiple Choice Selectors","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03882","snapshot_observed_at":"2026-08-07T12:05:56.806697Z","title":"Large language models are not robust multiple choice selectors.arXiv preprint arXiv:2309.03882, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.806697Z"},"links":{"cited_paper":"/paper/2309.03882","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:141c6f9bd37dce31a10848a8ffd42fe18852aa01cbfd18d75600c5bc3ff44d2c","observation_id":"9c9e14a4-7774-4374-9178-d1651ba39f18","resolution":{"observed_at":"2026-08-07T12:05:56.806697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-14T13:06:35.039871Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-07T12:05:56.921126Z","title":"Does prompt formatting have any impact on llm performance?arXiv preprint arXiv:2411.10541, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.921126Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:cf9a9387667885e41dc99063b968c510f1f652f56557d9f9981ef98674a508c8","observation_id":"c2dbf4f5-0b16-4863-992b-3b745ee773c4","resolution":{"observed_at":"2026-08-07T12:05:56.921126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T14:19:01.676290Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":1,"verified_fuzzy":15},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 1 inbound Pith citation observation for arXiv:2506.00688."}