{"as_of":"2026-08-19T20:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e3c6dbd7d073aea45e90ad6364ba736275c3c628d1287f45f56d9b91dcb20e43","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:16:50.604702Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.13388/citation-record","integrity":"/paper/2504.13388/integrity","json":"/paper/2504.13388/citation-record.json","paper":"/paper/2504.13388"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.441620Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.441620Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:f126acc34289a7a51674c0aa0944b62645f25138bf6d9bd78db0831126ffed25","observation_id":"4ba8d9ab-e81c-4662-a86b-2d26aa8b49b8","resolution":{"observed_at":"2026-08-16T12:16:50.441620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:51.122627Z","title":"Second-order stochastic optimization for machine learning in linear time","venue":null,"work_id":"b3409e9c-89dc-4ac5-9303-ba1ce926a9fa","year":2017},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.446505Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:c288a247ea2e771b3392fd09c9de6a7f188e1fb1e8199202ea6b55725a847b5c","observation_id":"0513ae6d-b9cc-4b7a-9ddf-a38e9bc58ea8","resolution":{"observed_at":"2026-08-16T12:16:51.125876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.450233Z","title":"Natural gradient works efficiently in learning","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.450233Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:5c608bafd8c4d47413528154e122b80ecd6edf59e7279e5c989db8b9bd0b0b26","observation_id":"53dd8be7-6a04-427b-b657-0aab91fcd2af","resolution":{"observed_at":"2026-08-16T12:16:50.450233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:51.105302Z","title":"M., Thakkar, O., and Thakurta, A","venue":null,"work_id":"cfcd8690-85f6-4f16-a623-01f4a9a45ea3","year":2022},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.453235Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:3450a27aa385ef01aa942f1545f7955f16d5d9c71898247dfa13818c5b8e944e","observation_id":"d5c94921-0159-4c84-b573-683d685a0cdc","resolution":{"observed_at":"2026-08-16T12:16:51.108575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.456455Z","title":"A., Jia, H., Travers, A., Zhang, B., Lie, D., and Papernot, N","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.456455Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:425c40570927b2fc5d03e2d621be4a08fadf1f83fafcf3e5ac65d3e559a53da3","observation_id":"84dde7e4-e8d7-434a-a0b8-807f18235ad7","resolution":{"observed_at":"2026-08-16T12:16:50.456455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22086","last_updated":"2025-05-06T00:58:15Z","snapshot_observed_at":"2026-08-18T06:04:57.506197Z","submitted_at":"2024-10-29T14:41:44Z","title":"Unlearning as multi-task optimization: A normalized gradient difference approach with an adaptive learning rate","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.22086","snapshot_observed_at":"2026-08-16T12:16:50.460021Z","title":"Unlearning as multi-task optimization: A normalized gradient difference approach with an adaptive learning rate","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.460021Z"},"links":{"cited_paper":"/paper/2410.22086","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:31e3ccc537ce2b4a125974c6d1bde3fa1f669fc03d3b1dc5c4d313a1b8bd2a22","observation_id":"2c0264e7-727a-4c98-84e3-6ef488dcb208","resolution":{"observed_at":"2026-08-16T12:16:50.460021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:51.087374Z","title":"S., Tarun, A","venue":null,"work_id":"995500ff-75ec-4e94-8126-eca96135e31c","year":2023},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.464300Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:458f19df9607730a6288209541a0f27ac8edbbaa9ba70f5fe3acd1e4d637bb41","observation_id":"19c0d712-6c2a-4ff8-9d8d-8e4a36f38d23","resolution":{"observed_at":"2026-08-16T12:16:51.090473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.467688Z","title":"F., Choquette-Choo, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.467688Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:f127f7bff514bfe4b592a8a1cc1f9e0ec3157a968f4f6fa45cd4f5ea282a7523","observation_id":"2011d049-b587-4035-960b-32a705792489","resolution":{"observed_at":"2026-08-16T12:16:50.467688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:51.076008Z","title":"GitHub , I","venue":null,"work_id":"751fd56e-a710-42db-9197-070c51cb73fe","year":2022},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.472190Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:053a1a0e2133b84cc07fb73af697e7094ab93b850b2bccd126ef0ca1f707437d","observation_id":"370a102c-a941-46d4-87ef-909f30b7b423","resolution":{"observed_at":"2026-08-16T12:16:51.079755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02238","last_updated":"2023-10-04T05:20:19Z","snapshot_observed_at":"2026-08-18T10:13:38.925008Z","submitted_at":"2023-10-03T17:48:14Z","title":"Who's Harry Potter? Approximate Unlearning in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02238","snapshot_observed_at":"2026-08-16T12:16:50.475141Z","title":"and Russinovich, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.475141Z"},"links":{"cited_paper":"/paper/2310.02238","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:f3dee013bb0804bad0f3bcac7fe2f34f363640e71204e8b7dfa4064d44ac5019","observation_id":"cf3c0c62-0b42-40ad-be5e-bfb366a4a03f","resolution":{"observed_at":"2026-08-16T12:16:50.475141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.479564Z","title":"Simplicity prevails: Rethinking negative preference optimization for llm unlearning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.479564Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:fe5bcc7620fc5fe9538b227f07b7021a9a43b973112833fc7a6c11008907d0eb","observation_id":"b9887c82-02f7-4d55-b8f5-5f9075ebaf7a","resolution":{"observed_at":"2026-08-16T12:16:50.479564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:51.062976Z","title":"Influence diagnostics under self-concordance","venue":null,"work_id":"a94a5330-31d0-4e99-b89f-e269e6b500be","year":2023},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.483212Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:5e70f1b6665735598cf9b49876ba272ee88eab341c7a417b3c0fdf4256699194","observation_id":"5b099f05-5c9b-4d8c-bc70-376882c974db","resolution":{"observed_at":"2026-08-16T12:16:51.066715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10223","last_updated":"2025-03-03T01:21:39Z","snapshot_observed_at":"2026-08-16T13:34:22.588125Z","submitted_at":"2024-07-14T14:26:17Z","title":"On Large Language Model Continual Unlearning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10223","snapshot_observed_at":"2026-08-16T12:16:50.486527Z","title":"Practical unlearning for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.486527Z"},"links":{"cited_paper":"/paper/2407.10223","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:a41538af5c179ffb7aabd0d36100cf97ac7f6b308555f02a9965ca84ebec312a","observation_id":"13a486ec-55c1-447d-be37-7ed73d15a3c7","resolution":{"observed_at":"2026-08-16T12:16:50.486527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-16T12:16:50.490600Z","title":"The pile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.490600Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:b2fd93bdf044084cd6696715d55a7ebd36f6bd59a63e7f4da3fcf7b0db507488","observation_id":"230e07f0-3e3d-4507-b6c6-131e52994763","resolution":{"observed_at":"2026-08-16T12:16:50.490600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.494527Z","title":"An investigation into neural net optimization via hessian eigenvalue density","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.494527Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:8008a6c0b98a75c57d5dd24aefd8620c197166d1b51aedc66b6f758ea71254f3","observation_id":"015d3fa2-f189-4947-9692-bb00fc77f2cf","resolution":{"observed_at":"2026-08-16T12:16:50.494527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.498136Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.498136Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:b6957dfaa16b6dd7eb0eb43434bc7527ed6028b0f68c88e82a754d3a38f59e9f","observation_id":"33663510-1136-4a80-9708-72862bbd5c5a","resolution":{"observed_at":"2026-08-16T12:16:50.498136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-16T12:16:50.501304Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.501304Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:3f891a88cf9c80b07742e049c929c433643c4ad25d2c5d10be61ed86ab4a4b4f","observation_id":"8f0d1ea4-08e1-42ca-97e3-2679fea317fb","resolution":{"observed_at":"2026-08-16T12:16:50.501304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:51.037981Z","title":"Jogging the memory of unlearned models through targeted relearning attacks","venue":null,"work_id":"578b69bd-22b9-4632-ba6f-292920c5f5e6","year":2024},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.504471Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:38f3ab792bde32488f33a074aaca51e7dd1a5a6831c179b17e9e8d98a5a08192","observation_id":"44e31fba-65c4-46d0-a711-5987a513a2e7","resolution":{"observed_at":"2026-08-16T12:16:51.042364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08607","last_updated":"2024-06-12T19:26:35Z","snapshot_observed_at":"2026-08-17T21:00:09.164783Z","submitted_at":"2024-06-12T19:26:35Z","title":"Reversing the Forget-Retain Objectives: An Efficient LLM Unlearning Framework from Logit Difference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08607","snapshot_observed_at":"2026-08-16T12:16:50.508668Z","title":"R., Liu, S., and Chang, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.508668Z"},"links":{"cited_paper":"/paper/2406.08607","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:6b9852ea75a1464f33df4fd171a1ddae4e9d3d6aa73d3130f01ab01318b6b578","observation_id":"c66d339d-2884-458e-ac76-43e5ec22ac64","resolution":{"observed_at":"2026-08-16T12:16:50.508668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17357","last_updated":"2024-09-25T21:05:35Z","snapshot_observed_at":"2026-08-17T20:16:00.627483Z","submitted_at":"2024-09-25T21:05:35Z","title":"Revisiting inverse Hessian vector products for calculating influence functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17357","snapshot_observed_at":"2026-08-16T12:16:50.511926Z","title":"and Liu, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.511926Z"},"links":{"cited_paper":"/paper/2409.17357","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:3298c09c0a79d0f194cc94176377e6f5595832f2cfdc92fa005ecb6a3efd030b","observation_id":"40d13760-1920-421f-87bb-abe778f3e9d9","resolution":{"observed_at":"2026-08-16T12:16:50.511926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.514626Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.514626Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:e5f95554bc5ea216d78cd6f7aba4a5358b2c8130e6b7c2487b846d430b71a39c","observation_id":"08af71f4-d3b8-4179-830a-240667abc47a","resolution":{"observed_at":"2026-08-16T12:16:50.514626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.516994Z","title":"Limitations of the empirical fisher approximation for natural gradient descent","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.516994Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:5b76ff50a554a9b7dd05d2fb0716c0b9fe13dac1f29c3b5a5296f09a87c0faa6","observation_id":"c9e72387-b273-42ea-a659-eb323c9eea43","resolution":{"observed_at":"2026-08-16T12:16:50.516994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03218","last_updated":"2024-05-15T19:16:09Z","snapshot_observed_at":"2026-08-15T06:18:34.739211Z","submitted_at":"2024-03-05T18:59:35Z","title":"The WMDP Benchmark: Measuring and Reducing Malicious Use With Unlearning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03218","snapshot_observed_at":"2026-08-16T12:16:50.520149Z","title":"D., Dombrowski, A.-K., Goel, S., Phan, L., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.520149Z"},"links":{"cited_paper":"/paper/2403.03218","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:3e1e85716e115643c0f5af97e8eda62ec56c48e2e3c29273214dd7d7ac74214f","observation_id":"e536439d-a7a1-480b-9c26-86403db04f99","resolution":{"observed_at":"2026-08-16T12:16:50.520149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07933","last_updated":"2024-10-31T07:36:39Z","snapshot_observed_at":"2026-08-17T21:25:45.332072Z","submitted_at":"2024-06-12T06:56:20Z","title":"Large Language Model Unlearning via Embedding-Corrupted Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07933","snapshot_observed_at":"2026-08-16T12:16:50.522762Z","title":"Y., Wang, Y., Flanigan, J., and Liu, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.522762Z"},"links":{"cited_paper":"/paper/2406.07933","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:756169131d938e2845f126bf137c8304ed7068ba340d1ead5b9eb8f4d5bf2f0c","observation_id":"48e154c3-dcd0-417a-bce6-8313f82fabab","resolution":{"observed_at":"2026-08-16T12:16:50.522762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-16T12:16:50.525200Z","title":"Fixing weight decay regularization in adam","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.525200Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:da28172d53980eea337c617cab4ae6f11cd013491984577c8e3d6132141a1cc7","observation_id":"c0cd3889-d6a6-4ff7-a552-a318499d9ff0","resolution":{"observed_at":"2026-08-16T12:16:50.525200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:51.014275Z","title":"Unlearning via RMU is mostly shallow","venue":null,"work_id":"8a145e0b-636b-422b-bcf6-60e2f26ad706","year":2024},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.527545Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:b6090bfa4484c057d8e9309e48d99c637fee64872292e3dfd4e8c4758125694b","observation_id":"585cebfe-0a94-46e3-ba79-8800d861b2d4","resolution":{"observed_at":"2026-08-16T12:16:51.018184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06121","last_updated":"2024-01-11T18:57:12Z","snapshot_observed_at":"2026-08-16T14:08:04.457126Z","submitted_at":"2024-01-11T18:57:12Z","title":"TOFU: A Task of Fictitious Unlearning for LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06121","snapshot_observed_at":"2026-08-16T12:16:50.530058Z","title":"C., and Kolter, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.530058Z"},"links":{"cited_paper":"/paper/2401.06121","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:f37e8399fa05b4d21a7628caa48b281355934bfbd26f16e39d483515a0689d7e","observation_id":"4230f4ca-4efa-41bb-ac5f-87cf2a808473","resolution":{"observed_at":"2026-08-16T12:16:50.530058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.533198Z","title":"New insights and perspectives on the natural gradient method","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.533198Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:235e6c0b16c488a18b99dc27fa1edebc7a45870de195bd0bf7d7cb2305c911bd","observation_id":"14ea4f1c-7b87-412e-abc9-2e8282e9cdba","resolution":{"observed_at":"2026-08-16T12:16:50.533198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.536843Z","title":null,"venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.536843Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:64f2ec85cffe007dceb3898bb1ce6bd535eaecdda2c9ed5d63bb020faa0fd064","observation_id":"848688cb-b357-4c92-a763-4af08d094a70","resolution":{"observed_at":"2026-08-16T12:16:50.536843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.991849Z","title":null,"venue":null,"work_id":"9eba0514-ecf2-4ea6-a9bd-bfe86c6b6293","year":1964},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.540711Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:f4d46acbd63001c34342723530550593ddc5af8ad60fb886aee9205f72a2cf06","observation_id":"2d7b4074-bc80-44fc-88f0-60ae0fbf2b82","resolution":{"observed_at":"2026-08-16T12:16:50.995129Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.543657Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.543657Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:900860af79985a000e64379e39e408eae5a5c0f3ae27ef8151784baddac0bed5","observation_id":"066ad914-3ddb-4e3b-89a1-de4a69cc0fb3","resolution":{"observed_at":"2026-08-16T12:16:50.543657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16789","last_updated":"2024-03-09T22:26:06Z","snapshot_observed_at":"2026-08-08T18:07:29.632928Z","submitted_at":"2023-10-25T17:21:23Z","title":"Detecting Pretraining Data from Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16789","snapshot_observed_at":"2026-08-16T12:16:50.547341Z","title":"Detecting pretraining data from large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.547341Z"},"links":{"cited_paper":"/paper/2310.16789","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:e3f3b83ea2f75679098cd84ba349b5ccb38f597233d67b53eb99eac713f8a536","observation_id":"89f70015-20ba-43ea-beaa-ca74ae5f95d0","resolution":{"observed_at":"2026-08-16T12:16:50.547341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06460","last_updated":"2024-07-14T20:14:02Z","snapshot_observed_at":"2026-08-16T13:35:57.672523Z","submitted_at":"2024-07-08T23:47:29Z","title":"MUSE: Machine Unlearning Six-Way Evaluation for Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06460","snapshot_observed_at":"2026-08-16T12:16:50.551418Z","title":"A., and Zhang, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.551418Z"},"links":{"cited_paper":"/paper/2407.06460","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:5011a56c448e707163469074c87e32babd1944db89dae21389e625ff1b83294b","observation_id":"c1deea37-69a1-4a89-bc16-d9cdb1945884","resolution":{"observed_at":"2026-08-16T12:16:50.551418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.555336Z","title":"and Valpola, H","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.555336Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:7a7d22710d0b8e0106c7e216fcbec95b22dd02476e9aeaec38f977adbdc4450c","observation_id":"decad587-0bde-42c1-ad46-7f4c86153b57","resolution":{"observed_at":"2026-08-16T12:16:50.555336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02879","last_updated":"2025-04-08T17:18:21Z","snapshot_observed_at":"2026-08-17T20:16:19.623129Z","submitted_at":"2024-10-03T18:07:25Z","title":"Position: LLM Unlearning Benchmarks are Weak Measures of Progress","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02879","snapshot_observed_at":"2026-08-16T12:16:50.558814Z","title":"S., and Smith, V","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.558814Z"},"links":{"cited_paper":"/paper/2410.02879","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:276a217968439e1f87d1c144ddbf33c6ef818567bbb4e0c5f6a611632c36cdb4","observation_id":"51e286be-ad48-4e22-8da1-734d488dc8d6","resolution":{"observed_at":"2026-08-16T12:16:50.558814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03329","last_updated":"2024-06-11T15:47:39Z","snapshot_observed_at":"2026-08-16T15:21:16.503322Z","submitted_at":"2024-03-05T21:19:06Z","title":"Guardrail Baselines for Unlearning in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03329","snapshot_observed_at":"2026-08-16T12:16:50.562372Z","title":"Guardrail baselines for unlearning in llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.562372Z"},"links":{"cited_paper":"/paper/2403.03329","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:ea277651c603ba2c0374b88950968baf70bc23a6570d680a2c1fea22c8c9413f","observation_id":"7cde0ba4-8785-47ea-ab87-07191525a08e","resolution":{"observed_at":"2026-08-16T12:16:50.562372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.565852Z","title":"Unrolling sgd: Understanding factors influencing machine unlearning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.565852Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:deca1f219344a3e71036e765649cb8f31220bea5334884f87a62424267eb389d","observation_id":"a90b9a11-bbb0-4513-9936-545499c4d0e8","resolution":{"observed_at":"2026-08-16T12:16:50.565852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.961320Z","title":"OpenAI , I","venue":null,"work_id":"f76b6ed3-7764-4d51-82dd-a38432910d8c","year":2023},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.568917Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:50c242218071f957d5e09bd400a34d362d6e468d1131648cad8b84dce1f6ed47","observation_id":"b5c76e88-6828-4b5b-9d54-6a1a215222d0","resolution":{"observed_at":"2026-08-16T12:16:50.965505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11143","last_updated":"2024-10-14T23:43:33Z","snapshot_observed_at":"2026-08-18T21:16:18.607862Z","submitted_at":"2024-10-14T23:43:33Z","title":"LLM Unlearning via Loss Adjustment with Only Forget Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11143","snapshot_observed_at":"2026-08-16T12:16:50.572931Z","title":"Y., Pang, J., Liu, Q., Shah, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.572931Z"},"links":{"cited_paper":"/paper/2410.11143","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:ccf66342c476c78d68d8f7f4c0346e91ecb66e51cf1489ab694f39ed91a399f5","observation_id":"120a6ed5-84c5-4524-81ca-967f947bd1a3","resolution":{"observed_at":"2026-08-16T12:16:50.572931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09117","last_updated":"2025-06-05T13:34:42Z","snapshot_observed_at":"2026-08-17T23:10:26.571292Z","submitted_at":"2025-03-12T07:08:54Z","title":"GRU: Mitigating the Trade-off between Unlearning and Retention for LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09117","snapshot_observed_at":"2026-08-16T12:16:50.577231Z","title":"Gru: Mitigating the trade-off between unlearning and retention for large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.577231Z"},"links":{"cited_paper":"/paper/2503.09117","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:95863bfc71e38f4db6fa70808eab407f9a692fae852fd980fa0ae487e4485259","observation_id":"d4c63adc-4c2e-4e9c-88df-eb9e8f176f58","resolution":{"observed_at":"2026-08-16T12:16:50.577231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10683","last_updated":"2024-02-16T19:47:36Z","snapshot_observed_at":"2026-08-18T12:31:49.489444Z","submitted_at":"2023-10-14T00:32:55Z","title":"Large Language Model Unlearning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10683","snapshot_observed_at":"2026-08-16T12:16:50.580713Z","title":"Large language model unlearning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.580713Z"},"links":{"cited_paper":"/paper/2310.10683","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:2af2d1fa5aaed7e2bb94f18756165984355f37ec974a615d0bfd1a0b7aed5402","observation_id":"0e837804-6967-457a-b4c3-812ead17d959","resolution":{"observed_at":"2026-08-16T12:16:50.580713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.584887Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.584887Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:9bf53a12254f31c215e64b94fc3451e5a5a79c0bd9777097624be6e4358cdd9e","observation_id":"516b4866-2986-4a76-8a9e-c444da27ff4b","resolution":{"observed_at":"2026-08-16T12:16:50.584887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05868","last_updated":"2024-10-10T22:00:41Z","snapshot_observed_at":"2026-07-06T17:57:27.510162Z","submitted_at":"2024-04-08T21:05:42Z","title":"Negative Preference Optimization: From Catastrophic Collapse to Effective Unlearning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05868","snapshot_observed_at":"2026-08-16T12:16:50.589422Z","title":"Negative preference optimization: From catastrophic collapse to effective unlearning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.589422Z"},"links":{"cited_paper":"/paper/2404.05868","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:3c1fc2e7ef70ae5f88f3b558bf5dfae63ecdb7d44c0c02ba0302f9f5fe6a73e1","observation_id":"1c82bf91-9c6f-4181-9717-e23aefd117ce","resolution":{"observed_at":"2026-08-16T12:16:50.589422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16454","last_updated":"2025-03-21T06:37:37Z","snapshot_observed_at":"2026-08-19T03:55:20.682101Z","submitted_at":"2024-10-21T19:28:37Z","title":"Catastrophic Failure of LLM Unlearning via Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16454","snapshot_observed_at":"2026-08-16T12:16:50.593156Z","title":"Catastrophic failure of LLM unlearning via quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.593156Z"},"links":{"cited_paper":"/paper/2410.16454","citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:d2c98788476b91e72827cbf4be34cb4c82ad5084fd8a7ac4a75312da94ec4b65","observation_id":"042d78c8-378e-46b2-8371-520cbf24ca77","resolution":{"observed_at":"2026-08-16T12:16:50.593156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.596896Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.596896Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:2e16af5ac425f59f80d6dfc9e4702b30afa6b0eb59b1707fb0795f59503d7bef","observation_id":"1e74b27c-9f72-4896-b90c-b88ad2870f72","resolution":{"observed_at":"2026-08-16T12:16:50.596896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.600850Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.600850Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:bf210840e9d82ad32bae55b116637686f0377e4d5b7b4fe2a546f03b9c8d3773","observation_id":"7b1d7bdd-e165-47ab-aa7a-f56122f8febe","resolution":{"observed_at":"2026-08-16T12:16:50.600850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:16:50.604702Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-16T12:16:50.604702Z"},"links":{"citing_paper":"/paper/2504.13388"},"observation_digest":"sha256:c6eccd0d41bba6613d9dae38823a87454fdfa06128bdabb277062624a55566d1","observation_id":"6cde11cb-1ad1-417f-b0e2-9c927aa8d5a8","resolution":{"observed_at":"2026-08-16T12:16:50.604702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.13388","last_updated":"2025-04-18T00:34:19Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T20:03:52.020509Z","submitted_at":"2025-04-18T00:34:19Z","title":"A mean teacher algorithm for unlearning of language models"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2504.13388."}