{"as_of":"2026-08-17T21:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:297c5f05e22d6029d5382d1faee4717f044cbd5a2efb9d7046fe9ab0566c403b","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:56:31.634491Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:39:08.021275Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T14:13:21.270655Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17279","snapshot_observed_at":"2026-08-05T10:39:08.021275Z","title":"Step-by-Step Reasoning Attack: Revealing ’Erased’ Knowledge in Large Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03871","last_updated":"2025-09-04T04:12:31Z","snapshot_observed_at":"2026-08-17T17:37:38.616375Z","submitted_at":"2025-09-04T04:12:31Z","title":"A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models","version":1},"reference_index":215,"source":"pdf_text","source_observed_at":"2026-08-05T10:39:08.021275Z"},"links":{"cited_paper":"/paper/2506.17279","citing_paper":"/paper/2509.03871"},"observation_digest":"sha256:f17ca904268119eab04761b4359f46a30840c13eaa00063a5a4bd0bed3195ad7","observation_id":"a956a9d4-9a7b-4fd9-9529-87d41fb15614","resolution":{"observed_at":"2026-08-05T10:39:08.021275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.17279","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17279","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"M., and Kankanhalli, M","venue":null,"work_id":"fbb95678-241c-46da-b999-b4e9951deed4","year":null},"citing_paper":{"arxiv_id":"2510.00761","last_updated":"2026-04-18T07:30:06Z","snapshot_observed_at":"2026-08-16T07:19:23.004984Z","submitted_at":"2025-10-01T10:50:14Z","title":"Downgrade to Upgrade: Optimizer Simplification Enhances Robustness in LLM Unlearning","version":5},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-18T10:44:53.516653Z"},"links":{"cited_paper":"/paper/2506.17279","citing_paper":"/paper/2510.00761"},"observation_digest":"sha256:f08942beb815d261f700be2cd8af4359af92f45909fcfa645f822ece5aaf1ca9","observation_id":"db9a6592-5d7f-4966-bf8f-5cbc40517d7c","resolution":{"observed_at":"2026-05-18T10:46:17.063339Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.17279","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17279","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"M., and Kankanhalli, M","venue":null,"work_id":"fbb95678-241c-46da-b999-b4e9951deed4","year":null},"citing_paper":{"arxiv_id":"2605.18891","last_updated":"2026-05-17T05:22:27Z","snapshot_observed_at":"2026-08-12T15:49:44.729844Z","submitted_at":"2026-05-17T05:22:27Z","title":"Auditing Reasoning-Trace Memorization Claims after Unlearning with Head-Conditioned Canaries","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T14:10:50.885027Z"},"links":{"cited_paper":"/paper/2506.17279","citing_paper":"/paper/2605.18891"},"observation_digest":"sha256:10949ff97b514390e6e5d0436001ff6896591e504034201db1990f193d6d1897","observation_id":"720ea40d-07bb-423f-8a62-a48eff257b4d","resolution":{"observed_at":"2026-05-20T14:13:21.272205Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.17279/citation-record","integrity":"/paper/2506.17279/integrity","json":"/paper/2506.17279/citation-record.json","paper":"/paper/2506.17279"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.08827","last_updated":"2025-02-07T16:27:48Z","snapshot_observed_at":"2026-08-16T13:10:19.359841Z","submitted_at":"2024-10-11T14:06:58Z","title":"Do Unlearning Methods Remove Information from Language Model Weights?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08827","snapshot_observed_at":"2026-08-07T00:56:31.527816Z","title":"Do unlearning methods remove information from language model weights? arXiv preprint arXiv:2410.08827,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.527816Z"},"links":{"cited_paper":"/paper/2410.08827","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:f86d4c1c6626427dc359454c71eb729cbb344854dd47bb689be9506bf36c30e6","observation_id":"bdc8e59c-a7b5-4908-9109-9b292287dc29","resolution":{"observed_at":"2026-08-07T00:56:31.527816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12949","last_updated":"2024-12-05T02:55:35Z","snapshot_observed_at":"2026-08-16T13:08:41.525950Z","submitted_at":"2024-10-16T18:35:02Z","title":"Mechanistic Unlearning: Robust Knowledge Unlearning and Editing via Mechanistic Localization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12949","snapshot_observed_at":"2026-08-07T00:56:31.537395Z","title":"Who’s harry potter? approximate unlearning for llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.537395Z"},"links":{"cited_paper":"/paper/2410.12949","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:4276dac3cad52e0925ea9daab1be0c6c7a74bf2f3bcf93e1a33918faac798f87","observation_id":"02947c08-5ca2-44d0-86cb-7613044fa35a","resolution":{"observed_at":"2026-08-07T00:56:31.537395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11614","last_updated":"2025-09-01T18:50:34Z","snapshot_observed_at":"2026-08-16T13:42:13.984721Z","submitted_at":"2024-06-17T15:00:35Z","title":"Intrinsic Test of Unlearning Using Parametric Knowledge Traces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11614","snapshot_observed_at":"2026-08-07T00:56:31.542059Z","title":"Intrinsic evaluation of unlearning using parametric knowledge traces","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.542059Z"},"links":{"cited_paper":"/paper/2406.11614","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:0d2c0f097af84a2266db2db02586bce3be0aea8505a87370f56c527c63b8b0fe","observation_id":"f77c2003-eba1-430b-a78a-010de4ae4e1f","resolution":{"observed_at":"2026-08-07T00:56:31.542059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13356","last_updated":"2025-03-17T07:46:49Z","snapshot_observed_at":"2026-08-16T13:41:32.655911Z","submitted_at":"2024-06-19T09:03:21Z","title":"Unlearning or Obfuscating? Jogging the Memory of Unlearned LLMs via Benign Relearning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13356","snapshot_observed_at":"2026-08-07T00:56:31.546933Z","title":"Jogging the memory of unlearned llms through targeted relearning attacks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.546933Z"},"links":{"cited_paper":"/paper/2406.13356","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:d2be708688049a573e7b118028893c20973a464812122c9a56ef0ad973f555df","observation_id":"8b8d6f30-4f26-4db6-aaab-f247156245e1","resolution":{"observed_at":"2026-08-07T00:56:31.546933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06223","last_updated":"2025-02-06T02:25:18Z","snapshot_observed_at":"2026-08-16T13:26:59.191703Z","submitted_at":"2024-08-12T15:24:50Z","title":"On Effects of Steering Latent Representation for Large Language Model Unlearning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06223","snapshot_observed_at":"2026-08-07T00:56:31.551842Z","title":"On effects of steering latent representation for large language model unlearning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.551842Z"},"links":{"cited_paper":"/paper/2408.06223","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:ced970dbf3e33b66a90bf06ca046c79d152337cec6c1e9d404230b9f0ff86b06","observation_id":"56a68388-89da-41c6-ba31-0d16da8edfdb","resolution":{"observed_at":"2026-08-07T00:56:31.551842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01504","last_updated":"2022-12-19T11:52:40Z","snapshot_observed_at":"2026-08-16T16:27:04.380829Z","submitted_at":"2022-10-04T10:18:11Z","title":"Knowledge Unlearning for Mitigating Privacy Risks in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01504","snapshot_observed_at":"2026-08-07T00:56:31.556982Z","title":"Knowledge unlearning for mitigating privacy risks in language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.556982Z"},"links":{"cited_paper":"/paper/2210.01504","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:b447c052fc6140df8632ee8eeb77d721f8a6beff8e8ee953a3e509fad81bbdb4","observation_id":"361f8a32-4eee-409d-9ea1-fe5c2f0c8023","resolution":{"observed_at":"2026-08-07T00:56:31.556982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17509","last_updated":"2025-04-12T21:23:46Z","snapshot_observed_at":"2026-08-16T13:06:47.311518Z","submitted_at":"2024-10-23T02:22:07Z","title":"WAGLE: Strategic Weight Attribution for Effective and Modular Unlearning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17509","snapshot_observed_at":"2026-08-07T00:56:31.561334Z","title":"Under review","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.561334Z"},"links":{"cited_paper":"/paper/2410.17509","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:e5ad407ae9429f928e0b96cedd028722525859afd15a4bbf2a66f52d6436e503","observation_id":"d9edc7df-58a0-4387-9c96-75a07e6a84bd","resolution":{"observed_at":"2026-08-07T00:56:31.561334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18025","last_updated":"2025-05-31T19:22:41Z","snapshot_observed_at":"2026-08-16T13:15:03.296869Z","submitted_at":"2024-09-26T16:32:19Z","title":"An Adversarial Perspective on Machine Unlearning for AI Safety","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18025","snapshot_observed_at":"2026-08-07T00:56:31.574139Z","title":"An adversarial perspective on machine unlearning for ai safety","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.574139Z"},"links":{"cited_paper":"/paper/2409.18025","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:395f5f11af79c590511b65a078e78f7f632ae52d4600009efbe91d0b5d5c3ff6","observation_id":"97392904-e4f6-4862-91f5-2e0fae35a55f","resolution":{"observed_at":"2026-08-07T00:56:31.574139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16835","last_updated":"2024-02-26T18:57:37Z","snapshot_observed_at":"2026-08-16T14:15:11.368083Z","submitted_at":"2024-02-26T18:57:37Z","title":"Eight Methods to Evaluate Robust Unlearning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16835","snapshot_observed_at":"2026-08-07T00:56:31.579425Z","title":"Eight methods to evaluate robust unlearning in llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.579425Z"},"links":{"cited_paper":"/paper/2402.16835","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:f8013a771f1b7e17894cc4129e608ed6a934a8c847aed836476b9c930f3de609","observation_id":"978c6968-bb87-44a6-88ef-92275a37f82d","resolution":{"observed_at":"2026-08-07T00:56:31.579425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17410","last_updated":"2023-09-29T17:12:43Z","snapshot_observed_at":"2026-08-16T14:56:26.138498Z","submitted_at":"2023-09-29T17:12:43Z","title":"Can Sensitive Information Be Deleted From LLMs? Objectives for Defending Against Extraction Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17410","snapshot_observed_at":"2026-08-07T00:56:31.588211Z","title":"Can sensitive information be deleted from llms? objectives for defending against extraction attacks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.588211Z"},"links":{"cited_paper":"/paper/2309.17410","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:52bb005773881fb78e90ac4839b79ef66cfdb850fa698989d5069ed65e151e2e","observation_id":"fe641c6d-bf13-4359-9fbe-835593427b04","resolution":{"observed_at":"2026-08-07T00:56:31.588211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07579","last_updated":"2024-06-06T06:31:08Z","snapshot_observed_at":"2026-08-17T21:29:04.285766Z","submitted_at":"2023-10-11T15:19:31Z","title":"In-Context Unlearning: Language Models as Few Shot Unlearners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07579","snapshot_observed_at":"2026-08-07T00:56:31.592736Z","title":"In-context unlearning: Language models as few shot unlearners","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.592736Z"},"links":{"cited_paper":"/paper/2310.07579","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:5aa587a42a2e8ed212eeedf64b08797a950c814ace903a279f6214160a8f1ef7","observation_id":"8da2733b-f91e-450c-97a0-ffd03518c0a9","resolution":{"observed_at":"2026-08-07T00:56:31.592736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15549","last_updated":"2025-07-29T09:37:22Z","snapshot_observed_at":"2026-08-16T13:32:11.184868Z","submitted_at":"2024-07-22T11:19:14Z","title":"Latent Adversarial Training Improves Robustness to Persistent Harmful Behaviors in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15549","snapshot_observed_at":"2026-08-07T00:56:31.597065Z","title":"Latent adversarial training improves robustness to persistent harmful behaviors in llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.597065Z"},"links":{"cited_paper":"/paper/2407.15549","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:9cb6eb4af26f784a11a44d4f083029b54275bc98214951bff8ee6cd252b07938","observation_id":"fa1ed3a2-4b3b-4bf8-8531-354b349b83b2","resolution":{"observed_at":"2026-08-07T00:56:31.597065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17050","last_updated":"2024-10-22T14:30:03Z","snapshot_observed_at":"2026-08-16T13:06:58.497799Z","submitted_at":"2024-10-22T14:30:03Z","title":"UnStar: Unlearning with Self-Taught Anti-Sample Reasoning for LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17050","snapshot_observed_at":"2026-08-07T00:56:31.601190Z","title":"Unstar: Unlearning with self-taught anti-sample reasoning for llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.601190Z"},"links":{"cited_paper":"/paper/2410.17050","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:3a72d3392c2aa0f5d04aab512aada9ad9797a032a6ac9fd72323ec5fb2563afe","observation_id":"a31b78f2-c335-4ec7-ac2d-52202a74f28b","resolution":{"observed_at":"2026-08-07T00:56:31.601190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00761","last_updated":"2025-02-10T18:26:14Z","snapshot_observed_at":"2026-08-16T13:29:08.472050Z","submitted_at":"2024-08-01T17:59:12Z","title":"Tamper-Resistant Safeguards for Open-Weight LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00761","snapshot_observed_at":"2026-08-07T00:56:31.605239Z","title":"Under review","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.605239Z"},"links":{"cited_paper":"/paper/2408.00761","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:270c95fc1bec08f5196ab6f9ef86efbf9e519c12d676853de4ad28595875ee64","observation_id":"a075f13e-8f9b-48b1-990d-36327b68a518","resolution":{"observed_at":"2026-08-07T00:56:31.605239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03329","last_updated":"2024-06-11T15:47:39Z","snapshot_observed_at":"2026-08-16T15:21:16.503322Z","submitted_at":"2024-03-05T21:19:06Z","title":"Guardrail Baselines for Unlearning in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03329","snapshot_observed_at":"2026-08-07T00:56:31.609281Z","title":"Guardrail baselines for unlearning in llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.609281Z"},"links":{"cited_paper":"/paper/2403.03329","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:65a420d62e1c27214c6c40af34255cbc2a673a4882d8971ab9803d52013a79b3","observation_id":"a8f9395b-f403-41bb-9ab1-90b50e17e52b","resolution":{"observed_at":"2026-08-07T00:56:31.609281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01983","last_updated":"2024-06-04T05:51:43Z","snapshot_observed_at":"2026-08-16T13:46:26.354067Z","submitted_at":"2024-06-04T05:51:43Z","title":"RKLD: Reverse KL-Divergence-based Knowledge Distillation for Unlearning Personal Information in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01983","snapshot_observed_at":"2026-08-07T00:56:31.613263Z","title":"Rkld: Reverse kl-divergence- based knowledge distillation for unlearning personal information in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.613263Z"},"links":{"cited_paper":"/paper/2406.01983","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:6d643f1c50ae95fab4be5b285c0115cfed1c92b309c13c7e13a91552c88fe85d","observation_id":"7297988f-0490-4414-81ec-4e5c231f4afc","resolution":{"observed_at":"2026-08-07T00:56:31.613263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15159","last_updated":"2024-05-30T15:44:51Z","snapshot_observed_at":"2026-08-17T08:25:32.062258Z","submitted_at":"2024-02-23T07:43:26Z","title":"Machine Unlearning of Pre-trained Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15159","snapshot_observed_at":"2026-08-07T00:56:31.621944Z","title":"Machine unlearning of pre-trained large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.621944Z"},"links":{"cited_paper":"/paper/2402.15159","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:1ab6307325c3fe7a65421e0687fb13c1b31e861269ffaafe67fa13c8cd3d6d98","observation_id":"c7869cbf-9904-4d29-8fe1-05e08742e9da","resolution":{"observed_at":"2026-08-07T00:56:31.621944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08109","last_updated":"2025-08-10T02:49:05Z","snapshot_observed_at":"2026-08-16T13:10:37.588222Z","submitted_at":"2024-10-10T16:56:05Z","title":"A Closer Look at Machine Unlearning for Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08109","snapshot_observed_at":"2026-08-07T00:56:31.626205Z","title":"A closer look at machine unlearning for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.626205Z"},"links":{"cited_paper":"/paper/2410.08109","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:cf347a94d30b5adc6b23112f314204eed38d0bac9825122248cfcbd316c5fa09","observation_id":"9653f7ae-a93f-44f8-8e55-67e2c55d42d7","resolution":{"observed_at":"2026-08-07T00:56:31.626205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05868","last_updated":"2024-10-10T22:00:41Z","snapshot_observed_at":"2026-07-06T17:57:27.510162Z","submitted_at":"2024-04-08T21:05:42Z","title":"Negative Preference Optimization: From Catastrophic Collapse to Effective Unlearning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05868","snapshot_observed_at":"2026-08-07T00:56:31.630394Z","title":"Negative preference optimization: From catastrophic collapse to effective unlearning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.630394Z"},"links":{"cited_paper":"/paper/2404.05868","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:8e45eb86b4c5fb1426a58878f8a7652b373d58835b0e644770913ed5deb4d65c","observation_id":"0c27cbc1-2030-4101-be4d-824e2aef4e9f","resolution":{"observed_at":"2026-08-07T00:56:31.630394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:32.039428Z","title":"Harry Potter and the Philosopher 's Stone","venue":null,"work_id":"57ab1252-0267-4397-9dd4-8da08cea372d","year":1991},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.634491Z"},"links":{"citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:934ecc09b6a7986fe4946aa58fe2de162d7cb78b4855cb2ef8dbec8fe952ebbf","observation_id":"fe3ca931-590b-402e-badc-7c0433c9f1dc","resolution":{"observed_at":"2026-08-07T00:56:32.043817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20138","last_updated":"2023-12-05T16:14:24Z","snapshot_observed_at":"2026-08-16T14:47:23.755604Z","submitted_at":"2023-10-31T03:09:36Z","title":"DEPN: Detecting and Editing Privacy Neurons in Pretrained Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20138","snapshot_observed_at":"2026-08-07T00:56:31.617645Z","title":"Depn: Detecting and editing privacy neurons in pretrained language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.617645Z"},"links":{"cited_paper":"/paper/2310.20138","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:801867a85250052a468bca26c3bff10e1418825d5361619442bbb88094a9b8cd","observation_id":"b0eeba5d-c419-48ce-8f02-52dd2272fcce","resolution":{"observed_at":"2026-08-07T00:56:31.617645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01814","last_updated":"2024-01-03T16:15:57Z","snapshot_observed_at":"2026-08-16T14:30:03.647547Z","submitted_at":"2024-01-03T16:15:57Z","title":"Large Language Models Relearn Removed Concepts","version":1},"cited_work":{"arxiv_id":"2401.01814","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.01814","snapshot_observed_at":"2026-08-07T00:56:31.887028Z","title":"Large Language Models Relearn Removed Concepts","venue":"cs.AI","work_id":"1016dac7-a7b5-4d2a-8042-f39cc3b487fa","year":2024},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.569889Z"},"links":{"cited_paper":"/paper/2401.01814","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:ef6d70bad0b45269a54a369f03c381767886865125922c59eed5173984868e19","observation_id":"adab6b89-3101-4e7b-af52-fb0761ecab07","resolution":{"observed_at":"2026-08-07T00:56:31.893913Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03218","last_updated":"2024-05-15T19:16:09Z","snapshot_observed_at":"2026-08-15T06:18:34.739211Z","submitted_at":"2024-03-05T18:59:35Z","title":"The WMDP Benchmark: Measuring and Reducing Malicious Use With Unlearning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03218","snapshot_observed_at":"2026-08-07T00:56:31.565579Z","title":"The wmdp benchmark: Measuring and reducing malicious use with unlearning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.565579Z"},"links":{"cited_paper":"/paper/2403.03218","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:0c1cd09a6bb43f5a9a258c2207b42b8c068e027b89e89e9c1e186e87317dd01e","observation_id":"1264694a-a6e3-4e3c-8563-3c883efaee09","resolution":{"observed_at":"2026-08-07T00:56:31.565579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10052","last_updated":"2024-10-16T11:50:27Z","snapshot_observed_at":"2026-08-16T14:18:15.899014Z","submitted_at":"2024-02-15T16:21:14Z","title":"UNDIAL: Self-Distillation with Adjusted Logits for Robust Unlearning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10052","snapshot_observed_at":"2026-08-07T00:56:31.532882Z","title":"Undial: Self-distillation with adjusted logits for robust unlearning in large language models.arXiv preprint arXiv:2402.10052,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.532882Z"},"links":{"cited_paper":"/paper/2402.10052","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:00db4126333b415fa659290f368175118e4acd9dbb56a56def7d00e534bea242","observation_id":"5517323e-66d1-4394-acfb-2d87c6448f53","resolution":{"observed_at":"2026-08-07T00:56:31.532882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06121","last_updated":"2024-01-11T18:57:12Z","snapshot_observed_at":"2026-08-16T14:08:04.457126Z","submitted_at":"2024-01-11T18:57:12Z","title":"TOFU: A Task of Fictitious Unlearning for LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06121","snapshot_observed_at":"2026-08-07T00:56:31.583991Z","title":"Tofu: A task of fictitious unlearning for llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.583991Z"},"links":{"cited_paper":"/paper/2401.06121","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:664c4f8dfaafda1327a69a0ba337d7fcafc8a850202a81f8187214ca252d1e2f","observation_id":"fbab28a2-d095-43d5-86cb-bb37dfc44c79","resolution":{"observed_at":"2026-08-07T00:56:31.583991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-10T22:53:22.399571Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 3 inbound Pith citation observations for arXiv:2506.17279."}