{"as_of":"2026-08-10T00:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cf5602b928744c09d5fa0f8284e24d9f85734de75e52d9a1b712f230ededd687","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:58:29.726809Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T21:05:04.078784Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.01586","last_updated":"2025-03-17T17:17:16Z","snapshot_observed_at":"2026-08-05T01:27:27.177475Z","submitted_at":"2024-09-03T03:59:22Z","title":"Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation","version":4},"cited_work":{"arxiv_id":"2409.01586","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.01586","snapshot_observed_at":"2026-06-30T21:05:04.078784Z","title":"F., and Liu, L","venue":null,"work_id":"69d29cc3-19fc-41a7-acf3-dbf4cb347928","year":2024},"citing_paper":{"arxiv_id":"2409.18169","last_updated":"2026-04-23T18:48:49Z","snapshot_observed_at":"2026-07-06T19:22:58.341345Z","submitted_at":"2024-09-26T17:55:22Z","title":"Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey","version":6},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-23T20:58:16.237327Z"},"links":{"cited_paper":"/paper/2409.01586","citing_paper":"/paper/2409.18169"},"observation_digest":"sha256:24355fcc1f491c7e9fa3db20f8449fd94f5c0b0073c61ea7bdab8a628670e86e","observation_id":"93af6967-16e1-40b8-8330-285e22e4bfa0","resolution":{"observed_at":"2026-05-23T20:58:26.165122Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01586","last_updated":"2025-03-17T17:17:16Z","snapshot_observed_at":"2026-08-05T01:27:27.177475Z","submitted_at":"2024-09-03T03:59:22Z","title":"Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation","version":4},"cited_work":{"arxiv_id":"2409.01586","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.01586","snapshot_observed_at":"2026-06-30T21:05:04.078784Z","title":"F., and Liu, L","venue":null,"work_id":"69d29cc3-19fc-41a7-acf3-dbf4cb347928","year":2024},"citing_paper":{"arxiv_id":"2502.05206","last_updated":"2026-04-14T16:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-02T05:14:22Z","title":"Safety at Scale: A Comprehensive Survey of Large Model and Agent Safety","version":6},"reference_index":121,"source":"pdf_text","source_observed_at":"2026-05-23T04:39:04.591722Z"},"links":{"cited_paper":"/paper/2409.01586","citing_paper":"/paper/2502.05206"},"observation_digest":"sha256:b37634f8e4eb0c69550b2d2b6982a64c226a1f675e252783270b940a2ea17021","observation_id":"730e1b8c-f0d2-4475-a877-ecd165e9bca3","resolution":{"observed_at":"2026-05-23T04:42:33.745007Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01586","last_updated":"2025-03-17T17:17:16Z","snapshot_observed_at":"2026-08-05T01:27:27.177475Z","submitted_at":"2024-09-03T03:59:22Z","title":"Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation","version":4},"cited_work":{"arxiv_id":"2409.01586","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.01586","snapshot_observed_at":"2026-06-30T21:05:04.078784Z","title":"F., and Liu, L","venue":null,"work_id":"69d29cc3-19fc-41a7-acf3-dbf4cb347928","year":2024},"citing_paper":{"arxiv_id":"2505.16737","last_updated":"2026-04-23T08:31:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-22T14:52:10Z","title":"Secure LLM Fine-Tuning via Safety-Aware Probing","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T13:07:09.402763Z"},"links":{"cited_paper":"/paper/2409.01586","citing_paper":"/paper/2505.16737"},"observation_digest":"sha256:3a674c7bb35b724d3446607b66edcc4de2e7a6ba8da7884b3c910576d5b63600","observation_id":"9e4699fb-d4ab-4a02-8f2d-b0fbe064a521","resolution":{"observed_at":"2026-05-22T13:11:35.859103Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01586","last_updated":"2025-03-17T17:17:16Z","snapshot_observed_at":"2026-08-05T01:27:27.177475Z","submitted_at":"2024-09-03T03:59:22Z","title":"Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01586","snapshot_observed_at":"2026-08-07T10:58:29.726809Z","title":"F., and Liu, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-08T08:07:29.820388Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:29.726809Z"},"links":{"cited_paper":"/paper/2409.01586","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:ba5677348802bc081fc11c9b2ab7643b92cea83c27c16ddf58eb6c01965fb3c3","observation_id":"432e1bfa-79a9-4200-a759-08918ef0de8c","resolution":{"observed_at":"2026-08-07T10:58:29.726809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01586","last_updated":"2025-03-17T17:17:16Z","snapshot_observed_at":"2026-08-05T01:27:27.177475Z","submitted_at":"2024-09-03T03:59:22Z","title":"Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation","version":4},"cited_work":{"arxiv_id":"2409.01586","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.01586","snapshot_observed_at":"2026-06-30T21:05:04.078784Z","title":"F., and Liu, L","venue":null,"work_id":"69d29cc3-19fc-41a7-acf3-dbf4cb347928","year":2024},"citing_paper":{"arxiv_id":"2508.20697","last_updated":"2026-08-04T09:31:07Z","snapshot_observed_at":"2026-08-07T23:09:05.524726Z","submitted_at":"2025-08-28T12:07:11Z","title":"Token Buncher: Shielding LLMs from Harmful Reinforcement Learning Fine-Tuning","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-18T20:40:44.496392Z"},"links":{"cited_paper":"/paper/2409.01586","citing_paper":"/paper/2508.20697"},"observation_digest":"sha256:f694ca8db9a0c6d66545cbd61f3fee1fc564e6750933495599b48a4a54d4db0c","observation_id":"c3e88d80-0562-4312-a7f4-06d60523dc35","resolution":{"observed_at":"2026-05-18T20:41:50.562505Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01586","last_updated":"2025-03-17T17:17:16Z","snapshot_observed_at":"2026-08-05T01:27:27.177475Z","submitted_at":"2024-09-03T03:59:22Z","title":"Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01586","snapshot_observed_at":"2026-08-04T23:10:21.153674Z","title":"Booster: Tackling harmful fine-tuning for large language models via attenuating harmful perturbation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06795","last_updated":"2025-09-08T15:24:33Z","snapshot_observed_at":"2026-08-06T11:18:33.345942Z","submitted_at":"2025-09-08T15:24:33Z","title":"Anchoring Refusal Direction: Mitigating Safety Risks in Tuning via Projection Constraint","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T23:10:21.153674Z"},"links":{"cited_paper":"/paper/2409.01586","citing_paper":"/paper/2509.06795"},"observation_digest":"sha256:b54fe450ee6d6f2834c6d5e4597adfae60c445f092dbaf3cf858bac1bfa14971","observation_id":"0f8c58c5-b4a2-45ad-84ff-55c498bcb8cb","resolution":{"observed_at":"2026-08-04T23:10:21.153674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01586","last_updated":"2025-03-17T17:17:16Z","snapshot_observed_at":"2026-08-05T01:27:27.177475Z","submitted_at":"2024-09-03T03:59:22Z","title":"Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01586","snapshot_observed_at":"2026-08-04T23:09:41.485922Z","title":"Booster: Tackling harmful fine-tuning for large language models via attenuating harmful perturbation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06807","last_updated":"2025-09-08T15:39:17Z","snapshot_observed_at":"2026-08-09T10:59:34.311406Z","submitted_at":"2025-09-08T15:39:17Z","title":"MoGU V2: Toward a Higher Pareto Frontier Between Model Usability and Security","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T23:09:41.485922Z"},"links":{"cited_paper":"/paper/2409.01586","citing_paper":"/paper/2509.06807"},"observation_digest":"sha256:e20d587a14a22a9c4361c2d2ad05503942e7a22277221c9c57faf27df73c5664","observation_id":"8cfb6400-5c9e-4148-bcae-beb5aafdf18e","resolution":{"observed_at":"2026-08-04T23:09:41.485922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01586","last_updated":"2025-03-17T17:17:16Z","snapshot_observed_at":"2026-08-05T01:27:27.177475Z","submitted_at":"2024-09-03T03:59:22Z","title":"Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation","version":4},"cited_work":{"arxiv_id":"2409.01586","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.01586","snapshot_observed_at":"2026-06-30T21:05:04.078784Z","title":"F., and Liu, L","venue":null,"work_id":"69d29cc3-19fc-41a7-acf3-dbf4cb347928","year":2024},"citing_paper":{"arxiv_id":"2604.12384","last_updated":"2026-04-14T07:17:55Z","snapshot_observed_at":"2026-07-06T23:00:37.144068Z","submitted_at":"2026-04-14T07:17:55Z","title":"Preventing Safety Drift in Large Language Models via Coupled Weight and Activation Constraints","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-10T16:04:25.851592Z"},"links":{"cited_paper":"/paper/2409.01586","citing_paper":"/paper/2604.12384"},"observation_digest":"sha256:ab7a22efc366f81ed7ca0b417484271e42ff5672ec4467a8a013517288a448a4","observation_id":"9d77a97c-4df9-4c06-9fed-156425c79b0f","resolution":{"observed_at":"2026-05-11T09:21:01.793449Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01586","last_updated":"2025-03-17T17:17:16Z","snapshot_observed_at":"2026-08-05T01:27:27.177475Z","submitted_at":"2024-09-03T03:59:22Z","title":"Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation","version":4},"cited_work":{"arxiv_id":"2409.01586","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.01586","snapshot_observed_at":"2026-06-30T21:05:04.078784Z","title":"F., and Liu, L","venue":null,"work_id":"69d29cc3-19fc-41a7-acf3-dbf4cb347928","year":2024},"citing_paper":{"arxiv_id":"2604.19016","last_updated":"2026-04-21T03:06:50Z","snapshot_observed_at":"2026-07-06T23:05:44.499005Z","submitted_at":"2026-04-21T03:06:50Z","title":"AlignCultura: Towards Culturally Aligned Large Language Models?","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-10T02:36:36.854805Z"},"links":{"cited_paper":"/paper/2409.01586","citing_paper":"/paper/2604.19016"},"observation_digest":"sha256:8ff2b1868e34ef70f1093c27908e56ce3e6074a9afefbe7dca95b2143e55d29b","observation_id":"39d3deeb-87fd-4701-ad08-215b3685191a","resolution":{"observed_at":"2026-05-11T12:56:05.116988Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01586","last_updated":"2025-03-17T17:17:16Z","snapshot_observed_at":"2026-08-05T01:27:27.177475Z","submitted_at":"2024-09-03T03:59:22Z","title":"Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation","version":4},"cited_work":{"arxiv_id":"2409.01586","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.01586","snapshot_observed_at":"2026-06-30T21:05:04.078784Z","title":"F., and Liu, L","venue":null,"work_id":"69d29cc3-19fc-41a7-acf3-dbf4cb347928","year":2024},"citing_paper":{"arxiv_id":"2605.09927","last_updated":"2026-05-11T03:23:46Z","snapshot_observed_at":"2026-07-06T23:21:59.096464Z","submitted_at":"2026-05-11T03:23:46Z","title":"Information Extraction of Nested Complex Structure of Quantum Cascade Lasers via Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-12T04:40:40.693392Z"},"links":{"cited_paper":"/paper/2409.01586","citing_paper":"/paper/2605.09927"},"observation_digest":"sha256:fe50a2513db5ef08abfcc6110fc87f10981341d3ab0e05b0b9bdb4b259b5d881","observation_id":"fe145d2a-9633-4509-bd91-3e1d021b8255","resolution":{"observed_at":"2026-05-12T04:41:21.968863Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01586","last_updated":"2025-03-17T17:17:16Z","snapshot_observed_at":"2026-08-05T01:27:27.177475Z","submitted_at":"2024-09-03T03:59:22Z","title":"Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation","version":4},"cited_work":{"arxiv_id":"2409.01586","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.01586","snapshot_observed_at":"2026-06-30T21:05:04.078784Z","title":"F., and Liu, L","venue":null,"work_id":"69d29cc3-19fc-41a7-acf3-dbf4cb347928","year":2024},"citing_paper":{"arxiv_id":"2605.14605","last_updated":"2026-05-24T08:34:13Z","snapshot_observed_at":"2026-07-06T23:25:58.895612Z","submitted_at":"2026-05-14T09:22:14Z","title":"One Step to the Side: Why Defenses Against Malicious Finetuning Fail Under Adaptive Adversaries","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T21:01:25.549340Z"},"links":{"cited_paper":"/paper/2409.01586","citing_paper":"/paper/2605.14605"},"observation_digest":"sha256:dcdfb9bc60815607d57cd3b9d055501770c847dede0048d4c2e07e602d461e07","observation_id":"a2dfaf6b-1bf7-4400-82bf-315d25f2f086","resolution":{"observed_at":"2026-06-30T21:05:04.080397Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01586","last_updated":"2025-03-17T17:17:16Z","snapshot_observed_at":"2026-08-05T01:27:27.177475Z","submitted_at":"2024-09-03T03:59:22Z","title":"Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation","version":4},"cited_work":{"arxiv_id":"2409.01586","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.01586","snapshot_observed_at":"2026-06-30T21:05:04.078784Z","title":"F., and Liu, L","venue":null,"work_id":"69d29cc3-19fc-41a7-acf3-dbf4cb347928","year":2024},"citing_paper":{"arxiv_id":"2605.28030","last_updated":"2026-05-27T06:36:22Z","snapshot_observed_at":"2026-08-07T03:38:26.044946Z","submitted_at":"2026-05-27T06:36:22Z","title":"SPARD: Defending Harmful Fine-Tuning Attack via Safety Projection with Relevance-Diversity Data Selection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T13:49:56.311711Z"},"links":{"cited_paper":"/paper/2409.01586","citing_paper":"/paper/2605.28030"},"observation_digest":"sha256:67d911a205ddf7d3dbe51df114f841adb442ca04fd1e6ca6273e31cc9ca7ecf9","observation_id":"75e4eee9-a5e3-4ba6-a677-00a307f7fe34","resolution":{"observed_at":"2026-06-29T13:53:28.635480Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01586","last_updated":"2025-03-17T17:17:16Z","snapshot_observed_at":"2026-08-05T01:27:27.177475Z","submitted_at":"2024-09-03T03:59:22Z","title":"Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01586","snapshot_observed_at":"2026-07-14T05:21:30.132993Z","title":"Booster: Tackling harmful fine-tuning for large language models via attenuating harmful perturbation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11475","last_updated":"2026-07-13T12:28:43Z","snapshot_observed_at":"2026-08-03T06:05:50.494677Z","submitted_at":"2026-07-13T12:28:43Z","title":"HyperSafe: Inference-Time Safety Recovery for Fine-Tuned Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T05:21:30.132993Z"},"links":{"cited_paper":"/paper/2409.01586","citing_paper":"/paper/2607.11475"},"observation_digest":"sha256:a874d38ad6f31782543e59cfbe980eaadbc1b29b3041be773f0874d2841f3f20","observation_id":"0bee95b9-158f-44c2-a685-f6661945d8cc","resolution":{"observed_at":"2026-07-14T05:21:30.132993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01586","last_updated":"2025-03-17T17:17:16Z","snapshot_observed_at":"2026-08-05T01:27:27.177475Z","submitted_at":"2024-09-03T03:59:22Z","title":"Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01586","snapshot_observed_at":"2026-08-01T07:46:17.515379Z","title":"arXiv preprint arXiv:2409.01586 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21356","last_updated":"2026-07-23T14:19:28Z","snapshot_observed_at":"2026-08-07T19:47:51.895704Z","submitted_at":"2026-07-23T14:19:28Z","title":"Emergent Misalignment Recruits a Pre-existing Persona Subspace","version":1},"reference_index":139,"source":"arxiv_source","source_observed_at":"2026-08-01T07:46:17.515379Z"},"links":{"cited_paper":"/paper/2409.01586","citing_paper":"/paper/2607.21356"},"observation_digest":"sha256:c466c0ec9291bf884a39faa9c1352430afb8e877bea925dc6659209090af92a4","observation_id":"1eaae0ff-20ab-47a9-93f8-65a8648886a3","resolution":{"observed_at":"2026-08-01T07:46:17.515379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01586","last_updated":"2025-03-17T17:17:16Z","snapshot_observed_at":"2026-08-05T01:27:27.177475Z","submitted_at":"2024-09-03T03:59:22Z","title":"Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01586","snapshot_observed_at":"2026-08-06T10:46:10.851158Z","title":"arXiv preprint arXiv:2409.01586 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05045","last_updated":"2026-08-05T16:55:59Z","snapshot_observed_at":"2026-08-09T18:29:41.382833Z","submitted_at":"2026-08-05T16:55:59Z","title":"Gradient Immunity: Null-Space Resistance to Malicious Fine-Tuning","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-06T10:46:10.851158Z"},"links":{"cited_paper":"/paper/2409.01586","citing_paper":"/paper/2608.05045"},"observation_digest":"sha256:dabd311fee5caeb67fba5bd9dc69cbce96d267d31d3f15b5442f37601f1ebfd3","observation_id":"b9582b11-b73f-412c-8a81-e4eb05b95bef","resolution":{"observed_at":"2026-08-06T10:46:10.851158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2409.01586/citation-record","integrity":"/paper/2409.01586/integrity","json":"/paper/2409.01586/citation-record.json","paper":"/paper/2409.01586"},"outbound":[],"paper":{"arxiv_id":"2409.01586","last_updated":"2025-03-17T17:17:16Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-05T01:27:27.177475Z","submitted_at":"2024-09-03T03:59:22Z","title":"Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2409.01586."}