{"as_of":"2026-08-14T15:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d487ee297e91e05968585e1cd76a3dc9501aefbabc670dbc996f189b195fa05a","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:58:32.629027Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T21:01:25.549340Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T21:05:04.110492Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.03850","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03850","snapshot_observed_at":"2026-06-30T21:05:04.110492Z","title":"Vulnerability-aware align- ment: Mitigating uneven forgetting in harmful fine-tuning.arXiv preprint arXiv:2506.03850, 2025","venue":null,"work_id":"4f4296f6-92cb-4999-a868-19efb75651b2","year":2025},"citing_paper":{"arxiv_id":"2605.14605","last_updated":"2026-05-24T08:34:13Z","snapshot_observed_at":"2026-07-06T23:25:58.895612Z","submitted_at":"2026-05-14T09:22:14Z","title":"One Step to the Side: Why Defenses Against Malicious Finetuning Fail Under Adaptive Adversaries","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T21:01:25.549340Z"},"links":{"cited_paper":"/paper/2506.03850","citing_paper":"/paper/2605.14605"},"observation_digest":"sha256:3417ea234ab0c65e6d5f0a9f79c8f23c73813be69372f9508536ee8c24ca2217","observation_id":"7f15e16c-f8f7-4280-8880-d2d3f12f7f79","resolution":{"observed_at":"2026-06-30T21:05:04.112067Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.03850","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03850","snapshot_observed_at":"2026-06-30T21:05:04.110492Z","title":"Vulnerability-aware align- ment: Mitigating uneven forgetting in harmful fine-tuning.arXiv preprint arXiv:2506.03850, 2025","venue":null,"work_id":"4f4296f6-92cb-4999-a868-19efb75651b2","year":2025},"citing_paper":{"arxiv_id":"2605.28030","last_updated":"2026-05-27T06:36:22Z","snapshot_observed_at":"2026-08-12T21:19:51.402396Z","submitted_at":"2026-05-27T06:36:22Z","title":"SPARD: Defending Harmful Fine-Tuning Attack via Safety Projection with Relevance-Diversity Data Selection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T13:49:56.311711Z"},"links":{"cited_paper":"/paper/2506.03850","citing_paper":"/paper/2605.28030"},"observation_digest":"sha256:7d9d29eb248b7eed9ffb4ba43147a4d600007a3238338d715050968f6c23ffde","observation_id":"485d1a7f-70e7-45c9-800c-5887115546fb","resolution":{"observed_at":"2026-06-29T13:53:28.667357Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.03850/citation-record","integrity":"/paper/2506.03850/integrity","json":"/paper/2506.03850/citation-record.json","paper":"/paper/2506.03850"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:27.960888Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:27.960888Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:e9296bef1e1db17178573d86a6b21d8ea73b29b8b7649915d90e83f7a93f6986","observation_id":"85be4b79-7bc6-4a4b-8739-558370a5ff14","resolution":{"observed_at":"2026-08-07T10:58:27.960888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:28.049879Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:28.049879Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:c8703fc8ab272343d231f6d08bd11346165d43fcf001b739d910a2713485946d","observation_id":"9201a311-3786-4f57-8a1a-d464c3807d6d","resolution":{"observed_at":"2026-08-07T10:58:28.049879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:35.719389Z","title":"D., Melenberg, B., and Rennen, G","venue":null,"work_id":"c3626f88-4382-48ae-ac6f-28611d430cbf","year":2013},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:28.166245Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:7be13b7330184b266be92c017f01bb0decd6afb0f7750d58c4b372b828a5fdfa","observation_id":"07745fbe-1cc1-4cbb-8cb0-60878b663edb","resolution":{"observed_at":"2026-08-07T10:58:35.806351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:35.535844Z","title":"Curriculum learning","venue":null,"work_id":"4ea625cf-c772-4cae-81a9-f9207b8113f8","year":2009},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:28.274612Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:c32e106884d83f4ecfc7051234c6d2689d91d7dc89fd84653b171f18f44a4de9","observation_id":"979dc913-5965-452a-ab2f-f847184f2920","resolution":{"observed_at":"2026-08-07T10:58:35.617713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:28.349795Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:28.349795Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:0d222f176bb06a9ccf62fe30eb1f9816d4a92d0f0d794a6d6804f797aa8f3541","observation_id":"fc7b2970-884a-458e-87cd-2e018560ef7b","resolution":{"observed_at":"2026-08-07T10:58:28.349795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:28.468902Z","title":"Beyond factuality: A comprehensive evaluation of large language models as knowledge generators","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:28.468902Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:b6ee748408ab0446e48cc7f2ce74eb508a296f8e12d03a99e690ee939dd346e0","observation_id":"1b388d9c-4b5e-4e9b-a117-6132bfe03b9b","resolution":{"observed_at":"2026-08-07T10:58:28.468902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:28.552869Z","title":"W at ME : Towards lossless watermarking through lexical redundancy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:28.552869Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:872d206f0b19b20cda00cb6cd7e613d7e4ab26682ce275b191ae9fe6dcece17c","observation_id":"6b99841c-5412-4628-8e93-984729d3a5e3","resolution":{"observed_at":"2026-08-07T10:58:28.552869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:35.317921Z","title":"Simple permutations can fool LL a MA : Permutation attack and defense for large language models","venue":null,"work_id":"0ac453f5-679b-4db1-894c-61c1a51bad84","year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:28.641840Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:1df2054162b8d1c0f6dd73ef4759618f0ffced93f14b678617a4626f1b10d31e","observation_id":"8d33798b-9766-4add-9d45-ff2fc5d2eb2d","resolution":{"observed_at":"2026-08-07T10:58:35.415083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:35.153154Z","title":"PEARL : Towards permutation-resilient LLM s","venue":null,"work_id":"d3de5b8a-9bca-42e3-a7ff-85c9d7bf69c6","year":2025},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:28.780718Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:c7519bc7592c10375b51b1b33b1638a4e00eb64fdd38e463c76a0d480dab3441","observation_id":"c4a364ec-717d-4543-a634-bba1b2c0d6f6","resolution":{"observed_at":"2026-08-07T10:58:35.239385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T10:58:28.922486Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:28.922486Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:8a787e11f24fd2f695a3b630d67bcfbe4ffa82941f4d5a68a8ce684d4ceec8f1","observation_id":"d4017aa4-c6e8-4a63-893e-37056372c498","resolution":{"observed_at":"2026-08-07T10:58:28.922486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:34.952715Z","title":"Statistics of robust optimization: A generalized empirical likelihood approach","venue":null,"work_id":"30217c79-2d6d-44e8-9e61-f6487e6ee751","year":2016},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:29.035354Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:fdb8e4e95d2b12edaac3be7507f0f21c32476df5d3cebfaf75b3a76eec8c2759","observation_id":"ee26b7b9-f979-4f71-b552-d64461331b23","resolution":{"observed_at":"2026-08-07T10:58:35.054218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:34.749932Z","title":"Sharpness-aware minimization for efficiently improving generalization","venue":null,"work_id":"d6029164-d062-486a-8e79-f1f22daf4e82","year":2021},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:29.096459Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:75423f55365516aef94ee8ab67d71b85c0bf5a2d7bd311188927a5b5c0f85c2b","observation_id":"5b6e0b8d-9112-4c43-abf2-31217a9a4b2e","resolution":{"observed_at":"2026-08-07T10:58:34.861219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03342","last_updated":"2022-01-18T23:54:07Z","snapshot_observed_at":"2026-08-13T18:50:00.151650Z","submitted_at":"2021-07-07T16:39:28Z","title":"A Survey of Uncertainty in Deep Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03342","snapshot_observed_at":"2026-08-07T10:58:29.226049Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:29.226049Z"},"links":{"cited_paper":"/paper/2107.03342","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:37da36dfbc2ebc61de29cbd2ceae7e558c85844a533a8a37ee9d2af4bb806008","observation_id":"0a7329e2-0b63-40cb-a845-8e5fd7ed970a","resolution":{"observed_at":"2026-08-07T10:58:29.226049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:34.542347Z","title":"Safe lora: the silver lining of reducing safety risks when fine-tuning large language models, 2024","venue":null,"work_id":"e5486d91-584e-45e6-b4e8-28b49c8198a8","year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:29.316371Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:2013ed0077b94c5ae7b00c6445c7761e731ae4850a4cbcac9c0f77d84738777d","observation_id":"d79474ea-dfc3-4cb8-9fc8-8c788cb0b3da","resolution":{"observed_at":"2026-08-07T10:58:34.635342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:34.338082Z","title":"Does distributionally robust supervised learning give robust classifiers? In International Conference on Machine Learning (ICML), 2018","venue":null,"work_id":"f90b5790-df40-4431-b8fc-cf9df6785439","year":2018},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:29.426723Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:f082b0c71f7c73607c87437f4e6e2b403fa49bfa1e7e350efeaf61390eb8534a","observation_id":"3039b9af-f8d2-4aeb-b693-0f6cb6283dd8","resolution":{"observed_at":"2026-08-07T10:58:34.437632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09600","last_updated":"2025-09-05T04:54:29Z","snapshot_observed_at":"2026-08-12T23:01:49.086216Z","submitted_at":"2024-08-18T21:45:03Z","title":"Antidote: Post-fine-tuning Safety Alignment for Large Language Models against Harmful Fine-tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09600","snapshot_observed_at":"2026-08-07T10:58:29.556438Z","title":"Antidote: Post-fine-tuning safety alignment for large language models against harmful fine-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:29.556438Z"},"links":{"cited_paper":"/paper/2408.09600","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:c1fd2b1875290ecd16c4630aea44677845d7788ee5395ca186e66539ae18d216","observation_id":"5ce7a588-a395-4725-802b-23fa97cb6001","resolution":{"observed_at":"2026-08-07T10:58:29.556438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01586","last_updated":"2025-03-17T17:17:16Z","snapshot_observed_at":"2026-08-12T22:52:40.630080Z","submitted_at":"2024-09-03T03:59:22Z","title":"Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01586","snapshot_observed_at":"2026-08-07T10:58:29.726809Z","title":"F., and Liu, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:29.726809Z"},"links":{"cited_paper":"/paper/2409.01586","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:bb405eef8fcd0bd54df46783b5e2eed2dca38fab789aa5448a104e740d698dba","observation_id":"432e1bfa-79a9-4200-a759-08918ef0de8c","resolution":{"observed_at":"2026-08-07T10:58:29.726809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18641","last_updated":"2024-10-29T05:46:55Z","snapshot_observed_at":"2026-08-12T23:55:40.111981Z","submitted_at":"2024-05-28T22:53:43Z","title":"Lisa: Lazy Safety Alignment for Large Language Models against Harmful Fine-tuning Attack","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18641","snapshot_observed_at":"2026-08-07T10:58:29.862212Z","title":"F., and Liu, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:29.862212Z"},"links":{"cited_paper":"/paper/2405.18641","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:7ac344914d2c30ec095ccb17cadc835102c668b0efb66e3b7165589b6ce580dd","observation_id":"68912f69-44e1-4a26-9e9d-4eccb783f9cf","resolution":{"observed_at":"2026-08-07T10:58:29.862212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01109","last_updated":"2024-11-24T20:09:55Z","snapshot_observed_at":"2026-08-13T19:54:16.744887Z","submitted_at":"2024-02-02T02:56:50Z","title":"Vaccine: Perturbation-aware Alignment for Large Language Models against Harmful Fine-tuning Attack","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01109","snapshot_observed_at":"2026-08-07T10:58:30.014066Z","title":"Vaccine: Perturbation-aware alignment for large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:30.014066Z"},"links":{"cited_paper":"/paper/2402.01109","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:e1bc99b2d793ba2da56854b06ad2b2fcf1217d00dc72461d51d1ca95ddedae02","observation_id":"2b67a653-2ba4-40ac-b187-9c56cd80cf82","resolution":{"observed_at":"2026-08-07T10:58:30.014066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:30.125758Z","title":"Beavertails: Towards improved safety alignment of llm via a human-preference dataset","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:30.125758Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:f4fb68c5edade2d278d2e69456ad60eb1c5c78afe81f3392c7a54f4e3e048052","observation_id":"85e40ba6-bc56-47e8-9791-7ac500928d3a","resolution":{"observed_at":"2026-08-07T10:58:30.125758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:34.168663Z","title":"A watermark for large language models","venue":null,"work_id":"9ff42df0-fd95-4022-8f58-b0160a738909","year":2023},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:30.240558Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:81e82570cd6a08e509a6e5a75f605fb3419cf232f4ef28b4992333d23e9b269b","observation_id":"7b62c561-52f3-42b0-9a61-828f87d4bb22","resolution":{"observed_at":"2026-08-07T10:58:34.258151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:33.965908Z","title":"and Zhou, E","venue":null,"work_id":"81e77852-f1e9-461b-a52c-ae843f209ce6","year":2015},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:30.373584Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:a257f75883f8814c3774de56122866d1f472e3eb888db36e8d0ffefa3b2cf475","observation_id":"9045197d-47fa-47bb-aca2-3d50cea61a3d","resolution":{"observed_at":"2026-08-07T10:58:34.043488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:30.489568Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:30.489568Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:c5aaa56542ecc3f53aa438cf9551e345c8c68f30eac0de77feea5a13e8a137c7","observation_id":"992acd13-9279-4488-99b5-01a2cc5cbbb7","resolution":{"observed_at":"2026-08-07T10:58:30.489568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:30.674810Z","title":"Truthfulqa: Measuring how models mimic human falsehoods, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:30.674810Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:78035d7f4f099b8a9098cbcff97526499d4ae5e974d14de9d301f30149e5009e","observation_id":"56a9ff7c-d06a-43d1-a381-a3109563f274","resolution":{"observed_at":"2026-08-07T10:58:30.674810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T10:58:30.814159Z","title":"Fixing weight decay regularization in adam","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:30.814159Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:4c9c4cc6cc3f5d9bf5ea0d8b3e1bad5bba78d7ad357651fc791c5495f44b44e4","observation_id":"51fd9752-942b-42b2-90aa-7a1795e26c32","resolution":{"observed_at":"2026-08-07T10:58:30.814159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18540","last_updated":"2025-01-17T01:43:21Z","snapshot_observed_at":"2026-08-13T04:07:59.588881Z","submitted_at":"2024-02-28T18:23:49Z","title":"Keeping LLMs Aligned After Fine-tuning: The Crucial Role of Prompt Templates","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18540","snapshot_observed_at":"2026-08-07T10:58:30.941185Z","title":"Keeping llms aligned after fine-tuning: The crucial role of prompt templates","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:30.941185Z"},"links":{"cited_paper":"/paper/2402.18540","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:e8a0429508c359e9db3db665a20777382c60e29cfcd41ab0780f3a2b5b4700ff","observation_id":"4fed7e0f-c7a7-4eb8-808c-4691a40cde4a","resolution":{"observed_at":"2026-08-07T10:58:30.941185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:33.763569Z","title":"Virtual adversarial training: a regularization method for supervised and semi-supervised learning","venue":null,"work_id":"0a965b0e-d649-4f09-a165-24bc6c2a404a","year":2018},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.035740Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:6e6e22d4f1baf11f40af00d7b1cd866628b2dcc100f2edc9960185adbd59f497","observation_id":"93941efd-55ef-4822-9be0-74563ea52630","resolution":{"observed_at":"2026-08-07T10:58:33.855444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13320","last_updated":"2024-07-01T17:14:27Z","snapshot_observed_at":"2026-08-13T10:27:45.284849Z","submitted_at":"2023-08-25T11:49:51Z","title":"Fine-tuning can cripple your foundation model; preserving features may be the solution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13320","snapshot_observed_at":"2026-08-07T10:58:31.154739Z","title":"H., and Dokania, P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.154739Z"},"links":{"cited_paper":"/paper/2308.13320","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:be0d76775dd8c902c03d050db76781e7f73b98e771a71528e4c1ad94c6dd9a4a","observation_id":"8aca17d5-d9ff-4695-9543-791e580d92ad","resolution":{"observed_at":"2026-08-07T10:58:31.154739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:31.235844Z","title":"Robust stochastic approximation approach to stochastic programming","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.235844Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:d15e895dfcf256c22f5e3096ded38d2ba46ef93ce2a64be037dcb18f54011b43","observation_id":"0899e5f3-95e0-4dfc-9c9b-61cd7d5dd285","resolution":{"observed_at":"2026-08-07T10:58:31.235844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:33.536179Z","title":"Distributionally robust language modeling","venue":null,"work_id":"75450302-7108-4511-99d3-026d32760af3","year":2019},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.306031Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:1ec9b5e3978914fd2f638dc1da6c99ba1b97ca0d9d9226a471150bd4c1b56825","observation_id":"31bf7f29-8d3d-4195-b990-02fa3aec3dd0","resolution":{"observed_at":"2026-08-07T10:58:33.666994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17374","last_updated":"2024-10-30T22:35:59Z","snapshot_observed_at":"2026-08-12T23:56:54.095037Z","submitted_at":"2024-05-27T17:31:56Z","title":"Navigating the Safety Landscape: Measuring Risks in Finetuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17374","snapshot_observed_at":"2026-08-07T10:58:31.384137Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.384137Z"},"links":{"cited_paper":"/paper/2405.17374","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:867696912401d8bd0a7444f82f593f15d64220bb0decfa7e5b8a538721a66a7c","observation_id":"ed815a8c-94fe-46df-8523-01939a05d727","resolution":{"observed_at":"2026-08-07T10:58:31.384137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:33.281926Z","title":"Gradient starvation: A learning proclivity in neural networks","venue":null,"work_id":"f002ad20-32eb-4b43-93e9-2f6734b4e33c","year":2021},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.471377Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:079db41aee3374e963f8e10c98a9904ed9d253b407dadbb4f94a4da49b4b3383","observation_id":"e9fa4308-f270-4c84-a1b8-eccdf39237e8","resolution":{"observed_at":"2026-08-07T10:58:33.450064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:33.099126Z","title":"Fine-tuning aligned language models compromises safety, even when users do not intend to! In The Twelfth International Conference on Learning Representations, 2024","venue":null,"work_id":"e8402c95-bae5-4473-a16a-3da6a0023192","year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.585683Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:05c2f5af061facc6e6b070f9ffea9b362cd7f225abbf5079e8e997639d32cc80","observation_id":"9213de61-e392-432a-957a-01f18cc978a4","resolution":{"observed_at":"2026-08-07T10:58:33.175737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14577","last_updated":"2024-10-30T22:58:40Z","snapshot_observed_at":"2026-08-12T23:59:50.265846Z","submitted_at":"2024-05-23T13:51:55Z","title":"Representation Noising: A Defence Mechanism Against Harmful Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14577","snapshot_observed_at":"2026-08-07T10:58:31.656919Z","title":"Representation noising effectively prevents harmful fine-tuning on llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.656919Z"},"links":{"cited_paper":"/paper/2405.14577","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:35e3609b075a106c1852444bbb8e85e878c5d2a23109cb4656fc3c2b5f0529b2","observation_id":"e024dd50-b677-4397-9582-d93faf791fef","resolution":{"observed_at":"2026-08-07T10:58:31.656919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16382","last_updated":"2024-10-03T16:39:32Z","snapshot_observed_at":"2026-08-13T04:10:18.026827Z","submitted_at":"2024-02-26T08:08:03Z","title":"Immunization against harmful fine-tuning attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16382","snapshot_observed_at":"2026-08-07T10:58:31.777027Z","title":"Immunization against harmful fine-tuning attacks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.777027Z"},"links":{"cited_paper":"/paper/2402.16382","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:05e83578fd4bf4d8414d88dc28a715b7a157c24b66f4e6bf557c58c6713fb3da","observation_id":"692cf9e7-b23c-4523-93e3-a926ffd1e9cc","resolution":{"observed_at":"2026-08-07T10:58:31.777027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:31.841598Z","title":"W., Hashimoto, T","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.841598Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:a9b59dad1731a095d8c82e35f973bb13abb1ce336d1cd538bedfae6c5c0741f7","observation_id":"a6c52886-6a07-4020-a183-0c9c52698cd9","resolution":{"observed_at":"2026-08-07T10:58:31.841598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:31.918620Z","title":"D., Ng, A","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.918620Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:2fc1dc71605bd44b8c624357962993e61edf882051c2e574c82a8635a8a063ee","observation_id":"6970cdf6-317a-4e6d-be18-0ac31cd90c05","resolution":{"observed_at":"2026-08-07T10:58:31.918620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:32.018033Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:32.018033Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:c226193a376917cb3994363a234ceca0f98af7801296f851f2c7116841f1accb","observation_id":"03d73a50-2a49-4b4e-841c-df5b920aea78","resolution":{"observed_at":"2026-08-07T10:58:32.018033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T10:58:32.116438Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:32.116438Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:05158c3a1ebcb3c30e15fbc340b14e3f0fa948994691d9f8b76c0d93c78546ec","observation_id":"836a6827-2136-4cc3-99cc-2cc4c5eabf0b","resolution":{"observed_at":"2026-08-07T10:58:32.116438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T10:58:32.223942Z","title":"Qwen2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:32.223942Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:976a81acd3e465b1ade291bcc2e95f99275e96ec1db00430cf6a16628f7fe345","observation_id":"4f4a639c-f73a-4dc8-adfe-3056e664ee1f","resolution":{"observed_at":"2026-08-07T10:58:32.223942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02949","last_updated":"2023-10-04T16:39:31Z","snapshot_observed_at":"2026-08-13T05:57:27.605916Z","submitted_at":"2023-10-04T16:39:31Z","title":"Shadow Alignment: The Ease of Subverting Safely-Aligned Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02949","snapshot_observed_at":"2026-08-07T10:58:32.316238Z","title":"Y., Zhao, X., and Lin, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:32.316238Z"},"links":{"cited_paper":"/paper/2310.02949","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:8227417a39b57bbe58e1798bcda7df0e541d1276ab91ec305ab4021be7153cd7","observation_id":"2e6a2e86-1dfb-49eb-bca1-21e2781a527e","resolution":{"observed_at":"2026-08-07T10:58:32.316238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09055","last_updated":"2024-05-15T03:04:05Z","snapshot_observed_at":"2026-08-13T00:07:33.019162Z","submitted_at":"2024-05-15T03:04:05Z","title":"A safety realignment framework via subspace-oriented model fusion for large language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09055","snapshot_observed_at":"2026-08-07T10:58:32.433283Z","title":"A safety realignment framework via subspace-oriented model fusion for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:32.433283Z"},"links":{"cited_paper":"/paper/2405.09055","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:8ce599763b7d30d832b0ec165c54a1aa0d24c0294a20bede120e7ed44d4d265a","observation_id":"34a5e47a-548e-4a19-b784-3991868611b4","resolution":{"observed_at":"2026-08-07T10:58:32.433283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05553","last_updated":"2024-04-05T23:30:56Z","snapshot_observed_at":"2026-08-13T05:28:57.633730Z","submitted_at":"2023-11-09T17:54:59Z","title":"Removing RLHF Protections in GPT-4 via Fine-Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05553","snapshot_observed_at":"2026-08-07T10:58:32.538591Z","title":"Removing rlhf protections in gpt-4 via fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:32.538591Z"},"links":{"cited_paper":"/paper/2311.05553","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:3f8fa51636917626fd35972c2390597df55bf40d25b686d55b42d7d67d6494b2","observation_id":"382b390f-a3a8-4031-8574-31eb66cb9f27","resolution":{"observed_at":"2026-08-07T10:58:32.538591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:32.629027Z","title":"Character-level convolutional networks for text classification","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:32.629027Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:2d426147ffd5c54dd811f6711a084f7ca7873af1a6009816b7ba4eeb75d2106f","observation_id":"c09f958c-6138-4837-b436-8b3cca594162","resolution":{"observed_at":"2026-08-07T10:58:32.629027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T21:43:46.350019Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 2 inbound Pith citation observations for arXiv:2506.03850."}