{"as_of":"2026-08-15T22:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:21adcc31226ff9b512d3335ea26f2f4cb6da17a68895f9dffde97573420cc8ee","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T00:18:57.358405Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:13:58.102071Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T03:36:29.112684Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19512","snapshot_observed_at":"2026-08-15T18:13:58.102071Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18631","last_updated":"2025-07-25T07:20:24Z","snapshot_observed_at":"2026-08-15T18:07:02.667074Z","submitted_at":"2025-07-24T17:59:24Z","title":"Layer-Aware Representation Filtering: Purifying Finetuning Data to Preserve LLM Safety Alignment","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T18:13:58.102071Z"},"links":{"cited_paper":"/paper/2412.19512","citing_paper":"/paper/2507.18631"},"observation_digest":"sha256:59f48f36d8ef537c74f0a95576719577061b551174f2c5ba2a60354526712cd3","observation_id":"b0cb59f1-cc2b-48e8-9ece-a4a3dd1880a4","resolution":{"observed_at":"2026-08-15T18:13:58.102071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"cited_work":{"arxiv_id":"2412.19512","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.19512","snapshot_observed_at":"2026-07-02T03:36:29.112684Z","title":"H., Sahay, S., Chen, S.- T., and Lee, H.-y","venue":null,"work_id":"6913ad55-d958-4c57-afff-5ce8a14ef349","year":2024},"citing_paper":{"arxiv_id":"2602.07892","last_updated":"2026-05-12T03:21:50Z","snapshot_observed_at":"2026-08-11T15:42:35.247968Z","submitted_at":"2026-02-08T09:53:46Z","title":"Safety Alignment as Continual Learning: Mitigating the Alignment Tax via Orthogonal Gradient Projection","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T06:39:17.785715Z"},"links":{"cited_paper":"/paper/2412.19512","citing_paper":"/paper/2602.07892"},"observation_digest":"sha256:6f40b414338784caf98c9c608bb03c2c23d4bbd82cf7974892bb09432fee6ae5","observation_id":"31aeccf6-a041-46cc-b0e8-4aa66fe671e2","resolution":{"observed_at":"2026-05-16T06:40:42.333276Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"cited_work":{"arxiv_id":"2412.19512","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.19512","snapshot_observed_at":"2026-07-02T03:36:29.112684Z","title":"H., Sahay, S., Chen, S.- T., and Lee, H.-y","venue":null,"work_id":"6913ad55-d958-4c57-afff-5ce8a14ef349","year":2024},"citing_paper":{"arxiv_id":"2605.04992","last_updated":"2026-05-06T14:52:22Z","snapshot_observed_at":"2026-08-15T04:49:15.846222Z","submitted_at":"2026-05-06T14:52:22Z","title":"You Snooze, You Lose: Automatic Safety Alignment Restoration through Neural Weight Translation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-08T17:02:20.836208Z"},"links":{"cited_paper":"/paper/2412.19512","citing_paper":"/paper/2605.04992"},"observation_digest":"sha256:abd9e142f44453180b219607c922b56429999a2dd31877486638502b4ced1705","observation_id":"991fed19-b0ee-4399-a3e7-ca86572f825c","resolution":{"observed_at":"2026-05-11T17:51:08.494325Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"cited_work":{"arxiv_id":"2412.19512","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.19512","snapshot_observed_at":"2026-07-02T03:36:29.112684Z","title":"H., Sahay, S., Chen, S.- T., and Lee, H.-y","venue":null,"work_id":"6913ad55-d958-4c57-afff-5ce8a14ef349","year":2024},"citing_paper":{"arxiv_id":"2606.02530","last_updated":"2026-06-01T17:38:12Z","snapshot_observed_at":"2026-08-05T11:28:53.105574Z","submitted_at":"2026-06-01T17:38:12Z","title":"SafeSteer: Localized On-Policy Distillation for Efficient Safety Alignment","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-28T14:39:11.178976Z"},"links":{"cited_paper":"/paper/2412.19512","citing_paper":"/paper/2606.02530"},"observation_digest":"sha256:56c5e9ca02c7fdd4514e45764b7ee770594d373feb5ebc3720ec11ca707a6a6c","observation_id":"0ab76c15-4a78-45d0-9611-7456edf670b7","resolution":{"observed_at":"2026-07-01T23:06:20.945075Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"cited_work":{"arxiv_id":"2412.19512","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.19512","snapshot_observed_at":"2026-07-02T03:36:29.112684Z","title":"H., Sahay, S., Chen, S.- T., and Lee, H.-y","venue":null,"work_id":"6913ad55-d958-4c57-afff-5ce8a14ef349","year":2024},"citing_paper":{"arxiv_id":"2606.06519","last_updated":"2026-06-02T14:51:14Z","snapshot_observed_at":"2026-08-08T05:55:13.863865Z","submitted_at":"2026-06-02T14:51:14Z","title":"SafeGene: Reusable Adapters for Transferable Safety Alignment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T09:58:16.956281Z"},"links":{"cited_paper":"/paper/2412.19512","citing_paper":"/paper/2606.06519"},"observation_digest":"sha256:06d5d4a6f6c4d9477714cb792f01001207cea4a4a45ee171c8ad873311a7bd66","observation_id":"321f8500-621c-4b33-b3a7-f30d06b63683","resolution":{"observed_at":"2026-07-02T03:36:29.115347Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19512","snapshot_observed_at":"2026-08-14T04:46:15.928433Z","title":"InFindings of the Association for Computational Linguis- tics (EMNLP), 16589–16602","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08542","last_updated":"2026-08-09T07:41:06Z","snapshot_observed_at":"2026-08-14T08:59:47.451043Z","submitted_at":"2026-08-09T07:41:06Z","title":"When Skills Meet Safety: Benchmarking and Characterizing the Adaptive Jailbreak Robustness of Skill-Merged LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T04:46:15.928433Z"},"links":{"cited_paper":"/paper/2412.19512","citing_paper":"/paper/2608.08542"},"observation_digest":"sha256:9d93451aa1734a8a172178d46abc51920150c3b5b18b8d4b7aa39f3f59b89b51","observation_id":"263505ab-b217-4b2e-b25a-28d22d546b0b","resolution":{"observed_at":"2026-08-14T04:46:15.928433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.19512/citation-record","integrity":"/paper/2412.19512/integrity","json":"/paper/2412.19512/citation-record.json","paper":"/paper/2412.19512"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.108268Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.108268Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:d2efa0c303b86e2cf80883d5a75a67b181b2ff0a06e66d2de97964af041ed006","observation_id":"a6669de0-a725-4743-a029-6803a7165005","resolution":{"observed_at":"2026-08-11T00:18:57.108268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.113902Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.113902Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:6fa32af31a046e9734b061ca2443077293da533ec8c0a0c43a048ecfa8fba348","observation_id":"eff4584b-fb71-4a75-87c0-7a33d8a563ba","resolution":{"observed_at":"2026-08-11T00:18:57.113902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.119147Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.119147Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:d34c0ebc12bd08fee837db7f6bdd574d5b336b70573b9fde3940e6d232c4a3fb","observation_id":"fd74db37-d909-4e67-a576-14baf081bd41","resolution":{"observed_at":"2026-08-11T00:18:57.119147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.123790Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.123790Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:307f56bdb655689497bd026d3093beb9698c99a8f68409c7bcb1942decac215c","observation_id":"a9fff2d4-892d-4ed9-b1fc-db6fdb6b9aa2","resolution":{"observed_at":"2026-08-11T00:18:57.123790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-11T00:18:57.127918Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.127918Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:20c009cd81179e8009ade5f7d80888bd598f255b060842884d8c10b41e332fa8","observation_id":"d1c1f9df-884a-442c-8223-47ad7581154c","resolution":{"observed_at":"2026-08-11T00:18:57.127918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.132798Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.132798Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:d9e125c8ba3bc4679a6eb88491e43c33f4ee3ff6bcc3900f2cebf4325a49445c","observation_id":"aa1a49bf-99f8-4cf3-99ac-3613d52e8694","resolution":{"observed_at":"2026-08-11T00:18:57.132798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.137405Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.137405Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:78ef9b00f40c34d3e4b6564e9f6f62c7938b08919d61a1789b2333196c8d1ac6","observation_id":"46844b93-c05e-4121-b95d-3a4250687f92","resolution":{"observed_at":"2026-08-11T00:18:57.137405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:58.082810Z","title":null,"venue":null,"work_id":"dc524858-719e-4817-a31a-5fc4745ca865","year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.141984Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:38e79502c0a4b27cb8e17121cb4cc9eb4261404030bdffa55124dc6c2eaf0424","observation_id":"7ac79489-bae2-49cc-9477-cd529f0b5bcb","resolution":{"observed_at":"2026-08-11T00:18:58.087683Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.147107Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.147107Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:81ee21267e2d4bb159c5dfaba0690de450d96cf5be8ae806f4e5047416a49f23","observation_id":"cae8a1d2-304d-4acb-b7f7-25bfa1eb1af1","resolution":{"observed_at":"2026-08-11T00:18:57.147107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.152116Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.152116Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:966307b4c9ee263502361f0811df2a960534a7e9ba58333aaf0b933d5b5d435e","observation_id":"3224d235-ae87-4a65-957a-f446bdb2be20","resolution":{"observed_at":"2026-08-11T00:18:57.152116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T00:18:57.156708Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.156708Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:8a873133646748c593ac22c3c955d55e4ec02c4b0edda74394b798b552272d04","observation_id":"fe2aa376-a3e4-40eb-b479-9f56327725cc","resolution":{"observed_at":"2026-08-11T00:18:57.156708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:58.066968Z","title":null,"venue":null,"work_id":"f0a6303b-a6f3-4cca-b14d-e72125b0cda7","year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.161552Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:4e8fc9f4a064b6819435bd2d2204f7d56b4243106aae3e194132a75305f2a5ca","observation_id":"96b2dc93-a2e4-4d51-945b-a088af357675","resolution":{"observed_at":"2026-08-11T00:18:58.072094Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.1212","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.479852Z","title":null,"venue":null,"work_id":"5878a9ac-992d-4727-baab-f50ff8060df1","year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.165917Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:aa13a6ad61b7de413073d8f92de985081c4317414389851dd1a0a13806d7a83d","observation_id":"f8e894bb-8996-453e-8c01-9002a2647b6b","resolution":{"observed_at":"2026-08-11T00:18:57.484090Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:58.051558Z","title":null,"venue":null,"work_id":"8bf61ad5-ff51-4118-9f67-3b90b072b8d9","year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.170570Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:4d056d71b039f4687b43f98d8c65599f162ad49cd8cf66d3e45efee1c15f1598","observation_id":"d0c08b9f-7102-40a9-b1ad-93f379aebd8c","resolution":{"observed_at":"2026-08-11T00:18:58.056542Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.175136Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.175136Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:b7f77351ff6afe938e6e9ce80bac58459f2883da46fc1a0585522b6f86b43fc0","observation_id":"258fefcc-76a3-4216-94c6-8a8215d953a1","resolution":{"observed_at":"2026-08-11T00:18:57.175136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04799","last_updated":"2024-06-07T06:28:05Z","snapshot_observed_at":"2026-08-13T05:54:55.227751Z","submitted_at":"2023-10-07T13:34:21Z","title":"Chat Vector: A Simple Approach to Equip LLMs with Instruction Following and Model Alignment in New Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04799","snapshot_observed_at":"2026-08-11T00:18:57.179861Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.179861Z"},"links":{"cited_paper":"/paper/2310.04799","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:621afd7977502788353a0747c787605d92b246e7eb95709d44f0661250f3a7a7","observation_id":"5c9ed235-0a5d-42ec-83ef-7a73376fd0f3","resolution":{"observed_at":"2026-08-11T00:18:57.179861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09600","last_updated":"2025-09-05T04:54:29Z","snapshot_observed_at":"2026-08-14T16:22:50.657429Z","submitted_at":"2024-08-18T21:45:03Z","title":"Antidote: Post-fine-tuning Safety Alignment for Large Language Models against Harmful Fine-tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09600","snapshot_observed_at":"2026-08-11T00:18:57.184736Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.184736Z"},"links":{"cited_paper":"/paper/2408.09600","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:3ff1e652b8c9568708f024a9dd5a71811c4db208a4d6559b20e570252994ed2d","observation_id":"982c9dc8-f229-41ca-8820-09e2b13a778a","resolution":{"observed_at":"2026-08-11T00:18:57.184736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:58.026720Z","title":null,"venue":null,"work_id":"8dee83ed-4130-4954-afe7-c90d762f64fb","year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.189479Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:7daa419235c271f8e68a6c6f00c54cf4c1e8f6f6bb1fd5fcd59d072af152e9e0","observation_id":"41d6838b-9387-45cc-b4ba-cc466bfa30ad","resolution":{"observed_at":"2026-08-11T00:18:58.031361Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:58.007838Z","title":null,"venue":null,"work_id":"ab401477-df30-4fe2-af26-8fe19d90aba4","year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.195358Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:f8f3c76b33149d0499aee7ef54285a55e48fd4717cb574309c2a9749491e396a","observation_id":"50db6f75-8f39-4688-a67b-30753377b358","resolution":{"observed_at":"2026-08-11T00:18:58.012110Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11391","last_updated":"2023-08-27T13:12:30Z","snapshot_observed_at":"2026-08-14T22:16:50.314777Z","submitted_at":"2023-05-19T02:41:12Z","title":"A Survey of Safety and Trustworthiness of Large Language Models through the Lens of Verification and Validation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11391","snapshot_observed_at":"2026-08-11T00:18:57.199347Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.199347Z"},"links":{"cited_paper":"/paper/2305.11391","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:e548381137f5ccd924cd5f524b26d60942264dec73f9a62fe92c4a2b7b3c0f33","observation_id":"96d250f9-95a3-42ae-a3c0-e72b4c87cdd2","resolution":{"observed_at":"2026-08-11T00:18:57.199347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.203568Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.203568Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:52bf40c99bbeb90c98c4c90db7e25ae17502c8a960b68c400df99dc05effa975","observation_id":"16e38055-cd88-4328-8d68-248f18ca3c5f","resolution":{"observed_at":"2026-08-11T00:18:57.203568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.207635Z","title":"Rusu, Kieran Milan, John Quan, Tiago Ramalho, Agnieszka Grabska-Barwinska, Demis Hassabis, Claudia Clopath, Dharshan Kumaran, and Raia Hadsell","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.207635Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:2a05b84392c6ab9c74b6dcee0b7cf4ded11212cdb6f099d3be39994b3ddbb521","observation_id":"604cd0c9-c35e-4614-bf54-c03176f45daf","resolution":{"observed_at":"2026-08-11T00:18:57.207635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.211710Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.211710Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:835aed445f7dd6ed2b51a7ecc3a619b487562783b3a59af34f42ce1e4a1cad7f","observation_id":"88e80cff-7404-4b57-90c9-178343271d6e","resolution":{"observed_at":"2026-08-11T00:18:57.211710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03129","last_updated":"2024-01-06T05:34:09Z","snapshot_observed_at":"2026-08-13T04:48:09.709808Z","submitted_at":"2024-01-06T05:34:09Z","title":"Examining Forgetting in Continual Pre-training of Aligned Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03129","snapshot_observed_at":"2026-08-11T00:18:57.215751Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.215751Z"},"links":{"cited_paper":"/paper/2401.03129","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:f5e19cc701dd5eda69fffe868f5e72bb0ad04c0830a7114c7f125b2bd0e4b09d","observation_id":"14dfb17d-7526-4be4-bafc-e6ba73337cc6","resolution":{"observed_at":"2026-08-11T00:18:57.215751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14070","last_updated":"2023-06-24T15:26:44Z","snapshot_observed_at":"2026-08-15T02:59:44.624023Z","submitted_at":"2023-03-24T15:29:16Z","title":"ChatDoctor: A Medical Chat Model Fine-Tuned on a Large Language Model Meta-AI (LLaMA) Using Medical Domain Knowledge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14070","snapshot_observed_at":"2026-08-11T00:18:57.220122Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.220122Z"},"links":{"cited_paper":"/paper/2303.14070","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:9cd5547f435360ed227503855e2e4f5655f4064e3278939ca08e6a5a3a334c49","observation_id":"d7cff0f7-6ccc-4234-81d3-9d7bfc077e11","resolution":{"observed_at":"2026-08-11T00:18:57.220122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.224721Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.224721Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:b801c699658005ab7cf686d6aea4f3a8e41feab84f6e4891701b7df484702c98","observation_id":"fbdd40e1-0b7a-46ae-a92c-0a627d582fca","resolution":{"observed_at":"2026-08-11T00:18:57.224721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-11T00:18:57.229525Z","title":"Le, Barret Zoph, Jason Wei, and Adam Roberts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.229525Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:ee7519bc5e20047f049295cad58530c64cd83a231598b6ae72f52c7c0a0b626d","observation_id":"0da4e2f5-7d8a-4b6f-be4b-c036700f19b9","resolution":{"observed_at":"2026-08-11T00:18:57.229525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.234241Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.234241Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:e40b02667562378232fc7cedfd24338bec7dfe1c98f7fc800b074f70cffb5a41","observation_id":"e2f2cebc-1786-4481-807a-a1fc31eef8a1","resolution":{"observed_at":"2026-08-11T00:18:57.234241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08747","last_updated":"2025-01-05T04:09:00Z","snapshot_observed_at":"2026-08-10T01:52:30.559515Z","submitted_at":"2023-08-17T02:53:23Z","title":"An Empirical Study of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08747","snapshot_observed_at":"2026-08-11T00:18:57.239024Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.239024Z"},"links":{"cited_paper":"/paper/2308.08747","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:bbca9b8ea26e7c5d6de4e54dc37208c1ebe238c689106a6c86ca7db565032c81","observation_id":"37e8b2ae-a17b-47b6-a3c8-faffc56c6b8a","resolution":{"observed_at":"2026-08-11T00:18:57.239024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11296","last_updated":"2025-05-22T23:03:47Z","snapshot_observed_at":"2026-08-15T11:34:36.001446Z","submitted_at":"2024-11-18T05:47:02Z","title":"Steering Language Model Refusal with Sparse Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11296","snapshot_observed_at":"2026-08-11T00:18:57.243698Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.243698Z"},"links":{"cited_paper":"/paper/2411.11296","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:92d00c2fd1b7e0faa52a629ab010d0469addffd9e47540bdd09236271aea8fa9","observation_id":"c45399fd-ffbc-430f-98fa-da9585ea3673","resolution":{"observed_at":"2026-08-11T00:18:57.243698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T00:18:57.248304Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.248304Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:ae371acafa49568499588ca8bcc7ac884023685847a67a205cc53fd5a3087213","observation_id":"b28e9ca3-9dd2-49dc-9650-ab4e13fa51d9","resolution":{"observed_at":"2026-08-11T00:18:57.248304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-11T00:18:57.253612Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.253612Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:91ed59ac00ce42ce12431792cfcb0c3b1c52d97329d2c90e70265670272e1561","observation_id":"9d427485-1f16-4aff-a2bb-16bc870c7513","resolution":{"observed_at":"2026-08-11T00:18:57.253612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.964490Z","title":"Patil, Tianjun Zhang, Xin Wang, and Joseph E","venue":null,"work_id":"390bd97c-62a8-4c9c-9404-db203af08a23","year":2023},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.258091Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:b58063fc96c51a28ce89fa164e9a49ef851a002f7723818f1f14b13497e51dbc","observation_id":"606fa7c1-b3ea-4a90-9312-691bac18423c","resolution":{"observed_at":"2026-08-11T00:18:57.969148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.262779Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.262779Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:7eb6199979ac5450801b6fe2cd59d8bd820bca5bc85205e66eab640a58ca8346","observation_id":"6984abc4-3de2-4ea2-823c-c29bbb092ddd","resolution":{"observed_at":"2026-08-11T00:18:57.262779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.268347Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.268347Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:cc901f6a18e464b66257d0ab2c385538331175edfd4896ff5f69d36f7bbd664d","observation_id":"a0c154c0-40e2-4d93-92a5-63313287e8af","resolution":{"observed_at":"2026-08-11T00:18:57.268347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.272888Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.272888Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:155cf9d2d9404d8bf00032d38782b93dfb495f8df54e00715d51b2eae26bd4e4","observation_id":"f83f2ac8-decf-4b56-859e-7f72e3acb095","resolution":{"observed_at":"2026-08-11T00:18:57.272888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.503","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.446727Z","title":null,"venue":null,"work_id":"ed6c6847-768f-45b8-8ee2-627328eef506","year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.277282Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:43352969c48e3ffdc0965b914542cb7f16eadf8917654bd35ee18e3e43229aa5","observation_id":"4ea73843-acfd-4c78-b012-0d165824a4a5","resolution":{"observed_at":"2026-08-11T00:18:57.451041Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.281228Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.281228Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:1debf357c019c2f1419b833e6d3eb22d805e3db35ecd99cb2fd46bbd914784d3","observation_id":"506734e3-029b-4625-a317-972082c5716b","resolution":{"observed_at":"2026-08-11T00:18:57.281228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-11T00:18:57.285277Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.285277Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:a69146576db88bb69181bea19c81b476d2cff233cf8cd40db889ad36ae41e8f1","observation_id":"cc1abd00-ea36-460c-a646-8c251f96686d","resolution":{"observed_at":"2026-08-11T00:18:57.285277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.289369Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.289369Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:8050490894af83055e4af8109da6058e3d26f9969a9bb196c4fd36d1c0cb55e6","observation_id":"81be9f56-6b6c-4385-9e26-8994908544d3","resolution":{"observed_at":"2026-08-11T00:18:57.289369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.908213Z","title":null,"venue":null,"work_id":"49db1b9a-74b4-44dc-80aa-55d418cb3f40","year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.293248Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:29369cbbd915caefc0578825afafeedc808ac3f3bb57ecaae33811259bc382c8","observation_id":"65cc7a7f-dc18-481b-84cf-56f7ade16304","resolution":{"observed_at":"2026-08-11T00:18:57.914020Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.890996Z","title":null,"venue":null,"work_id":"200568a5-c25e-44fd-b3c6-9e0c8a8602f3","year":2017},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.297149Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:f13843f209d1f1818aa12ce27e8fe4ad6002efa8b207ad6276f87882c55d96f7","observation_id":"9cd53d52-179c-4626-82ca-07d4772ebfb2","resolution":{"observed_at":"2026-08-11T00:18:57.895988Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.875271Z","title":null,"venue":null,"work_id":"3f2fc563-9516-4f86-8953-540a3d4d0bf1","year":2022},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.301429Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:946807b1ce30f1d9c1e3936910a885ffb00b8efd26c792643e7ba0c385097155","observation_id":"ba9c54d4-2cf8-44dc-bb73-b9c9728300e1","resolution":{"observed_at":"2026-08-11T00:18:57.880020Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.859894Z","title":null,"venue":null,"work_id":"91fd3a61-5f61-44fc-a4d2-62cb8d01ec7d","year":2022},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.305506Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:4a79126e1deb68f8cdd92e15b8f10bcaa54d5cae03cc743dd5d5f8592362d73f","observation_id":"1195a6c3-ca05-48a1-ab0c-9b7398401691","resolution":{"observed_at":"2026-08-11T00:18:57.864541Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-acl.66","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.421104Z","title":null,"venue":null,"work_id":"94abed2a-421c-4016-88c8-0342338f0a9f","year":2025},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.309458Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:96d6519dc21e64177cbb6f64e25e5989ca0c8230428d6cb39be3f4bd09e1f2e2","observation_id":"37371682-f637-4edd-a981-9cf9a3da808e","resolution":{"observed_at":"2026-08-11T00:18:57.427088Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.844183Z","title":null,"venue":null,"work_id":"8bfc4e8f-37e9-4aee-a61b-2497149aa55a","year":2025},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.314081Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:ca8159b79b46445f97b952309ceef5f49a7dce9e82e78f06e45a5ce5967ea9d4","observation_id":"c474736d-c6f6-40d5-8094-baa91145fd97","resolution":{"observed_at":"2026-08-11T00:18:57.849504Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.318175Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.318175Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:90a125ca6449e74837eb9a0dcd9ed2ca9ae5518ffa7ffc51980a605cc4e86d38","observation_id":"660f0cb2-37c9-4e4c-9e76-4badd7e039d7","resolution":{"observed_at":"2026-08-11T00:18:57.318175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02949","last_updated":"2023-10-04T16:39:31Z","snapshot_observed_at":"2026-08-13T05:57:27.605916Z","submitted_at":"2023-10-04T16:39:31Z","title":"Shadow Alignment: The Ease of Subverting Safely-Aligned Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02949","snapshot_observed_at":"2026-08-11T00:18:57.322310Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.322310Z"},"links":{"cited_paper":"/paper/2310.02949","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:e36633e1a4fc39eeb0789fc081234c3957f591c54f8edef0dd67f0eab64fab6e","observation_id":"303e0b88-975d-4769-a3c8-8d356b9950a2","resolution":{"observed_at":"2026-08-11T00:18:57.322310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.326362Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.326362Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:166c967f715651bde5a1875deb751eef50bfc69b63baa900e7dc717e6a5aad4e","observation_id":"e32e24a3-54a6-4a7b-90b4-d2f6d73c298e","resolution":{"observed_at":"2026-08-11T00:18:57.326362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09055","last_updated":"2024-05-15T03:04:05Z","snapshot_observed_at":"2026-08-13T00:07:33.019162Z","submitted_at":"2024-05-15T03:04:05Z","title":"A safety realignment framework via subspace-oriented model fusion for large language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09055","snapshot_observed_at":"2026-08-11T00:18:57.331014Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.331014Z"},"links":{"cited_paper":"/paper/2405.09055","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:8ae4c04efe49237e58e0cae504de2245da4b51dacd60f4fcd53860b20afa40f2","observation_id":"12882652-4d8a-49cf-8534-c6f29466875e","resolution":{"observed_at":"2026-08-11T00:18:57.331014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.829184Z","title":null,"venue":null,"work_id":"3e7533e3-0b56-44e8-b81b-e4cd807983a1","year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.335821Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:454f624502b559fec4ec9ba791655b67f23337be596c341a37f7382a2cfa10bb","observation_id":"40debd29-8179-4299-83fe-610fa81c608a","resolution":{"observed_at":"2026-08-11T00:18:57.833826Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.340125Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.340125Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:3fed950bf3c610f13dc87b87b5cb010ec220e41db3b89305c93fcc85cef61263","observation_id":"586cd658-5738-43be-9949-725ac913fcb9","resolution":{"observed_at":"2026-08-11T00:18:57.340125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:18:57.344622Z","title":"Weinberger, and Yoav Artzi","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.344622Z"},"links":{"citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:d425fa7a960043a60cd22e6000bfc8f7ab8283ee6c1c476bf967d7270681c3b5","observation_id":"1e0ab87e-e791-4654-bb2b-d4b6654abd16","resolution":{"observed_at":"2026-08-11T00:18:57.344622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13372","last_updated":"2024-06-27T22:44:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-20T08:08:54Z","title":"LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13372","snapshot_observed_at":"2026-08-11T00:18:57.348962Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.348962Z"},"links":{"cited_paper":"/paper/2403.13372","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:cb2ecc994f2ae94c4883d200317424c6209f5a332886c4de5066177c8d0cea44","observation_id":"5c7fd691-73c8-4b8e-adb4-c7ea122aa2da","resolution":{"observed_at":"2026-08-11T00:18:57.348962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-11T00:18:57.353609Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.353609Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:405f6b1fb7b26b37e0df9383b0e54707d770c71b5bb4f9e1b61781e5dc30c9df","observation_id":"d700507f-4e65-4384-836d-8df86fce00ec","resolution":{"observed_at":"2026-08-11T00:18:57.353609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-13T04:27:42.124177Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-08-11T00:18:57.358405Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T00:18:57.358405Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2412.19512"},"observation_digest":"sha256:d6a1013894d783dfe1ed055d73f944783d2f982eada3683c52d399a0f964dbf5","observation_id":"0ba08b25-c7d1-4545-896a-6847b723fea5","resolution":{"observed_at":"2026-08-11T00:18:57.358405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.19512","last_updated":"2025-08-28T01:13:45Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T04:53:46.476562Z","submitted_at":"2024-12-27T08:03:22Z","title":"Safeguard Fine-Tuned LLMs Through Pre- and Post-Tuning Model Merging"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":3,"verified_fuzzy":1},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 6 inbound Pith citation observations for arXiv:2412.19512."}