{"as_of":"2026-08-14T12:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ff434bf769e40a461c7c743271582e4296bfc623e7d873562349d27df80ad4de","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:12:32.717267Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T07:46:16.678202Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T00:47:29.934082Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"cited_work":{"arxiv_id":"2507.03662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.03662","snapshot_observed_at":"2026-07-03T00:47:29.934082Z","title":"Isaia Gisler, Zhonghao He, and Tianyi Qiu","venue":null,"work_id":"bfe2d11d-e3ab-40c1-99cf-197a96702ba4","year":null},"citing_paper":{"arxiv_id":"2605.12798","last_updated":"2026-05-12T22:27:32Z","snapshot_observed_at":"2026-08-10T21:22:50.460073Z","submitted_at":"2026-05-12T22:27:32Z","title":"Emergent and Subliminal Misalignment Through the Lens of Data-Mediated Transfer","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-14T20:36:44.104197Z"},"links":{"cited_paper":"/paper/2507.03662","citing_paper":"/paper/2605.12798"},"observation_digest":"sha256:1b5642b4d5ae429babaaf9a929e62add82d52da6f364d092c244e6b143a7096e","observation_id":"bb166d1b-0ba0-4538-9556-df44c085b1e4","resolution":{"observed_at":"2026-05-14T20:39:26.793422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"cited_work":{"arxiv_id":"2507.03662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.03662","snapshot_observed_at":"2026-07-03T00:47:29.934082Z","title":"Isaia Gisler, Zhonghao He, and Tianyi Qiu","venue":null,"work_id":"bfe2d11d-e3ab-40c1-99cf-197a96702ba4","year":null},"citing_paper":{"arxiv_id":"2606.07612","last_updated":"2026-05-29T16:38:53Z","snapshot_observed_at":"2026-08-03T13:49:06.792444Z","submitted_at":"2026-05-29T16:38:53Z","title":"Position: Anthropomorphic Misalignment Research Needs Stronger Evidence","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-06-28T20:13:53.972585Z"},"links":{"cited_paper":"/paper/2507.03662","citing_paper":"/paper/2606.07612"},"observation_digest":"sha256:c7e859de6a50ca07ed603661404aae198eb2792d2e3b4a37d58ae2decbb78121","observation_id":"a9e7daba-9750-43ab-aaa4-3a5d18d69f6c","resolution":{"observed_at":"2026-06-28T20:22:37.266421Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"cited_work":{"arxiv_id":"2507.03662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.03662","snapshot_observed_at":"2026-07-03T00:47:29.934082Z","title":"Isaia Gisler, Zhonghao He, and Tianyi Qiu","venue":null,"work_id":"bfe2d11d-e3ab-40c1-99cf-197a96702ba4","year":null},"citing_paper":{"arxiv_id":"2606.08044","last_updated":"2026-08-04T12:50:00Z","snapshot_observed_at":"2026-08-07T23:11:38.433528Z","submitted_at":"2026-06-06T08:10:56Z","title":"When Behavioral Safety Evaluation Fails: A Representation-Level Perspective","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-27T20:04:17.744876Z"},"links":{"cited_paper":"/paper/2507.03662","citing_paper":"/paper/2606.08044"},"observation_digest":"sha256:514c521058e412cd812f2b3eb653e963024f5fb07e5d110143737d3a0559dfb0","observation_id":"54b7d6bf-2f22-4b85-a8b1-d71a6906e547","resolution":{"observed_at":"2026-07-02T20:57:23.094369Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"cited_work":{"arxiv_id":"2507.03662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.03662","snapshot_observed_at":"2026-07-03T00:47:29.934082Z","title":"Isaia Gisler, Zhonghao He, and Tianyi Qiu","venue":null,"work_id":"bfe2d11d-e3ab-40c1-99cf-197a96702ba4","year":null},"citing_paper":{"arxiv_id":"2606.09068","last_updated":"2026-06-08T06:05:47Z","snapshot_observed_at":"2026-08-12T12:19:55.865403Z","submitted_at":"2026-06-08T06:05:47Z","title":"Emergent Misalignment Can Be Induced by Sycophancy and Reversed via Alignment Gating","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-27T17:03:33.199645Z"},"links":{"cited_paper":"/paper/2507.03662","citing_paper":"/paper/2606.09068"},"observation_digest":"sha256:f96f9b7289d695fee5cd7eeab3219d7d3fdf03fc0ae219d2fbc986c3d9ff9dab","observation_id":"9f2ba424-287a-47fe-808c-60bbae68247a","resolution":{"observed_at":"2026-07-03T00:47:29.935594Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.03662","snapshot_observed_at":"2026-07-11T18:20:40.287006Z","title":"Re-emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs , 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04510","last_updated":"2026-08-03T19:51:37Z","snapshot_observed_at":"2026-08-13T04:53:43.299286Z","submitted_at":"2026-07-05T21:23:15Z","title":"Transplanting, inverting, and preventing a misalignment persona: method-conditional emergent misalignment in Qwen2.5","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-11T18:20:40.287006Z"},"links":{"cited_paper":"/paper/2507.03662","citing_paper":"/paper/2607.04510"},"observation_digest":"sha256:6a036e91ab171a690699baa90eb248965bbb58a4a482a0f453ee1e99d82ba418","observation_id":"dae3c0ef-8390-43fa-9503-c5e75a1078e8","resolution":{"observed_at":"2026-07-11T18:20:40.287006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.03662","snapshot_observed_at":"2026-08-01T07:46:16.678202Z","title":"arXiv preprint arXiv:2507.03662 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21356","last_updated":"2026-07-23T14:19:28Z","snapshot_observed_at":"2026-08-14T00:44:11.658093Z","submitted_at":"2026-07-23T14:19:28Z","title":"Emergent Misalignment Recruits a Pre-existing Persona Subspace","version":1},"reference_index":133,"source":"arxiv_source","source_observed_at":"2026-08-01T07:46:16.678202Z"},"links":{"cited_paper":"/paper/2507.03662","citing_paper":"/paper/2607.21356"},"observation_digest":"sha256:5fa0bfd3249e5f42807f73e5631be40ee98324fe147abb9b682a2783991468ba","observation_id":"71991987-2695-4185-8692-2fddc292ff96","resolution":{"observed_at":"2026-08-01T07:46:16.678202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.03662/citation-record","integrity":"/paper/2507.03662/integrity","json":"/paper/2507.03662/citation-record.json","paper":"/paper/2507.03662"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:30.497834Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:30.497834Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:94a398ad9847fb5bd4ddd5f9b2e6066afe5c111883e42331184990e15a11f0ce","observation_id":"62f4367f-cd43-4297-967f-69d6ae87b075","resolution":{"observed_at":"2026-08-06T20:12:30.497834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:30.565244Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:30.565244Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:9186623eb0dc4a716c691baea781f5348381d10a729a5610f9fcc17d74a05bfb","observation_id":"25dbe0fd-3487-41a7-b685-04a8f11c4335","resolution":{"observed_at":"2026-08-06T20:12:30.565244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:33.138274Z","title":null,"venue":null,"work_id":"78af92a1-44e4-4c17-b8b6-ab747e5fe9a3","year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:30.799717Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:431eb712e63c35581d50dc6963a8b32c27cb24f4671c539bcf6f55ae73dc49e8","observation_id":"a5c470c2-9592-4749-a3eb-23587dfd7d9d","resolution":{"observed_at":"2026-08-06T20:12:33.140998Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-06T20:12:30.963700Z","title":"Bowman, Zac Hatfield-Dodds, Ben Mann, Dario Amodei, Nicholas Joseph, Sam McCandlish, Tom Brown, and Jared Kaplan","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:30.963700Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:178c34f6f43c718e34ca11c8606ff9a457c00ccd884a9ef4b24deae2a18b414a","observation_id":"ca7bb3f9-e6e4-4ac1-8ab9-ecfc7afcde91","resolution":{"observed_at":"2026-08-06T20:12:30.963700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:33.130588Z","title":null,"venue":null,"work_id":"b488eed0-8d85-42f0-acb5-0d4d12b8a383","year":2023},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:31.086504Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:1bf1aa8b1486e2af2db0896a910fde6738b34069e980b65b38dd512f6c04caa0","observation_id":"97a054a0-bc05-4b2c-a4df-343e9ba49a7e","resolution":{"observed_at":"2026-08-06T20:12:33.133118Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:31.194346Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:31.194346Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:915e77eb1a9e0ffba0d7a156032f5da1fe03dcb92bd18ab87c57d365a765622a","observation_id":"b299773b-7daa-495b-bb1a-9afbb6bba5c0","resolution":{"observed_at":"2026-08-06T20:12:31.194346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:33.122275Z","title":null,"venue":null,"work_id":"1b9356b4-8346-4910-9243-1f1cfc83598a","year":2022},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:31.342729Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:d027c9800538637f4cf3658cc0d457a1ec3a80d4510ae32222107e67ec8177ad","observation_id":"625618f7-5876-4f5c-9d46-a9ca13d9fed9","resolution":{"observed_at":"2026-08-06T20:12:33.125055Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14093","last_updated":"2024-12-20T02:22:19Z","snapshot_observed_at":"2026-08-13T11:12:58.507759Z","submitted_at":"2024-12-18T17:41:24Z","title":"Alignment faking in large language models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14093","snapshot_observed_at":"2026-08-06T20:12:31.417382Z","title":"Bowman, and Evan Hubinger","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:31.417382Z"},"links":{"cited_paper":"/paper/2412.14093","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:3578dec4b175eb66515f7f0014c1e17a6f70a9599df1bad18252d2a77b1e53e5","observation_id":"3cc5fc6c-864d-44a4-b643-d10f4d2acc4a","resolution":{"observed_at":"2026-08-06T20:12:31.417382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-06T20:12:31.510017Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:31.510017Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:ab352bfe914bf68eda87e517a731b24b8608ff5c8523a309bb045d637712cde0","observation_id":"cd9b383d-6907-4e68-a577-33a83da7a7c5","resolution":{"observed_at":"2026-08-06T20:12:31.510017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:33.114030Z","title":null,"venue":null,"work_id":"e1ec54eb-6d1b-42af-8bf5-f9f051a1bae2","year":2023},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:31.619729Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:b181a86547189aa787f41f8a37c5d42de3b80cd392bac6e04ca78a7f4100141e","observation_id":"6ef3bc1d-de03-4454-8877-edee4a792cf4","resolution":{"observed_at":"2026-08-06T20:12:33.116840Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23743","last_updated":"2025-06-05T02:01:49Z","snapshot_observed_at":"2026-08-12T22:11:03.271393Z","submitted_at":"2024-10-31T08:58:06Z","title":"What Happened in LLMs Layers when Trained for Fast vs. Slow Thinking: A Gradient Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23743","snapshot_observed_at":"2026-08-06T20:12:31.713901Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:31.713901Z"},"links":{"cited_paper":"/paper/2410.23743","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:a8be48711bedc1f03fd42798eddfa5faffd5019490ce8bac63f08997aaee049e","observation_id":"e5f17dd1-7cd4-439e-a439-a55953373809","resolution":{"observed_at":"2026-08-06T20:12:31.713901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:31.818876Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:31.818876Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:ebb40d861d62acb0d6161864fb6b01724523f5750733922a99b5dc76a62d9c46","observation_id":"c72ec5de-4211-420b-96be-6e2b12e39de5","resolution":{"observed_at":"2026-08-06T20:12:31.818876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-06T20:12:31.934646Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:31.934646Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:080948e45ee21f24793d02370b330c2a2879233d82fefd331fdedf28b374eee9","observation_id":"4352885e-eeab-4b84-bd8f-08c00e0f0c34","resolution":{"observed_at":"2026-08-06T20:12:31.934646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06824","last_updated":"2024-08-19T01:18:41Z","snapshot_observed_at":"2026-07-06T16:30:37.867641Z","submitted_at":"2023-10-10T17:54:39Z","title":"The Geometry of Truth: Emergent Linear Structure in Large Language Model Representations of True/False Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06824","snapshot_observed_at":"2026-08-06T20:12:32.082534Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.082534Z"},"links":{"cited_paper":"/paper/2310.06824","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:863586e2a51990a66d1add4151861799e5a5702504001405fd25cdc3b57b52ed","observation_id":"9295086e-065f-4692-bae0-5645d92b2092","resolution":{"observed_at":"2026-08-06T20:12:32.082534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04984","last_updated":"2025-01-14T20:16:01Z","snapshot_observed_at":"2026-08-14T10:15:12.633739Z","submitted_at":"2024-12-06T12:09:50Z","title":"Frontier Models are Capable of In-context Scheming","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04984","snapshot_observed_at":"2026-08-06T20:12:32.170069Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.170069Z"},"links":{"cited_paper":"/paper/2412.04984","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:49ebc31052c14a47cfd46c09b6b60ce1b7dcd0d6d3ffda7fb7e82ffa69867cc2","observation_id":"89996c97-33f7-4b19-af30-445a6f932ffb","resolution":{"observed_at":"2026-08-06T20:12:32.170069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:33.100769Z","title":null,"venue":null,"work_id":"ff2cf3a4-e13a-4516-9a0b-d85b5a3c1189","year":2022},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.292132Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:45e85889ff9e3ed1ebd4ac176ead972cf9d514c1613bd3f9e96c976b8c55d391","observation_id":"7b2a8d3a-8b9f-4bc4-a50d-dc6304d93ee6","resolution":{"observed_at":"2026-08-06T20:12:33.103446Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09674","last_updated":"2025-05-27T08:40:42Z","snapshot_observed_at":"2026-08-13T22:50:26.223810Z","submitted_at":"2025-02-13T06:39:22Z","title":"The Hidden Dimensions of LLM Alignment: A Multi-Dimensional Analysis of Orthogonal Safety Directions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09674","snapshot_observed_at":"2026-08-06T20:12:32.398404Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.398404Z"},"links":{"cited_paper":"/paper/2502.09674","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:6687aa6dd9e588629fee6283086470e0cc37392601f4851ba0ed5a5c9d548c6b","observation_id":"b416694e-7921-4807-93b9-12890c8c63dc","resolution":{"observed_at":"2026-08-06T20:12:32.398404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:33.092465Z","title":null,"venue":null,"work_id":"b9bbe134-9c93-4955-b5fd-61e6668e736a","year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.567511Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:1063871b95d7f6f5270123ba4c752847976640037839309b130630527f26caf9","observation_id":"939f9b4c-eefc-4e53-a938-b2c1c323f77b","resolution":{"observed_at":"2026-08-06T20:12:33.095322Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:32.643003Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.643003Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:23ca05c0f3fa127eb54c7b73a285bb7cc7d4deb5224d9542d9060fd25b3bfb2a","observation_id":"bafb2894-8f73-459c-8955-986e3df6e39a","resolution":{"observed_at":"2026-08-06T20:12:32.643003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15025","last_updated":"2023-09-26T15:49:23Z","snapshot_observed_at":"2026-08-13T10:04:36.296007Z","submitted_at":"2023-09-26T15:49:23Z","title":"Large Language Model Alignment: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15025","snapshot_observed_at":"2026-08-06T20:12:32.681144Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.681144Z"},"links":{"cited_paper":"/paper/2309.15025","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:18769b81386c000f04d1a4a1e8ee60a6be16fac4fa0be30880e98aecfa80f3b1","observation_id":"65189b11-ca14-4d88-a6e2-8eccd78c7420","resolution":{"observed_at":"2026-08-06T20:12:32.681144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:33.078290Z","title":null,"venue":null,"work_id":"f090d180-425a-4372-82d9-9efd2e387c9b","year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.699969Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:019374beb38fdb56d4e8d7b5ddf05d85ab2da9cff52d511459d639a8bd27c100","observation_id":"9f9a9da4-00a7-4c63-99f1-b22f0e2864bb","resolution":{"observed_at":"2026-08-06T20:12:33.080992Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:33.069694Z","title":"Zhao, Kelvin Guu, Adams Wei Yu, Brian Lester, Nan Du, Andrew M","venue":null,"work_id":"7aee3291-eb65-485e-a398-1c4c8e53399b","year":2022},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.703259Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:3992a2a82799b45227ff947f72a6546931123330b7246e703e202d9a8450a075","observation_id":"977ae365-45ac-4b9a-a33d-300974733ea9","resolution":{"observed_at":"2026-08-06T20:12:33.072891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16332","last_updated":"2025-05-27T10:39:39Z","snapshot_observed_at":"2026-08-13T04:32:29.829038Z","submitted_at":"2024-01-29T17:38:14Z","title":"Tradeoffs Between Alignment and Helpfulness in Language Models with Steering Methods","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16332","snapshot_observed_at":"2026-08-06T20:12:32.706277Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.706277Z"},"links":{"cited_paper":"/paper/2401.16332","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:535888f0e87bf58cb580030ac9fd1a37d904969922fb8ff889923d2fdf54a625","observation_id":"197cdb0f-11bf-4a8f-b2f3-cdaac7a31d69","resolution":{"observed_at":"2026-08-06T20:12:32.706277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:32.709279Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.709279Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:c1c28d3b04e8a6464fcc479b053e0d4b5382f20c85fcc8f1eaf863244cf5b25f","observation_id":"bdee2e24-4579-4b38-a4bc-fb759751952f","resolution":{"observed_at":"2026-08-06T20:12:32.709279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:32.711845Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.711845Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:e1e07f7afa83b23d0ad4f53942f09d0d856dc53d8204ee6bfb398b24d1e0a1b2","observation_id":"21face3e-8415-4880-af1a-fe573448aef9","resolution":{"observed_at":"2026-08-06T20:12:32.711845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:33.060118Z","title":null,"venue":null,"work_id":"a3795265-23cc-47f5-8c9a-172726f3075c","year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.714663Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:412b286e9da41fe50ab4ec4b9181eaa0fd4cd21351d77be53d631742d60156ef","observation_id":"11ef7507-24b9-4b9b-8132-d4782471ece7","resolution":{"observed_at":"2026-08-06T20:12:33.063688Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-06T20:12:32.717267Z","title":"Byun, Zifan Wang, Alex Mallen, Steven Basart, Sanmi Koyejo, Dawn Song, Matt Fredrikson, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.717267Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:8b4e30d29670a7fe9e594fb1b91da1840a2c3ca1f6bf81346cd0a1f5595a1a10","observation_id":"3798a0a1-33f5-473c-9ba6-a532c6038529","resolution":{"observed_at":"2026-08-06T20:12:32.717267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T01:25:56.961867Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 6 inbound Pith citation observations for arXiv:2507.03662."}