{"as_of":"2026-08-10T04:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2422cbc76efd6327dbc5b887e236a069fc555ce6b9189e02320d7ca1551126bf","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T05:42:43.475213Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T17:38:43.807884Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.20053","last_updated":"2024-06-28T17:05:46Z","snapshot_observed_at":"2026-07-06T18:38:33.882786Z","submitted_at":"2024-06-28T17:05:46Z","title":"Covert Malicious Finetuning: Challenges in Safeguarding LLM Adaptation","version":1},"cited_work":{"arxiv_id":"2406.20053","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.20053","snapshot_observed_at":"2026-07-03T17:38:43.807884Z","title":"T., Haghtalab, N., and Steinhardt, J","venue":null,"work_id":"fb25b159-bc80-432c-8310-71c9b46f8f50","year":2024},"citing_paper":{"arxiv_id":"2409.18169","last_updated":"2026-04-23T18:48:49Z","snapshot_observed_at":"2026-07-06T19:22:58.341345Z","submitted_at":"2024-09-26T17:55:22Z","title":"Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey","version":6},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-23T20:58:16.237327Z"},"links":{"cited_paper":"/paper/2406.20053","citing_paper":"/paper/2409.18169"},"observation_digest":"sha256:15864efc5828dbd015d560cf0d7233179f7148ba358f4a40271385d233551229","observation_id":"f146f0cf-5d29-4f7f-ad00-53bf24f4e648","resolution":{"observed_at":"2026-05-23T20:58:26.280364Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20053","last_updated":"2024-06-28T17:05:46Z","snapshot_observed_at":"2026-07-06T18:38:33.882786Z","submitted_at":"2024-06-28T17:05:46Z","title":"Covert Malicious Finetuning: Challenges in Safeguarding LLM Adaptation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.20053","snapshot_observed_at":"2026-08-08T05:42:43.475213Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08301","last_updated":"2025-06-23T09:04:32Z","snapshot_observed_at":"2026-08-09T07:42:28.077349Z","submitted_at":"2025-02-12T11:02:59Z","title":"Compromising Honesty and Harmlessness in Language Models via Deception Attacks","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T05:42:43.475213Z"},"links":{"cited_paper":"/paper/2406.20053","citing_paper":"/paper/2502.08301"},"observation_digest":"sha256:3339c14ffd06c9dbcb015a83639717884e467112faf33fc090dbfcbff774b443","observation_id":"8ba51696-cc2b-45bd-98ac-6316dedf5d0e","resolution":{"observed_at":"2026-08-08T05:42:43.475213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20053","last_updated":"2024-06-28T17:05:46Z","snapshot_observed_at":"2026-07-06T18:38:33.882786Z","submitted_at":"2024-06-28T17:05:46Z","title":"Covert Malicious Finetuning: Challenges in Safeguarding LLM Adaptation","version":1},"cited_work":{"arxiv_id":"2406.20053","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.20053","snapshot_observed_at":"2026-07-03T17:38:43.807884Z","title":"T., Haghtalab, N., and Steinhardt, J","venue":null,"work_id":"fb25b159-bc80-432c-8310-71c9b46f8f50","year":2024},"citing_paper":{"arxiv_id":"2506.06414","last_updated":"2026-04-20T20:58:30Z","snapshot_observed_at":"2026-08-03T02:03:44.971897Z","submitted_at":"2025-06-06T17:33:33Z","title":"Benchmarking Misuse Mitigation Against Covert Adversaries","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-19T10:29:05.104520Z"},"links":{"cited_paper":"/paper/2406.20053","citing_paper":"/paper/2506.06414"},"observation_digest":"sha256:e0cd13329571977ad7efe5f2daf78630c4f4b0b056a58056a8a1a5783150fabd","observation_id":"2da52532-3665-422b-b902-6af623ea321d","resolution":{"observed_at":"2026-05-19T10:32:14.767204Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20053","last_updated":"2024-06-28T17:05:46Z","snapshot_observed_at":"2026-07-06T18:38:33.882786Z","submitted_at":"2024-06-28T17:05:46Z","title":"Covert Malicious Finetuning: Challenges in Safeguarding LLM Adaptation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.20053","snapshot_observed_at":"2026-08-06T22:23:08.525510Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22521","last_updated":"2025-06-26T22:02:01Z","snapshot_observed_at":"2026-08-07T22:00:37.560675Z","submitted_at":"2025-06-26T22:02:01Z","title":"A Survey on Model Extraction Attacks and Defenses for Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:08.525510Z"},"links":{"cited_paper":"/paper/2406.20053","citing_paper":"/paper/2506.22521"},"observation_digest":"sha256:c01cf77b197cdee9b729a65e00065bcf0451fd44919d158be73a336f329e903f","observation_id":"fef00b4a-a03c-461e-b9c9-0382cfbf997d","resolution":{"observed_at":"2026-08-06T22:23:08.525510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20053","last_updated":"2024-06-28T17:05:46Z","snapshot_observed_at":"2026-07-06T18:38:33.882786Z","submitted_at":"2024-06-28T17:05:46Z","title":"Covert Malicious Finetuning: Challenges in Safeguarding LLM Adaptation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.20053","snapshot_observed_at":"2026-08-05T11:39:20.462571Z","title":"Covert malicious finetuning: Challenges in safeguarding llm adaptation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02411","last_updated":"2025-09-02T15:19:57Z","snapshot_observed_at":"2026-08-06T21:38:56.067118Z","submitted_at":"2025-09-02T15:19:57Z","title":"A Survey: Towards Privacy and Security in Mobile Large Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T11:39:20.462571Z"},"links":{"cited_paper":"/paper/2406.20053","citing_paper":"/paper/2509.02411"},"observation_digest":"sha256:5d7fb8549e5b464408101f939c39753e081e05bf5a8ea07881c1c1f9799bc471","observation_id":"9032a2ed-a944-4fda-b5aa-a94c4b5857f4","resolution":{"observed_at":"2026-08-05T11:39:20.462571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20053","last_updated":"2024-06-28T17:05:46Z","snapshot_observed_at":"2026-07-06T18:38:33.882786Z","submitted_at":"2024-06-28T17:05:46Z","title":"Covert Malicious Finetuning: Challenges in Safeguarding LLM Adaptation","version":1},"cited_work":{"arxiv_id":"2406.20053","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.20053","snapshot_observed_at":"2026-07-03T17:38:43.807884Z","title":"T., Haghtalab, N., and Steinhardt, J","venue":null,"work_id":"fb25b159-bc80-432c-8310-71c9b46f8f50","year":2024},"citing_paper":{"arxiv_id":"2511.02356","last_updated":"2026-04-20T12:25:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-04T08:24:22Z","title":"ASTRA: An Automated Framework for Strategy Discovery, Retrieval, and Evolution for Jailbreaking LLMs","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-18T01:54:22.995178Z"},"links":{"cited_paper":"/paper/2406.20053","citing_paper":"/paper/2511.02356"},"observation_digest":"sha256:a1d654981359723a8c5b2e87fa8e3196769f9a8f0c124edc8f61cf2989822bf4","observation_id":"2e151fc8-31fa-45ff-b41c-4a353e8a2f19","resolution":{"observed_at":"2026-05-18T01:55:37.997525Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20053","last_updated":"2024-06-28T17:05:46Z","snapshot_observed_at":"2026-07-06T18:38:33.882786Z","submitted_at":"2024-06-28T17:05:46Z","title":"Covert Malicious Finetuning: Challenges in Safeguarding LLM Adaptation","version":1},"cited_work":{"arxiv_id":"2406.20053","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.20053","snapshot_observed_at":"2026-07-03T17:38:43.807884Z","title":"T., Haghtalab, N., and Steinhardt, J","venue":null,"work_id":"fb25b159-bc80-432c-8310-71c9b46f8f50","year":2024},"citing_paper":{"arxiv_id":"2604.07754","last_updated":"2026-04-09T03:20:29Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T03:20:29Z","title":"The Art of (Mis)alignment: How Fine-Tuning Methods Effectively Misalign and Realign LLMs in Post-Training","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T18:18:56.476698Z"},"links":{"cited_paper":"/paper/2406.20053","citing_paper":"/paper/2604.07754"},"observation_digest":"sha256:85fdb74e377dc95c6b474cd5378521cb625ef122017f0c9ee4a40ae22d688671","observation_id":"a27b54f0-9bc7-4f98-83b4-a5b699d9b133","resolution":{"observed_at":"2026-05-11T00:45:50.605409Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20053","last_updated":"2024-06-28T17:05:46Z","snapshot_observed_at":"2026-07-06T18:38:33.882786Z","submitted_at":"2024-06-28T17:05:46Z","title":"Covert Malicious Finetuning: Challenges in Safeguarding LLM Adaptation","version":1},"cited_work":{"arxiv_id":"2406.20053","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.20053","snapshot_observed_at":"2026-07-03T17:38:43.807884Z","title":"T., Haghtalab, N., and Steinhardt, J","venue":null,"work_id":"fb25b159-bc80-432c-8310-71c9b46f8f50","year":2024},"citing_paper":{"arxiv_id":"2605.10998","last_updated":"2026-05-09T15:52:29Z","snapshot_observed_at":"2026-08-03T01:46:31.309604Z","submitted_at":"2026-05-09T15:52:29Z","title":"Few-Shot Truly Benign DPO Attack for Jailbreaking LLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-13T07:06:46.387088Z"},"links":{"cited_paper":"/paper/2406.20053","citing_paper":"/paper/2605.10998"},"observation_digest":"sha256:ebf8dffe9e39a99843cd16e62d2558b6d70c9cf2f1f1702d4d847f247c0e2ae1","observation_id":"5e9508a6-668e-4928-a60a-80e0d49d23df","resolution":{"observed_at":"2026-05-13T07:07:27.068775Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20053","last_updated":"2024-06-28T17:05:46Z","snapshot_observed_at":"2026-07-06T18:38:33.882786Z","submitted_at":"2024-06-28T17:05:46Z","title":"Covert Malicious Finetuning: Challenges in Safeguarding LLM Adaptation","version":1},"cited_work":{"arxiv_id":"2406.20053","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.20053","snapshot_observed_at":"2026-07-03T17:38:43.807884Z","title":"T., Haghtalab, N., and Steinhardt, J","venue":null,"work_id":"fb25b159-bc80-432c-8310-71c9b46f8f50","year":2024},"citing_paper":{"arxiv_id":"2606.02609","last_updated":"2026-06-04T21:57:13Z","snapshot_observed_at":"2026-08-01T15:36:46.336573Z","submitted_at":"2026-05-23T20:37:33Z","title":"Building Better Activation Oracles","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-30T14:19:37.262201Z"},"links":{"cited_paper":"/paper/2406.20053","citing_paper":"/paper/2606.02609"},"observation_digest":"sha256:868d6dfc2433e1d542d6f8dc5b913d57dd68369af3d5148675ea41de7d538fdd","observation_id":"ac318e72-8f7c-494a-8eda-0db4c377f68e","resolution":{"observed_at":"2026-06-30T14:24:45.001679Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20053","last_updated":"2024-06-28T17:05:46Z","snapshot_observed_at":"2026-07-06T18:38:33.882786Z","submitted_at":"2024-06-28T17:05:46Z","title":"Covert Malicious Finetuning: Challenges in Safeguarding LLM Adaptation","version":1},"cited_work":{"arxiv_id":"2406.20053","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.20053","snapshot_observed_at":"2026-07-03T17:38:43.807884Z","title":"T., Haghtalab, N., and Steinhardt, J","venue":null,"work_id":"fb25b159-bc80-432c-8310-71c9b46f8f50","year":2024},"citing_paper":{"arxiv_id":"2606.17110","last_updated":"2026-06-15T07:04:01Z","snapshot_observed_at":"2026-08-05T23:11:05.452983Z","submitted_at":"2026-06-15T07:04:01Z","title":"Loss Landscape Poisoning: Targeted Extraction of Unseen Training Data from LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T03:59:30.468854Z"},"links":{"cited_paper":"/paper/2406.20053","citing_paper":"/paper/2606.17110"},"observation_digest":"sha256:4507bb7aa5b9ae1222a7e0bb1b9c0c735f14e029bbf67fb8df26f87252ea353a","observation_id":"a8c446a6-f145-44fb-83b7-7d27d5f358e7","resolution":{"observed_at":"2026-07-03T17:38:43.809194Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2406.20053/citation-record","integrity":"/paper/2406.20053/integrity","json":"/paper/2406.20053/citation-record.json","paper":"/paper/2406.20053"},"outbound":[],"paper":{"arxiv_id":"2406.20053","last_updated":"2024-06-28T17:05:46Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-07-06T18:38:33.882786Z","submitted_at":"2024-06-28T17:05:46Z","title":"Covert Malicious Finetuning: Challenges in Safeguarding LLM Adaptation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2406.20053."}