{"as_of":"2026-08-08T23:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4febcd6466bd553ddd77db27410c003429f615e39969c5a24f04a1bba34481ef","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:02:33.690065Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.04524","last_updated":"2025-02-17T02:32:33Z","snapshot_observed_at":"2026-07-06T19:28:39.495408Z","submitted_at":"2024-10-06T15:34:04Z","title":"Toward Secure Tuning: Mitigating Security Risks from Instruction Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2410.04524","doi":"10.48550/arxiv.2410.04524","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.04524","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards secure tuning: Mitigating security risks arising from benign instruction fine-tuning","venue":"arXiv (Cornell University)","work_id":"ba087fb5-090b-4bd1-8504-6899076427da","year":2024},"citing_paper":{"arxiv_id":"2409.18169","last_updated":"2026-04-23T18:48:49Z","snapshot_observed_at":"2026-07-06T19:22:58.341345Z","submitted_at":"2024-09-26T17:55:22Z","title":"Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey","version":6},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-23T20:58:16.237327Z"},"links":{"cited_paper":"/paper/2410.04524","citing_paper":"/paper/2409.18169"},"observation_digest":"sha256:091c1fb6ef531566fa37c60c8108ff1125ea3dae021cd776291b0c34cc58d6f0","observation_id":"58f9adb2-0685-432f-b6b5-f01d0a117206","resolution":{"observed_at":"2026-05-23T20:58:26.039828Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04524","last_updated":"2025-02-17T02:32:33Z","snapshot_observed_at":"2026-07-06T19:28:39.495408Z","submitted_at":"2024-10-06T15:34:04Z","title":"Toward Secure Tuning: Mitigating Security Risks from Instruction Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04524","snapshot_observed_at":"2026-08-07T15:02:33.690065Z","title":"Towards secure tuning: Miti- gating security risks arising from benign instruction fine-tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16559","last_updated":"2025-05-22T11:47:08Z","snapshot_observed_at":"2026-08-07T14:56:28.471596Z","submitted_at":"2025-05-22T11:47:08Z","title":"CTRAP: Embedding Collapse Trap to Safeguard Large Language Models from Harmful Fine-Tuning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:33.690065Z"},"links":{"cited_paper":"/paper/2410.04524","citing_paper":"/paper/2505.16559"},"observation_digest":"sha256:9f92ab387ada293cb01ce0874f8051fc12910466dd2627ffa5e80de0b44d8e58","observation_id":"945327e5-42c1-4dcd-9ef0-14fb7d36d7b5","resolution":{"observed_at":"2026-08-07T15:02:33.690065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04524","last_updated":"2025-02-17T02:32:33Z","snapshot_observed_at":"2026-07-06T19:28:39.495408Z","submitted_at":"2024-10-06T15:34:04Z","title":"Toward Secure Tuning: Mitigating Security Risks from Instruction Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04524","snapshot_observed_at":"2026-08-07T14:15:18.441128Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19670","last_updated":"2025-05-26T08:25:25Z","snapshot_observed_at":"2026-08-07T14:06:45.672196Z","submitted_at":"2025-05-26T08:25:25Z","title":"Reshaping Representation Space to Balance the Safety and Over-rejection in Large Audio Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:15:18.441128Z"},"links":{"cited_paper":"/paper/2410.04524","citing_paper":"/paper/2505.19670"},"observation_digest":"sha256:b756195d6f6fdf5de23296dde45624bf49006ed6a0eb3da0f8a2ec2db325a39e","observation_id":"4c0a44ed-ae13-4cf9-9eda-91c3020efaa5","resolution":{"observed_at":"2026-08-07T14:15:18.441128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04524","last_updated":"2025-02-17T02:32:33Z","snapshot_observed_at":"2026-07-06T19:28:39.495408Z","submitted_at":"2024-10-06T15:34:04Z","title":"Toward Secure Tuning: Mitigating Security Risks from Instruction Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04524","snapshot_observed_at":"2026-08-04T23:09:41.463474Z","title":"Towards secure tuning: Mitigating security risks arising from benign instruction fine-tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06807","last_updated":"2025-09-08T15:39:17Z","snapshot_observed_at":"2026-08-06T11:18:26.434722Z","submitted_at":"2025-09-08T15:39:17Z","title":"MoGU V2: Toward a Higher Pareto Frontier Between Model Usability and Security","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T23:09:41.463474Z"},"links":{"cited_paper":"/paper/2410.04524","citing_paper":"/paper/2509.06807"},"observation_digest":"sha256:432b5a7e015d7d4aaa89afdb33920b64d37c3db3602c03143e3a4ad795e17e68","observation_id":"0a575274-5666-4764-9913-0df741e67ef7","resolution":{"observed_at":"2026-08-04T23:09:41.463474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04524","last_updated":"2025-02-17T02:32:33Z","snapshot_observed_at":"2026-07-06T19:28:39.495408Z","submitted_at":"2024-10-06T15:34:04Z","title":"Toward Secure Tuning: Mitigating Security Risks from Instruction Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2410.04524","doi":"10.48550/arxiv.2410.04524","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.04524","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards secure tuning: Mitigating security risks arising from benign instruction fine-tuning","venue":"arXiv (Cornell University)","work_id":"ba087fb5-090b-4bd1-8504-6899076427da","year":2024},"citing_paper":{"arxiv_id":"2601.14004","last_updated":"2026-04-14T03:49:06Z","snapshot_observed_at":"2026-07-31T09:24:49.481740Z","submitted_at":"2026-01-20T14:23:23Z","title":"Locate, Steer, and Improve: A Practical Survey of Actionable Mechanistic Interpretability in Large Language Models","version":4},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-16T12:39:57.398423Z"},"links":{"cited_paper":"/paper/2410.04524","citing_paper":"/paper/2601.14004"},"observation_digest":"sha256:475aaf0dfeb7f3e6dcea53c2cc8cf34963ad8107b8f0016dc6452b1dbb156ce2","observation_id":"5924b097-09e9-462d-8eb5-a4d38184c206","resolution":{"observed_at":"2026-05-16T12:40:54.418934Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04524","last_updated":"2025-02-17T02:32:33Z","snapshot_observed_at":"2026-07-06T19:28:39.495408Z","submitted_at":"2024-10-06T15:34:04Z","title":"Toward Secure Tuning: Mitigating Security Risks from Instruction Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04524","snapshot_observed_at":"2026-08-03T03:46:14.790420Z","title":"Gemini Team","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.06911","last_updated":"2026-06-02T23:27:30Z","snapshot_observed_at":"2026-08-07T07:06:32.555804Z","submitted_at":"2026-02-06T18:04:38Z","title":"TamperBench: Systematically Stress-Testing LLM Safety Under Fine-Tuning and Tampering","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T03:46:14.790420Z"},"links":{"cited_paper":"/paper/2410.04524","citing_paper":"/paper/2602.06911"},"observation_digest":"sha256:2e15de87927df7535c7ab51edcf1e1105511f46e2f37fe086633657bdbfe163e","observation_id":"cff9a125-00ba-468c-82d0-26bad94a0713","resolution":{"observed_at":"2026-08-03T03:46:14.790420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04524","last_updated":"2025-02-17T02:32:33Z","snapshot_observed_at":"2026-07-06T19:28:39.495408Z","submitted_at":"2024-10-06T15:34:04Z","title":"Toward Secure Tuning: Mitigating Security Risks from Instruction Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2410.04524","doi":"10.48550/arxiv.2410.04524","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.04524","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards secure tuning: Mitigating security risks arising from benign instruction fine-tuning","venue":"arXiv (Cornell University)","work_id":"ba087fb5-090b-4bd1-8504-6899076427da","year":2024},"citing_paper":{"arxiv_id":"2606.02530","last_updated":"2026-06-01T17:38:12Z","snapshot_observed_at":"2026-08-05T11:28:53.105574Z","submitted_at":"2026-06-01T17:38:12Z","title":"SafeSteer: Localized On-Policy Distillation for Efficient Safety Alignment","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-28T14:39:11.178976Z"},"links":{"cited_paper":"/paper/2410.04524","citing_paper":"/paper/2606.02530"},"observation_digest":"sha256:4426296769137deb431d632eb53a100daeb7fd80f089715ac99e89d9db8d5bf6","observation_id":"81ef9047-4a2d-4c48-b365-795bf1d7e40b","resolution":{"observed_at":"2026-07-01T23:06:20.908557Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2410.04524/citation-record","integrity":"/paper/2410.04524/integrity","json":"/paper/2410.04524/citation-record.json","paper":"/paper/2410.04524"},"outbound":[],"paper":{"arxiv_id":"2410.04524","last_updated":"2025-02-17T02:32:33Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T19:28:39.495408Z","submitted_at":"2024-10-06T15:34:04Z","title":"Toward Secure Tuning: Mitigating Security Risks from Instruction Fine-Tuning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2410.04524."}