{"as_of":"2026-08-10T05:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7432d9b439455e7fab141b7490b8d1bcdd55aaaf534b6c793bb26cc339ac197c","coverage":[{"denominator":6,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:35:34.616461Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T01:12:44.184834Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2509.09870","last_updated":"2026-04-29T01:28:14Z","snapshot_observed_at":"2026-07-06T22:29:01.585836Z","submitted_at":"2025-09-11T21:43:49Z","title":"Vibe Check: Understanding the Effects of LLM-Based Conversational Agents' Personality and Alignment on User Perceptions in Goal-Oriented Tasks","version":2},"reference_index":114,"source":"pdf_text","source_observed_at":"2026-05-18T17:00:06.402954Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2509.09870"},"observation_digest":"sha256:b4dded5cbdf17d2a29352651c3be9a491523b0e94dd74cffa4d2593ced178cbe","observation_id":"d5e3815c-4641-4358-ba47-d92df3d6a102","resolution":{"observed_at":"2026-05-18T17:01:38.344182Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2509.26238","last_updated":"2026-04-21T11:04:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-30T13:32:59Z","title":"Beyond Linear Probes: Dynamic Safety Monitoring for Language Models","version":4},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-18T12:41:48.620040Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2509.26238"},"observation_digest":"sha256:d5b4b4f765bcdb1ae1f095c9e172d5cbd7c3f2d5740c7dfa71b379969c3fd168","observation_id":"5896c4be-d5ba-4f1d-b9d4-3591bf8b6ef7","resolution":{"observed_at":"2026-05-18T12:42:36.853762Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2604.07709","last_updated":"2026-06-03T21:15:24Z","snapshot_observed_at":"2026-07-13T00:19:28.134640Z","submitted_at":"2026-04-09T01:54:33Z","title":"IatroBench: Pre-Registered Evidence of Iatrogenic Harm from AI Safety Measures","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-10T18:25:53.037936Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2604.07709"},"observation_digest":"sha256:a6571275e00e37f21a6f137981ace470f5e0bf963b2f6f07474b92caf67013db","observation_id":"36ecda09-0937-4c16-ab76-00ee4d62cc54","resolution":{"observed_at":"2026-05-11T00:35:52.616391Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-07-13T00:19:33.861692Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.07709","last_updated":"2026-06-03T21:15:24Z","snapshot_observed_at":"2026-07-13T00:19:28.134640Z","submitted_at":"2026-04-09T01:54:33Z","title":"IatroBench: Pre-Registered Evidence of Iatrogenic Harm from AI Safety Measures","version":4},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-13T00:19:33.861692Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2604.07709"},"observation_digest":"sha256:81e1253155b724c512e52b10038e9194432f85ee7742bde33775d3510bd6a1f3","observation_id":"07612579-4de2-4a67-a42e-7fd7c0e3ed24","resolution":{"observed_at":"2026-07-13T00:19:33.861692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2604.17299","last_updated":"2026-04-21T06:17:50Z","snapshot_observed_at":"2026-07-06T23:04:28.260463Z","submitted_at":"2026-04-19T07:29:37Z","title":"Cat-DPO: Category-Adaptive Safety Alignment","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T05:33:32.642379Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2604.17299"},"observation_digest":"sha256:8b35172ed7b783b2e25092a92a699b2bd16b7bc81dd8c6d734b489ad334116eb","observation_id":"66929448-40e1-4ddf-be66-fc7de901521d","resolution":{"observed_at":"2026-05-10T05:36:01.750925Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2604.18463","last_updated":"2026-05-03T16:42:04Z","snapshot_observed_at":"2026-08-07T17:16:53.633362Z","submitted_at":"2026-04-20T16:18:08Z","title":"Using large language models for embodied planning introduces systematic safety risks","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-10T04:45:46.483867Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2604.18463"},"observation_digest":"sha256:84ddcf16b4e630d23d8b754f64cdbca3351c12a511c3dde733bc1c516651bc5c","observation_id":"41e0bb4f-39d5-48a6-83fc-c31191e12e91","resolution":{"observed_at":"2026-05-10T11:40:20.104188Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2604.24082","last_updated":"2026-04-27T06:12:43Z","snapshot_observed_at":"2026-07-06T23:10:12.016186Z","submitted_at":"2026-04-27T06:12:43Z","title":"Jailbreaking Frontier Foundation Models Through Intention Deception","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T03:17:51.039062Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2604.24082"},"observation_digest":"sha256:1392928e61ee31a93db66e25c14639603c2ee1d07a4be74e49a3cc72ec2a2e54","observation_id":"b0bec346-0217-440a-9c94-502e42612725","resolution":{"observed_at":"2026-05-11T22:11:14.010147Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:703ea54ba7d53d9c70383b3ddbfbe6d0562dd7ba7c5a65f93214358c3ed7abcd","observation_id":"aec6227f-8076-41dc-94a9-9d0babd9efd4","resolution":{"observed_at":"2026-05-11T19:31:08.563625Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2605.08930","last_updated":"2026-05-09T13:05:00Z","snapshot_observed_at":"2026-07-06T23:21:06.773761Z","submitted_at":"2026-05-09T13:05:00Z","title":"Internalizing Safety Understanding in Large Reasoning Models via Verification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-12T01:50:59.283409Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2605.08930"},"observation_digest":"sha256:5d4e3d802fa16489fb3d4cb90f2149c2d261a8b71a3470686716d534e0987d00","observation_id":"27dddf4d-e254-4f60-953b-8ff3632f9d83","resolution":{"observed_at":"2026-05-12T01:51:14.238142Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2605.22771","last_updated":"2026-05-28T14:36:56Z","snapshot_observed_at":"2026-08-02T14:56:42.675689Z","submitted_at":"2026-05-21T17:32:40Z","title":"Reducing Political Manipulation with Consistency Training","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-22T05:32:19.312335Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2605.22771"},"observation_digest":"sha256:968855ef76698f33f1710556ccde4d57c5fac3e5e060563d9bb6da6a599002fd","observation_id":"5d489190-aa42-498a-9084-49fc23f6703c","resolution":{"observed_at":"2026-05-22T05:34:40.233116Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2605.22771","last_updated":"2026-05-28T14:36:56Z","snapshot_observed_at":"2026-08-02T14:56:42.675689Z","submitted_at":"2026-05-21T17:32:40Z","title":"Reducing Political Manipulation with Consistency Training","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-30T16:49:16.542582Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2605.22771"},"observation_digest":"sha256:d95e02821a62937b9724a65f2a4a396cabf17c7e4aed7c23ccd92c33f8ce3aa6","observation_id":"27d5e496-392f-4511-a39f-bf7b49040453","resolution":{"observed_at":"2026-06-30T16:54:58.727042Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2605.31381","last_updated":"2026-06-02T14:28:06Z","snapshot_observed_at":"2026-08-09T09:12:57.809856Z","submitted_at":"2026-05-29T14:50:08Z","title":"LLM Judges Inconsistently Disagree Across Safety Criteria and Harm Categories","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T22:33:26.600072Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2605.31381"},"observation_digest":"sha256:bb549da799a1508629aa40d6bf88a71078d7e6efe11c9e6cf963cc93282d1b98","observation_id":"1a845245-3a9c-46d1-9b9b-cdb20a841c83","resolution":{"observed_at":"2026-07-01T19:26:00.785841Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2606.02423","last_updated":"2026-06-01T16:01:37Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T16:01:37Z","title":"Investigating and Alleviating Harm Amplification in LLM Interactions","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-28T14:31:52.027889Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2606.02423"},"observation_digest":"sha256:f37292b4739c58a48bb4d740e989edbbcfb237ae6843fce856098e093fc2c663","observation_id":"d966b265-c9f3-4000-b32b-f8565878dee3","resolution":{"observed_at":"2026-07-01T23:16:24.040929Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2606.03648","last_updated":"2026-06-02T13:39:17Z","snapshot_observed_at":"2026-08-09T14:15:59.693564Z","submitted_at":"2026-06-02T13:39:17Z","title":"Safety Measurements for Fine-tuned LLMs Should be Grounded in Capability","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-28T10:00:30.904247Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2606.03648"},"observation_digest":"sha256:ed19ff5f5a792005ff8e679c0fbe1a998f1991d02a17117a2cb34ed582805e95","observation_id":"fed5df3e-33d3-415e-967a-4a6a64015832","resolution":{"observed_at":"2026-07-02T03:26:29.803972Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2606.30661","last_updated":"2026-06-16T18:48:20Z","snapshot_observed_at":"2026-08-09T15:01:30.842402Z","submitted_at":"2026-06-16T18:48:20Z","title":"Understanding Censorship in Large Language Models: From Mechanisms to Governance","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-01T07:02:35.840261Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2606.30661"},"observation_digest":"sha256:982891329a27c236976139e9f92a72ce8c3bc9aa3c9a32e83fd867c24ace1c5e","observation_id":"28e34803-b869-4ca7-93d5-9fb1e5c85b01","resolution":{"observed_at":"2026-07-01T07:05:28.397555Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2607.02047","last_updated":"2026-07-02T11:14:52Z","snapshot_observed_at":"2026-08-05T00:28:59.014764Z","submitted_at":"2026-07-02T11:14:52Z","title":"OpenSafeIntent: Evaluating Intent-Calibrated Safe Completion Across Dual-Use Prompt Sets","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-03T14:44:57.205766Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2607.02047"},"observation_digest":"sha256:1c305664068666c21749faceba0497eef632ac21f556b7bfaf6dc4165b200af9","observation_id":"8032e4dd-60b3-47f1-a891-572cd3fd65ad","resolution":{"observed_at":"2026-07-03T14:48:32.496890Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-07-12T06:11:38.403281Z","title":"From hard refusals to safe-completions: Toward output-centric safety training.arXiv preprint arXiv:2508.09224, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02914","last_updated":"2026-07-03T03:19:39Z","snapshot_observed_at":"2026-08-06T07:16:16.960857Z","submitted_at":"2026-07-03T03:19:39Z","title":"Oyster-II: Reinforcement Learning for Constructive Safety Alignment in Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-12T06:11:38.403281Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2607.02914"},"observation_digest":"sha256:d06bb21560438c260997998becbdfbc7eb0bf98e9b7a8e947bd227e9c317066f","observation_id":"13e43977-b44e-4383-bfa6-66195151621c","resolution":{"observed_at":"2026-07-12T06:11:38.403281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-01T01:12:44.184834Z","title":"Yu,J.,Lin,X.,Yu,Z.,andXing,X","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.184834Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:909e0a455ecd560b52fe2be7cb5206e9d9189fa6210d999b6a469e4018ce5e61","observation_id":"b3b09427-a1e8-4a06-a09e-bb0a28d19412","resolution":{"observed_at":"2026-08-01T01:12:44.184834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-01T00:35:58.478085Z","title":"arXiv preprint arXiv:2508.09224 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26200","last_updated":"2026-07-28T19:05:24Z","snapshot_observed_at":"2026-08-07T08:35:32.111987Z","submitted_at":"2026-07-28T19:05:24Z","title":"Choosing Where and How to Moderate: End-to-End Trade-offs in Filter Placement and Response Rewriting","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T00:35:58.478085Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2607.26200"},"observation_digest":"sha256:611a0ddef24b2e60de20a326b9a7253a1d792629e470ffcb328db6f2864053be","observation_id":"3a138c4e-30e0-4b6a-8e2f-7bead74052f4","resolution":{"observed_at":"2026-08-01T00:35:58.478085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-07-31T22:25:22.224180Z","title":"arXiv preprint arXiv:2508.09224 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27951","last_updated":"2026-07-30T09:59:08Z","snapshot_observed_at":"2026-08-07T06:10:33.172835Z","submitted_at":"2026-07-30T09:59:08Z","title":"Safeguards Based on Copyable Context Cannot Provide Reliable Safety for LLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-31T22:25:22.224180Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2607.27951"},"observation_digest":"sha256:bbf6b35a1ae2e4fe2ee5bd945f7f4d3a066d37b47e9756049da1ff2ff793d4b5","observation_id":"9486a6b5-410d-471b-afd1-06341419d6b5","resolution":{"observed_at":"2026-07-31T22:25:22.224180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.09224/citation-record","integrity":"/paper/2508.09224/integrity","json":"/paper/2508.09224/citation-record.json","paper":"/paper/2508.09224"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.02151","last_updated":"2025-04-17T18:55:45Z","snapshot_observed_at":"2026-08-08T01:18:53.200448Z","submitted_at":"2024-04-02T17:58:27Z","title":"Jailbreaking Leading Safety-Aligned LLMs with Simple Adaptive Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02151","snapshot_observed_at":"2026-08-05T21:35:33.950466Z","title":"Conference on Language Modeling(2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T21:35:33.950466Z"},"links":{"cited_paper":"/paper/2404.02151","citing_paper":"/paper/2508.09224"},"observation_digest":"sha256:bce258b08a7d016c5382afae6f8b99fdff1e0181678e62df7425a9ea655cc565","observation_id":"6fae85d6-77d2-416f-8c51-c429779c4d98","resolution":{"observed_at":"2026-08-05T21:35:33.950466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:35:34.834620Z","title":"[14]OpenAI","venue":null,"work_id":"a19edb6f-a8e2-442a-b5df-a10f4fd40367","year":2025},"citing_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T21:35:34.366680Z"},"links":{"citing_paper":"/paper/2508.09224"},"observation_digest":"sha256:4c7af16d5b39356b476d3ca389535e4700fef442445e8f1d3397dfe67cb4b6b0","observation_id":"f2be2c8c-8ac3-4957-8e84-5c49decdb846","resolution":{"observed_at":"2026-08-05T21:35:34.923470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01263","last_updated":"2024-04-01T11:50:35Z","snapshot_observed_at":"2026-08-03T00:58:55.865010Z","submitted_at":"2023-08-02T16:30:40Z","title":"XSTest: A Test Suite for Identifying Exaggerated Safety Behaviours in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01263","snapshot_observed_at":"2026-08-05T21:35:34.494480Z","title":"InAdvances in Neural Information Processing Systems(2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T21:35:34.494480Z"},"links":{"cited_paper":"/paper/2308.01263","citing_paper":"/paper/2508.09224"},"observation_digest":"sha256:904f50007b0212ed1d9aa54be9bc72e7aabedf0f313788eef8085e0ca4649929","observation_id":"81b07747-e930-4ec7-94d4-ab893594fb53","resolution":{"observed_at":"2026-08-05T21:35:34.494480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-05T21:35:34.096588Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T21:35:34.096588Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2508.09224"},"observation_digest":"sha256:d00fdd455115c2401d0061f43d20183e9d1d5c8ca0e5dfdc00aa8be92c7c8076","observation_id":"9c3d15c9-ca69-4187-af43-76ddc9f34c93","resolution":{"observed_at":"2026-08-05T21:35:34.096588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-05T21:35:34.616461Z","title":"highly actionable instructions on evading law enforcement or facilitating theft","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T21:35:34.616461Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2508.09224"},"observation_digest":"sha256:f24631fc821b9e49ec69ea308136fc2540cedb01209586e6d75922d5d7cf6552","observation_id":"e05cc146-80ba-4697-b710-292789aa3a39","resolution":{"observed_at":"2026-08-05T21:35:34.616461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T21:35:34.168865Z","title":"[12]OpenAI","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T21:35:34.168865Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2508.09224"},"observation_digest":"sha256:196b605493ffdea5989bc8e820c99a164b91653ce12c327acce6b89cb077727a","observation_id":"9a63e92e-2b3c-4b20-afb6-6ea4a7b1b4db","resolution":{"observed_at":"2026-08-05T21:35:34.168865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","latest_version":1,"primary_category":"cs.CY","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training"},"reference_resolution":{"displayed":6,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":6},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 6 of 6 outbound references and 20 inbound Pith citation observations for arXiv:2508.09224."}