{"as_of":"2026-08-17T10:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bfc089fc1f5d207c85370f4c0bf11d90dcf7b46d66b7a54fb279c933b625f7ca","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:24:12.784378Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.02475","last_updated":"2024-03-04T20:39:24Z","snapshot_observed_at":"2026-08-16T14:12:53.238076Z","submitted_at":"2024-03-04T20:39:24Z","title":"Enhancing LLM Safety via Constrained Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2403.02475","doi":"10.48550/arxiv.2403.02475","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02475","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Enhanc- ing LLM safety via constrained direct preference op- timization","venue":"arXiv (Cornell University)","work_id":"ece4fade-4dec-42df-9963-2b9cf949769d","year":2024},"citing_paper":{"arxiv_id":"2407.04295","last_updated":"2024-08-30T11:57:47Z","snapshot_observed_at":"2026-08-12T17:45:10.384900Z","submitted_at":"2024-07-05T06:57:30Z","title":"Jailbreak Attacks and Defenses Against Large Language Models: A Survey","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-15T02:20:44.368219Z"},"links":{"cited_paper":"/paper/2403.02475","citing_paper":"/paper/2407.04295"},"observation_digest":"sha256:1e93cdf23f2fde49b9a8d27930909853f20f471288d77fc3424ca1016ab267ef","observation_id":"e3322188-3172-48ef-b84e-540124df4156","resolution":{"observed_at":"2026-05-15T02:20:44.762062Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02475","last_updated":"2024-03-04T20:39:24Z","snapshot_observed_at":"2026-08-16T14:12:53.238076Z","submitted_at":"2024-03-04T20:39:24Z","title":"Enhancing LLM Safety via Constrained Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02475","snapshot_observed_at":"2026-08-10T14:39:22.636132Z","title":"arXiv preprint arXiv:2403.02475","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15109","last_updated":"2025-01-25T07:21:50Z","snapshot_observed_at":"2026-08-16T20:04:45.777293Z","submitted_at":"2025-01-25T07:21:50Z","title":"Clear Preferences Leave Traces: Reference Model-Guided Sampling for Preference Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T14:39:22.636132Z"},"links":{"cited_paper":"/paper/2403.02475","citing_paper":"/paper/2501.15109"},"observation_digest":"sha256:1a7058d3a32cbf18bc6f15bac50458a80d305321ecdd252bd82ced1a2b98621c","observation_id":"df0fb837-b648-4b15-9f59-646e4f21287a","resolution":{"observed_at":"2026-08-10T14:39:22.636132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02475","last_updated":"2024-03-04T20:39:24Z","snapshot_observed_at":"2026-08-16T14:12:53.238076Z","submitted_at":"2024-03-04T20:39:24Z","title":"Enhancing LLM Safety via Constrained Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02475","snapshot_observed_at":"2026-08-09T13:14:34.063868Z","title":"Enhancing LLM safety via constrained direct preference optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02153","last_updated":"2025-02-04T09:31:54Z","snapshot_observed_at":"2026-08-16T16:34:47.536642Z","submitted_at":"2025-02-04T09:31:54Z","title":"Vulnerability Mitigation for Safety-Aligned Language Models via Debiasing","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T13:14:34.063868Z"},"links":{"cited_paper":"/paper/2403.02475","citing_paper":"/paper/2502.02153"},"observation_digest":"sha256:931712b0177f3b8afae1264251dd6fff97da80aba980d912fcfc1fd75061fd2e","observation_id":"8a1a9168-3123-4793-9419-953e9e725e33","resolution":{"observed_at":"2026-08-09T13:14:34.063868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02475","last_updated":"2024-03-04T20:39:24Z","snapshot_observed_at":"2026-08-16T14:12:53.238076Z","submitted_at":"2024-03-04T20:39:24Z","title":"Enhancing LLM Safety via Constrained Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02475","snapshot_observed_at":"2026-08-16T11:24:12.784378Z","title":"Enhancing llm safety via constrained direct preference optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15585","last_updated":"2025-06-09T02:36:20Z","snapshot_observed_at":"2026-08-16T13:11:23.928524Z","submitted_at":"2025-04-22T05:02:49Z","title":"A Comprehensive Survey in LLM(-Agent) Full Stack Safety: Data, Training and Deployment","version":4},"reference_index":257,"source":"pdf_text","source_observed_at":"2026-08-16T11:24:12.784378Z"},"links":{"cited_paper":"/paper/2403.02475","citing_paper":"/paper/2504.15585"},"observation_digest":"sha256:0637d8c14dba130f03f330f3d2f8117fba812a6407c1e59b46c1d33c6d5380ec","observation_id":"c48394cd-17d8-4785-8765-b74899b2e30e","resolution":{"observed_at":"2026-08-16T11:24:12.784378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02475","last_updated":"2024-03-04T20:39:24Z","snapshot_observed_at":"2026-08-16T14:12:53.238076Z","submitted_at":"2024-03-04T20:39:24Z","title":"Enhancing LLM Safety via Constrained Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02475","snapshot_observed_at":"2026-08-15T23:30:24.239154Z","title":"Enhancing llm safety via constrained direct preference optimization, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04578","last_updated":"2025-05-07T17:18:48Z","snapshot_observed_at":"2026-08-15T23:22:49.261991Z","submitted_at":"2025-05-07T17:18:48Z","title":"Fight Fire with Fire: Defending Against Malicious RL Fine-Tuning via Reward Neutralization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:30:24.239154Z"},"links":{"cited_paper":"/paper/2403.02475","citing_paper":"/paper/2505.04578"},"observation_digest":"sha256:d6d4632bf215106f523182e219c020e568227bfacacdffcb38be15bd34603f9e","observation_id":"f3078b42-6be0-469d-88f3-a7f023a620f9","resolution":{"observed_at":"2026-08-15T23:30:24.239154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02475","last_updated":"2024-03-04T20:39:24Z","snapshot_observed_at":"2026-08-16T14:12:53.238076Z","submitted_at":"2024-03-04T20:39:24Z","title":"Enhancing LLM Safety via Constrained Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02475","snapshot_observed_at":"2026-08-07T12:30:16.012101Z","title":"Enhancing LLM Safety via Constrained Direct Preference Optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24445","last_updated":"2025-05-30T10:30:24Z","snapshot_observed_at":"2026-08-10T04:52:18.742003Z","submitted_at":"2025-05-30T10:30:24Z","title":"Learning Safety Constraints for Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:16.012101Z"},"links":{"cited_paper":"/paper/2403.02475","citing_paper":"/paper/2505.24445"},"observation_digest":"sha256:d6fdb24f2ac6a2299b9b2bfdc0bc76c4e5f2dcc915c5cbcb84f432399c9af1f4","observation_id":"7f1d5073-9f8a-45ce-be38-8a0bd2e8880e","resolution":{"observed_at":"2026-08-07T12:30:16.012101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02475","last_updated":"2024-03-04T20:39:24Z","snapshot_observed_at":"2026-08-16T14:12:53.238076Z","submitted_at":"2024-03-04T20:39:24Z","title":"Enhancing LLM Safety via Constrained Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02475","snapshot_observed_at":"2026-08-07T05:21:58.706600Z","title":"Enhancing llm safety via constrained direct preference optimization, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08266","last_updated":"2025-06-09T22:03:56Z","snapshot_observed_at":"2026-08-17T00:40:28.013808Z","submitted_at":"2025-06-09T22:03:56Z","title":"Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T05:21:58.706600Z"},"links":{"cited_paper":"/paper/2403.02475","citing_paper":"/paper/2506.08266"},"observation_digest":"sha256:e8d3a317de3b3ae60938686b0aacce94f56afe2b87a1db51840d6fd4326d660f","observation_id":"094a5a8d-af98-4b91-83a0-bad6ed9f6a95","resolution":{"observed_at":"2026-08-07T05:21:58.706600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02475","last_updated":"2024-03-04T20:39:24Z","snapshot_observed_at":"2026-08-16T14:12:53.238076Z","submitted_at":"2024-03-04T20:39:24Z","title":"Enhancing LLM Safety via Constrained Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02475","snapshot_observed_at":"2026-08-06T15:01:47.808584Z","title":"Enhancing llm safety via constrained direct preference optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21141","last_updated":"2025-07-23T07:56:05Z","snapshot_observed_at":"2026-08-13T01:25:54.824538Z","submitted_at":"2025-07-23T07:56:05Z","title":"The Geometry of Harmfulness in LLMs through Subconcept Probing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:01:47.808584Z"},"links":{"cited_paper":"/paper/2403.02475","citing_paper":"/paper/2507.21141"},"observation_digest":"sha256:61030af4940164eb7cbb95a35bf0de3d361c8d21eae990ce3cb0614a5448523e","observation_id":"a1939382-08e1-4005-bcf6-ae0c11ce47c8","resolution":{"observed_at":"2026-08-06T15:01:47.808584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02475","last_updated":"2024-03-04T20:39:24Z","snapshot_observed_at":"2026-08-16T14:12:53.238076Z","submitted_at":"2024-03-04T20:39:24Z","title":"Enhancing LLM Safety via Constrained Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2403.02475","doi":"10.48550/arxiv.2403.02475","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02475","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Enhanc- ing LLM safety via constrained direct preference op- timization","venue":"arXiv (Cornell University)","work_id":"ece4fade-4dec-42df-9963-2b9cf949769d","year":2024},"citing_paper":{"arxiv_id":"2509.03526","last_updated":"2026-05-20T03:07:46Z","snapshot_observed_at":"2026-08-15T03:55:37.990374Z","submitted_at":"2025-08-25T07:31:48Z","title":"Enhancing Speech Large Language Models through Reinforced Behavior Alignment","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-21T22:23:52.392075Z"},"links":{"cited_paper":"/paper/2403.02475","citing_paper":"/paper/2509.03526"},"observation_digest":"sha256:8c490b8ae4bc0524aed2b8a1d5466469efa5c2ad93e83a457d6fa2e48251811a","observation_id":"4424de3d-0056-46e5-a14a-8c910b95c668","resolution":{"observed_at":"2026-05-21T22:24:23.468405Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02475","last_updated":"2024-03-04T20:39:24Z","snapshot_observed_at":"2026-08-16T14:12:53.238076Z","submitted_at":"2024-03-04T20:39:24Z","title":"Enhancing LLM Safety via Constrained Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02475","snapshot_observed_at":"2026-08-02T19:23:43.246430Z","title":"arXiv:2403.02475 doi:10.48550/ARXIV.2403.02475 Andreas Maurer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.02565","last_updated":"2026-07-28T05:22:32Z","snapshot_observed_at":"2026-08-10T10:54:41.863181Z","submitted_at":"2026-03-03T03:35:34Z","title":"FlashEvaluator: Expanding Search Space with Parallel Sequence-Level Evaluation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T19:23:43.246430Z"},"links":{"cited_paper":"/paper/2403.02475","citing_paper":"/paper/2603.02565"},"observation_digest":"sha256:8f184a946d5c4d366858a45cc4d2fba6510ac45078798bf49bca97ef7114f184","observation_id":"964885b8-7802-4657-802f-425b10c0d969","resolution":{"observed_at":"2026-08-02T19:23:43.246430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02475","last_updated":"2024-03-04T20:39:24Z","snapshot_observed_at":"2026-08-16T14:12:53.238076Z","submitted_at":"2024-03-04T20:39:24Z","title":"Enhancing LLM Safety via Constrained Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2403.02475","doi":"10.48550/arxiv.2403.02475","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02475","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Enhanc- ing LLM safety via constrained direct preference op- timization","venue":"arXiv (Cornell University)","work_id":"ece4fade-4dec-42df-9963-2b9cf949769d","year":2024},"citing_paper":{"arxiv_id":"2604.20685","last_updated":"2026-04-22T15:33:45Z","snapshot_observed_at":"2026-08-15T09:20:37.303455Z","submitted_at":"2026-04-22T15:33:45Z","title":"MGDA-Decoupled: Geometry-Aware Multi-Objective Optimisation for DPO-based LLM Alignment","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-10T01:38:49.892824Z"},"links":{"cited_paper":"/paper/2403.02475","citing_paper":"/paper/2604.20685"},"observation_digest":"sha256:ee0c7f1000c8c4991d151f4dc7e48e815fdea3595abe7b9f05fdfe405464d629","observation_id":"18defa3c-fc79-471c-a584-7aee7dcfa815","resolution":{"observed_at":"2026-05-10T01:40:55.342322Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02475","last_updated":"2024-03-04T20:39:24Z","snapshot_observed_at":"2026-08-16T14:12:53.238076Z","submitted_at":"2024-03-04T20:39:24Z","title":"Enhancing LLM Safety via Constrained Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2403.02475","doi":"10.48550/arxiv.2403.02475","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02475","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Enhanc- ing LLM safety via constrained direct preference op- timization","venue":"arXiv (Cornell University)","work_id":"ece4fade-4dec-42df-9963-2b9cf949769d","year":2024},"citing_paper":{"arxiv_id":"2604.24488","last_updated":"2026-04-27T13:55:49Z","snapshot_observed_at":"2026-08-11T13:43:44.980197Z","submitted_at":"2026-04-27T13:55:49Z","title":"Scalable First-Order Interior Point Trust Region Algorithms for Linearly Constrained Optimization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-08T01:30:53.740345Z"},"links":{"cited_paper":"/paper/2403.02475","citing_paper":"/paper/2604.24488"},"observation_digest":"sha256:f8b144c8923b98c752a54a455e963ec413d2b8e34dcb7f046460fe8fca37621c","observation_id":"9416754a-97e6-429e-a76f-6904dcf0ae8a","resolution":{"observed_at":"2026-05-11T23:06:22.066349Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02475","last_updated":"2024-03-04T20:39:24Z","snapshot_observed_at":"2026-08-16T14:12:53.238076Z","submitted_at":"2024-03-04T20:39:24Z","title":"Enhancing LLM Safety via Constrained Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2403.02475","doi":"10.48550/arxiv.2403.02475","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02475","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Enhanc- ing LLM safety via constrained direct preference op- timization","venue":"arXiv (Cornell University)","work_id":"ece4fade-4dec-42df-9963-2b9cf949769d","year":2024},"citing_paper":{"arxiv_id":"2607.00481","last_updated":"2026-07-01T06:08:07Z","snapshot_observed_at":"2026-08-04T19:51:57.082592Z","submitted_at":"2026-07-01T06:08:07Z","title":"Beyond the Prompt: Jailbreaking Function-Calling LLMs via Simulated Moderation Traces","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-02T11:37:02.538968Z"},"links":{"cited_paper":"/paper/2403.02475","citing_paper":"/paper/2607.00481"},"observation_digest":"sha256:df8876a7946fa982e246880193787580508be1736e3303952d16746d4c2e2b2e","observation_id":"b5e38fd8-be65-4be7-a4e7-ea14c221efc2","resolution":{"observed_at":"2026-07-02T11:46:54.874567Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02475","last_updated":"2024-03-04T20:39:24Z","snapshot_observed_at":"2026-08-16T14:12:53.238076Z","submitted_at":"2024-03-04T20:39:24Z","title":"Enhancing LLM Safety via Constrained Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02475","snapshot_observed_at":"2026-07-12T07:05:47.150308Z","title":"arXiv preprint arXiv:2403.02475 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.02781","last_updated":"2026-07-02T21:27:59Z","snapshot_observed_at":"2026-08-14T21:10:19.680500Z","submitted_at":"2026-07-02T21:27:59Z","title":"Safe Inference-Time Alignment via Lagrangian Reward Augmentation","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-07-12T07:05:47.150308Z"},"links":{"cited_paper":"/paper/2403.02475","citing_paper":"/paper/2607.02781"},"observation_digest":"sha256:a52f4cdfb4ad6bff477ebf8eff10a3f438cc9acf933efb745096e8c5b8857e64","observation_id":"85cbb6ca-3aa2-4830-b59b-5f800a6df652","resolution":{"observed_at":"2026-07-12T07:05:47.150308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02475","last_updated":"2024-03-04T20:39:24Z","snapshot_observed_at":"2026-08-16T14:12:53.238076Z","submitted_at":"2024-03-04T20:39:24Z","title":"Enhancing LLM Safety via Constrained Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02475","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Enhancing LLM safety via constrained direct preference optimization.arXiv preprint arXiv:2403.02475, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2403.02475","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:8afdee43fd71ba54e8e3832841a7869ea32c85d0c5c33ffb8798b977affbdb8f","observation_id":"5ad6ebef-9d33-4b6d-b1cb-bb49ba592132","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2403.02475/citation-record","integrity":"/paper/2403.02475/integrity","json":"/paper/2403.02475/citation-record.json","paper":"/paper/2403.02475"},"outbound":[],"paper":{"arxiv_id":"2403.02475","last_updated":"2024-03-04T20:39:24Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T14:12:53.238076Z","submitted_at":"2024-03-04T20:39:24Z","title":"Enhancing LLM Safety via Constrained Direct Preference Optimization"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2403.02475."}