{"as_of":"2026-08-13T06:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4a95951130b01980b2e5ca05f24e504887640980fbe3f0b96dfedf9db9775b7c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":21,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T12:41:20.729703Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T06:15:00.866473Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":"2410.15595","doi":"10.48550/arxiv.2410.15595","metadata_source":"pith","pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A comprehensive survey of datasets, theories, variants, and applications in direct preference optimization","venue":"cs.AI","work_id":"fbcda931-44f5-4714-9437-c62403696afb","year":2024},"citing_paper":{"arxiv_id":"2412.04300","last_updated":"2025-06-04T03:29:18Z","snapshot_observed_at":"2026-08-08T07:13:29.035650Z","submitted_at":"2024-12-05T16:21:01Z","title":"T2I-FactualBench: Benchmarking the Factuality of Text-to-Image Models with Knowledge-Intensive Concepts","version":3},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-23T08:00:12.781392Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2412.04300"},"observation_digest":"sha256:8b67dc793d3b29abe1dcdd1c1500a39a682a06909fdabfb5c7905e855b188dbb","observation_id":"519dfa99-5557-425f-8788-51f51b6b75ce","resolution":{"observed_at":"2026-06-10T02:11:10.714292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-08-11T12:41:20.729703Z","title":"Yuxi Xie, Anirudh Goyal, Wenyue Zheng, Min-Yen Kan, Timothy P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15282","last_updated":"2024-12-18T15:38:39Z","snapshot_observed_at":"2026-08-11T12:35:09.122376Z","submitted_at":"2024-12-18T15:38:39Z","title":"A Systematic Examination of Preference Learning through the Lens of Instruction-Following","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T12:41:20.729703Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2412.15282"},"observation_digest":"sha256:a7fc4932d0b520dbe46ed508beea4e72ee141a5ef08bdb8751a59716fc83e2f1","observation_id":"f028a299-d28d-459f-84e3-0fa6a25f4242","resolution":{"observed_at":"2026-08-11T12:41:20.729703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-08-10T22:51:52.728580Z","title":"A comprehensive survey of datas ets, theories, variants, and applications in direct preference optimization,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.00562","last_updated":"2025-01-03T06:28:02Z","snapshot_observed_at":"2026-08-11T05:18:08.282517Z","submitted_at":"2024-12-31T17:48:33Z","title":"An Overview and Discussion on Using Large Language Models for Implementation Generation of Solutions to Open-Ended Problems","version":2},"reference_index":145,"source":"pdf_text","source_observed_at":"2026-08-10T22:51:52.728580Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2501.00562"},"observation_digest":"sha256:0179782db65ed31271c02264b77b7dde8bde051b296850fec7039c0780d0411b","observation_id":"0d3620bb-1f7d-453e-98d8-255766d04571","resolution":{"observed_at":"2026-08-10T22:51:52.728580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-08-10T22:32:56.533627Z","title":"A comprehensive surve y of datasets, the- ories, variants, and applications in direct preference opt imization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01544","last_updated":"2025-01-02T21:31:38Z","snapshot_observed_at":"2026-08-13T01:58:58.270635Z","submitted_at":"2025-01-02T21:31:38Z","title":"Many of Your DPOs are Secretly One: Attempting Unification Through Mutual Information","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:56.533627Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2501.01544"},"observation_digest":"sha256:4e13d689f9f58ade128d96129855af6f4bcd8dd974172afc0508a7a5b69b9b83","observation_id":"5245b116-1829-4987-b49d-f4d9e617ab9a","resolution":{"observed_at":"2026-08-10T22:32:56.533627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-08-07T14:31:22.245835Z","title":"In Advances in Neural Information Processing Sys- tems, volume 37, pages 116617–116637","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18720","last_updated":"2025-05-24T14:44:15Z","snapshot_observed_at":"2026-08-10T09:42:18.411786Z","submitted_at":"2025-05-24T14:44:15Z","title":"Optimal Transport-Based Token Weighting scheme for Enhanced Preference Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:31:22.245835Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2505.18720"},"observation_digest":"sha256:94985a1acb69f7bb9f0750d965165a2bf146c2b5053f0e06523224c7abec9104","observation_id":"34e2bed6-a7a6-4cbe-bce3-07af2c1df1bc","resolution":{"observed_at":"2026-08-07T14:31:22.245835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-08-07T13:24:23.510307Z","title":"A comprehensive survey of direct preference optimization: Datasets, theories, variants, and applications","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21907","last_updated":"2025-05-31T04:48:02Z","snapshot_observed_at":"2026-08-09T21:30:35.237559Z","submitted_at":"2025-05-28T02:52:39Z","title":"Modeling and Optimizing User Preferences in AI Copilots: A Comprehensive Survey and Taxonomy","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:24:23.510307Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2505.21907"},"observation_digest":"sha256:bed50b2774a97d2b2690986d1c93432ed87eebddc8b5da7c38165221649819b0","observation_id":"771e57d2-c34f-4158-9bea-d118b007f221","resolution":{"observed_at":"2026-08-07T13:24:23.510307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":"2410.15595","doi":"10.48550/arxiv.2410.15595","metadata_source":"pith","pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A comprehensive survey of datasets, theories, variants, and applications in direct preference optimization","venue":"cs.AI","work_id":"fbcda931-44f5-4714-9437-c62403696afb","year":2024},"citing_paper":{"arxiv_id":"2507.05179","last_updated":"2026-05-31T04:19:46Z","snapshot_observed_at":"2026-08-06T19:27:53.110737Z","submitted_at":"2025-07-07T16:34:28Z","title":"From Fragments to Facts: A Curriculum-Driven DPO Approach for Generating Hindi News Veracity Explanations","version":5},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-19T06:09:26.269452Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2507.05179"},"observation_digest":"sha256:83eb0497cbde0f47217e1187b432539a7ad1821833e0a66a145c28748f7204a6","observation_id":"9e4f5b25-ea62-4f09-bbf0-0c4acd5eda14","resolution":{"observed_at":"2026-06-10T02:11:10.714292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":"2410.15595","doi":"10.48550/arxiv.2410.15595","metadata_source":"pith","pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A comprehensive survey of datasets, theories, variants, and applications in direct preference optimization","venue":"cs.AI","work_id":"fbcda931-44f5-4714-9437-c62403696afb","year":2024},"citing_paper":{"arxiv_id":"2509.02547","last_updated":"2026-04-17T18:09:08Z","snapshot_observed_at":"2026-08-03T09:07:42.489237Z","submitted_at":"2025-09-02T17:46:26Z","title":"The Landscape of Agentic Reinforcement Learning for LLMs: A Survey","version":5},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T19:19:36.427337Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2509.02547"},"observation_digest":"sha256:705ebedfa5b5625f5cbb01964963d2ec0ab1a34137ec083853e5df7945dba16d","observation_id":"53a7ab6b-16a0-4246-bd5b-83e320dda34c","resolution":{"observed_at":"2026-06-10T02:11:10.714292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-08-03T05:26:01.675314Z","title":"A comprehensive sur- vey of direct preference optimization.arXiv preprint arXiv:2410.15595,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.02451","last_updated":"2026-06-18T18:51:33Z","snapshot_observed_at":"2026-08-09T18:18:03.576485Z","submitted_at":"2026-02-02T18:43:52Z","title":"Active Causal Experimentalist (ACE): Learning Intervention Strategies via Direct Preference Optimization","version":2},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-03T05:26:01.675314Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2602.02451"},"observation_digest":"sha256:c50d419188c058cf79ceffb14aa02c331d5ab291cf7d3c90d5176496d4f7d6b7","observation_id":"98c858db-038a-4c6e-9a94-6d9fc951bdf2","resolution":{"observed_at":"2026-08-03T05:26:01.675314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":"2410.15595","doi":"10.48550/arxiv.2410.15595","metadata_source":"pith","pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A comprehensive survey of datasets, theories, variants, and applications in direct preference optimization","venue":"cs.AI","work_id":"fbcda931-44f5-4714-9437-c62403696afb","year":2024},"citing_paper":{"arxiv_id":"2604.27859","last_updated":"2026-05-15T06:25:17Z","snapshot_observed_at":"2026-08-10T20:23:29.058595Z","submitted_at":"2026-04-30T13:43:25Z","title":"Rethinking Agentic Reinforcement Learning In Large Language Models","version":1},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-05-07T06:30:09.945371Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2604.27859"},"observation_digest":"sha256:738486004f064d001adbc01c592c89667278fb4ef65924245aafc050f4c300c6","observation_id":"3013383f-6f4a-4153-95b5-e41680157898","resolution":{"observed_at":"2026-06-10T02:11:10.714292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":"2410.15595","doi":"10.48550/arxiv.2410.15595","metadata_source":"pith","pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A comprehensive survey of datasets, theories, variants, and applications in direct preference optimization","venue":"cs.AI","work_id":"fbcda931-44f5-4714-9437-c62403696afb","year":2024},"citing_paper":{"arxiv_id":"2604.27859","last_updated":"2026-05-15T06:25:17Z","snapshot_observed_at":"2026-08-10T20:23:29.058595Z","submitted_at":"2026-04-30T13:43:25Z","title":"Rethinking Agentic Reinforcement Learning In Large Language Models","version":2},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-05-08T03:12:19.414358Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2604.27859"},"observation_digest":"sha256:ca8cf3ea2b668b356bfc011b2057d083cbfef1c1fa882727e5edeaf1ad07c48c","observation_id":"72b588ce-8bf1-44d0-8e97-596c09337a06","resolution":{"observed_at":"2026-06-10T02:11:10.714292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":"2410.15595","doi":"10.48550/arxiv.2410.15595","metadata_source":"pith","pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A comprehensive survey of datasets, theories, variants, and applications in direct preference optimization","venue":"cs.AI","work_id":"fbcda931-44f5-4714-9437-c62403696afb","year":2024},"citing_paper":{"arxiv_id":"2604.27859","last_updated":"2026-05-15T06:25:17Z","snapshot_observed_at":"2026-08-10T20:23:29.058595Z","submitted_at":"2026-04-30T13:43:25Z","title":"Rethinking Agentic Reinforcement Learning In Large Language Models","version":3},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-05-19T16:58:41.558250Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2604.27859"},"observation_digest":"sha256:c54312cac1a22b8fc53d5ce12e9e885abe0a0efab94b882f67951272ec1919e6","observation_id":"942de73f-1e2a-400a-883e-7b98baa62f04","resolution":{"observed_at":"2026-06-10T02:11:10.714292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":"2410.15595","doi":"10.48550/arxiv.2410.15595","metadata_source":"pith","pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A comprehensive survey of datasets, theories, variants, and applications in direct preference optimization","venue":"cs.AI","work_id":"fbcda931-44f5-4714-9437-c62403696afb","year":2024},"citing_paper":{"arxiv_id":"2605.11679","last_updated":"2026-05-13T09:28:34Z","snapshot_observed_at":"2026-08-11T08:28:39.520767Z","submitted_at":"2026-05-12T07:38:59Z","title":"Explaining and Breaking the Safety-Helpfulness Ceiling via Preference Dimensional Expansion","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-13T01:03:10.263663Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2605.11679"},"observation_digest":"sha256:a5fe8bcc2d4e1c9c595b118edbe9c3b9d0d326e88d7f36bd2c03efa0889a2d7c","observation_id":"02f081b9-9386-4801-9343-faad5808d4b8","resolution":{"observed_at":"2026-06-10T02:11:10.714292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":"2410.15595","doi":"10.48550/arxiv.2410.15595","metadata_source":"pith","pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A comprehensive survey of datasets, theories, variants, and applications in direct preference optimization","venue":"cs.AI","work_id":"fbcda931-44f5-4714-9437-c62403696afb","year":2024},"citing_paper":{"arxiv_id":"2605.11679","last_updated":"2026-05-13T09:28:34Z","snapshot_observed_at":"2026-08-11T08:28:39.520767Z","submitted_at":"2026-05-12T07:38:59Z","title":"Explaining and Breaking the Safety-Helpfulness Ceiling via Preference Dimensional Expansion","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-14T21:12:06.989077Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2605.11679"},"observation_digest":"sha256:b3e1de068256c4d88bdc2b1f7c6cbcdd113b01828397c789850140317508ab24","observation_id":"5d75473b-9ac6-4a3d-b4b1-9e20570849a5","resolution":{"observed_at":"2026-06-10T02:11:10.714292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":"2410.15595","doi":"10.48550/arxiv.2410.15595","metadata_source":"pith","pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A comprehensive survey of datasets, theories, variants, and applications in direct preference optimization","venue":"cs.AI","work_id":"fbcda931-44f5-4714-9437-c62403696afb","year":2024},"citing_paper":{"arxiv_id":"2605.12288","last_updated":"2026-06-10T07:32:21Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T15:44:33Z","title":"TokenRatio: Principled Token-Level Preference Optimization via Ratio Matching","version":1},"reference_index":189,"source":"arxiv_source","source_observed_at":"2026-05-13T04:55:55.013900Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2605.12288"},"observation_digest":"sha256:23e322283c671d01e83968f5b5f44f83742d349f2af566a4b2faabb8293d2e55","observation_id":"bbb00dc8-427e-4690-98d6-7d2477d6ca53","resolution":{"observed_at":"2026-06-10T02:11:10.714292Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":"2410.15595","doi":"10.48550/arxiv.2410.15595","metadata_source":"pith","pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A comprehensive survey of datasets, theories, variants, and applications in direct preference optimization","venue":"cs.AI","work_id":"fbcda931-44f5-4714-9437-c62403696afb","year":2024},"citing_paper":{"arxiv_id":"2605.12288","last_updated":"2026-06-10T07:32:21Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T15:44:33Z","title":"TokenRatio: Principled Token-Level Preference Optimization via Ratio Matching","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-15T05:41:10.714594Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2605.12288"},"observation_digest":"sha256:668a6fd93e3aa9e0c54e4f908c3e3a620cb5422577e365e198aaf3af5aaf1815","observation_id":"88539dbc-8626-4e97-ba06-9cded6ea9dac","resolution":{"observed_at":"2026-06-10T02:11:10.714292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":"2410.15595","doi":"10.48550/arxiv.2410.15595","metadata_source":"pith","pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A comprehensive survey of datasets, theories, variants, and applications in direct preference optimization","venue":"cs.AI","work_id":"fbcda931-44f5-4714-9437-c62403696afb","year":2024},"citing_paper":{"arxiv_id":"2605.12288","last_updated":"2026-06-10T07:32:21Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T15:44:33Z","title":"TokenRatio: Principled Token-Level Preference Optimization via Ratio Matching","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2605.12288"},"observation_digest":"sha256:9ddc40d2647673f7c069b4f7aca8122413d450875d02839dae7f77fce3634d4a","observation_id":"d2a656bc-9798-4349-a83e-5b4be92d3abf","resolution":{"observed_at":"2026-06-30T22:25:06.439296Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":"2410.15595","doi":"10.48550/arxiv.2410.15595","metadata_source":"pith","pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A comprehensive survey of datasets, theories, variants, and applications in direct preference optimization","venue":"cs.AI","work_id":"fbcda931-44f5-4714-9437-c62403696afb","year":2024},"citing_paper":{"arxiv_id":"2605.12288","last_updated":"2026-06-10T07:32:21Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T15:44:33Z","title":"TokenRatio: Principled Token-Level Preference Optimization via Ratio Matching","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T22:15:53.639048Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2605.12288"},"observation_digest":"sha256:860aecdcad8078d85a2442fa31efa6ead240f5523293fb5345bb158e0ce7327d","observation_id":"ab5e5094-07ec-4c79-9063-00f45ac2f4b2","resolution":{"observed_at":"2026-06-30T22:25:06.431552Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":"2410.15595","doi":"10.48550/arxiv.2410.15595","metadata_source":"pith","pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A comprehensive survey of datasets, theories, variants, and applications in direct preference optimization","venue":"cs.AI","work_id":"fbcda931-44f5-4714-9437-c62403696afb","year":2024},"citing_paper":{"arxiv_id":"2606.18323","last_updated":"2026-06-16T15:41:44Z","snapshot_observed_at":"2026-08-13T03:10:55.584303Z","submitted_at":"2026-06-16T15:41:44Z","title":"Reliable Neural-Codec Text-to-Speech by ASR Self-Verification and Distillation: Near-Zero Catastrophic Failures Across Models and Codecs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T22:46:47.786929Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2606.18323"},"observation_digest":"sha256:d23926c909b86d8e2a8d7d076c6cec4c44a5ecb02b8ac2704e46831f45a26e8f","observation_id":"97fe8aa6-09c7-463d-80d0-c2b16d2dc714","resolution":{"observed_at":"2026-07-03T23:19:02.875664Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":"2410.15595","doi":"10.48550/arxiv.2410.15595","metadata_source":"pith","pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A comprehensive survey of datasets, theories, variants, and applications in direct preference optimization","venue":"cs.AI","work_id":"fbcda931-44f5-4714-9437-c62403696afb","year":2024},"citing_paper":{"arxiv_id":"2606.21943","last_updated":"2026-06-20T08:20:41Z","snapshot_observed_at":"2026-07-06T23:56:54.959593Z","submitted_at":"2026-06-20T08:20:41Z","title":"Modularized Reinforcement Learning on LLMs: From MDP Creation to Exploration and Learning","version":1},"reference_index":233,"source":"pdf_text","source_observed_at":"2026-06-26T12:15:08.304150Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2606.21943"},"observation_digest":"sha256:9589d76b88cd00d8d0e80634de1c2223ccc4c9b38b017b7f96dbfb55eaa46db1","observation_id":"e86b1d7e-f9db-4e1d-b288-cefa5e6e7f8a","resolution":{"observed_at":"2026-07-04T08:09:40.699362Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15595","snapshot_observed_at":"2026-08-01T10:59:18.707247Z","title":"A comprehensive survey of direct preference optimization: Datasets, theories, variants, and applications.arXiv preprint arXiv:2410.15595, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20057","last_updated":"2026-07-22T11:59:38Z","snapshot_observed_at":"2026-08-11T15:45:03.346275Z","submitted_at":"2026-07-22T11:59:38Z","title":"Antigen-specific Antibody Multi-modal Foundation Model for Functional Antibody Design","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-01T10:59:18.707247Z"},"links":{"cited_paper":"/paper/2410.15595","citing_paper":"/paper/2607.20057"},"observation_digest":"sha256:ff278d559e124edcf2ce746d00828c91ebfe9ea1ab0bf90cbbae2054ab5eac21","observation_id":"65e0b408-5a26-4e3f-ae87-b9879ef5963c","resolution":{"observed_at":"2026-08-01T10:59:18.707247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.15595/citation-record","integrity":"/paper/2410.15595/integrity","json":"/paper/2410.15595/citation-record.json","paper":"/paper/2410.15595"},"outbound":[],"paper":{"arxiv_id":"2410.15595","last_updated":"2026-06-09T05:48:30Z","latest_version":4,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-12T22:19:01.850354Z","submitted_at":"2024-10-21T02:27:24Z","title":"A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 21 inbound Pith citation observations for arXiv:2410.15595."}