{"as_of":"2026-08-10T04:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b92733360a898643116c99dcfc19f2296b2e3c6195818c4dbe15ae49fa1e5769","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:09:44.129023Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-07T17:10:44.708302Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-07T05:09:44.129023Z","title":"A survey of direct preference optimization.arXiv preprint arXiv:2503.11701, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08745","last_updated":"2025-06-10T12:40:39Z","snapshot_observed_at":"2026-08-08T00:32:04.126170Z","submitted_at":"2025-06-10T12:40:39Z","title":"Consistent Paths Lead to Truth: Self-Rewarding Reinforcement Learning for LLM Reasoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:09:44.129023Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2506.08745"},"observation_digest":"sha256:79509e5e395ded9d27945263723b17f5ca6b44835a5488e1a1134a4bc134a6c3","observation_id":"e1c935f6-3a28-48d5-aa9a-b50a8efa91e9","resolution":{"observed_at":"2026-08-07T05:09:44.129023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-07T17:10:44.708302Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-07T05:09:34.053645Z","title":"A survey of direct preference optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09096","last_updated":"2025-06-16T04:03:11Z","snapshot_observed_at":"2026-08-07T05:00:14.370421Z","submitted_at":"2025-06-10T12:59:14Z","title":"Intra-Trajectory Consistency for Reward Modeling","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T05:09:34.053645Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2506.09096"},"observation_digest":"sha256:5bed71ed01e8479ab41d517f27be16484cc23b4a9d064bf9e1027d6d04c188a8","observation_id":"99d4cb26-b296-413f-a0f2-d56a0e88cb02","resolution":{"observed_at":"2026-08-07T05:09:34.053645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-07T17:10:44.708302Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-06T15:40:33.764607Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15281","last_updated":"2025-07-21T06:30:39Z","snapshot_observed_at":"2026-08-09T23:08:15.822530Z","submitted_at":"2025-07-21T06:30:39Z","title":"A Novel Self-Evolution Framework for Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T15:40:33.764607Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2507.15281"},"observation_digest":"sha256:369c2cd5283090457b74c7074e151fa4d802476790d3c67798676148382d4a7f","observation_id":"7a998fd7-a7b3-4929-9f05-f782f3d09b1b","resolution":{"observed_at":"2026-08-06T15:40:33.764607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-07T17:10:44.708302Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2503.11701","doi":"10.48550/arxiv.2503.11701","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Direct Preference Optimization , journal =","venue":"arXiv (Cornell University)","work_id":"5ed16d1c-9ad4-4eb5-80e6-650d33cb9f66","year":2025},"citing_paper":{"arxiv_id":"2509.03526","last_updated":"2026-05-20T03:07:46Z","snapshot_observed_at":"2026-08-07T01:53:38.136292Z","submitted_at":"2025-08-25T07:31:48Z","title":"Enhancing Speech Large Language Models through Reinforced Behavior Alignment","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-21T22:23:52.392075Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2509.03526"},"observation_digest":"sha256:3174d5187797fd99d88e5a27cb5676b8dacffc3f04274a81f20d2eefa89b3811","observation_id":"8de070ee-5aae-42de-9bcb-a29fff768523","resolution":{"observed_at":"2026-05-21T22:24:23.437263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-07T17:10:44.708302Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-04T06:54:11.231474Z","title":"A survey of direct preference optimization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.00382","last_updated":"2026-08-03T16:22:30Z","snapshot_observed_at":"2026-08-07T22:27:02.267336Z","submitted_at":"2025-11-01T03:29:56Z","title":"Efficiency vs. Alignment: Investigating Safety and Fairness Risks in Parameter-Efficient Fine-Tuning of LLMs","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T06:54:11.231474Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2511.00382"},"observation_digest":"sha256:4df3887ec2c4ff5e028d796bb6143b38022104a65c88bb0c7101068a9be96a82","observation_id":"ecd42d58-be7e-4676-946a-a1142d2fc2ae","resolution":{"observed_at":"2026-08-04T06:54:11.231474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-07T17:10:44.708302Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2503.11701","doi":"10.48550/arxiv.2503.11701","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Direct Preference Optimization , journal =","venue":"arXiv (Cornell University)","work_id":"5ed16d1c-9ad4-4eb5-80e6-650d33cb9f66","year":2025},"citing_paper":{"arxiv_id":"2603.18113","last_updated":"2026-05-09T03:21:15Z","snapshot_observed_at":"2026-08-02T05:27:37.366682Z","submitted_at":"2026-03-18T14:05:51Z","title":"VC-Soup: Value-Consistency Guided Multi-Value Alignment for Large Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T09:38:32.977517Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2603.18113"},"observation_digest":"sha256:209187510477fc1e9ce7cb3dee807abf287fe111de2b2c4fda103fab24d8a298","observation_id":"ee5a3204-80e7-427e-b045-6d032292e33a","resolution":{"observed_at":"2026-05-15T09:39:54.350069Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-07T17:10:44.708302Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2503.11701","doi":"10.48550/arxiv.2503.11701","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Direct Preference Optimization , journal =","venue":"arXiv (Cornell University)","work_id":"5ed16d1c-9ad4-4eb5-80e6-650d33cb9f66","year":2025},"citing_paper":{"arxiv_id":"2604.07941","last_updated":"2026-04-16T04:43:04Z","snapshot_observed_at":"2026-08-02T07:24:04.075021Z","submitted_at":"2026-04-09T08:00:37Z","title":"Large Language Model Post-Training: A Unified View of Off-Policy and On-Policy Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T18:28:58.515666Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2604.07941"},"observation_digest":"sha256:e1e55b7573438b0f340dab681158097637583fe067a665789fcd605fd25de217","observation_id":"1696a3ff-944e-435f-8c6c-275e5452166a","resolution":{"observed_at":"2026-05-11T00:30:53.684688Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-07T17:10:44.708302Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2503.11701","doi":"10.48550/arxiv.2503.11701","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Direct Preference Optimization , journal =","venue":"arXiv (Cornell University)","work_id":"5ed16d1c-9ad4-4eb5-80e6-650d33cb9f66","year":2025},"citing_paper":{"arxiv_id":"2604.11259","last_updated":"2026-04-13T10:12:03Z","snapshot_observed_at":"2026-08-08T19:50:22.048210Z","submitted_at":"2026-04-13T10:12:03Z","title":"Mobile GUI Agent Privacy Personalization with Trajectory Induced Preference Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T16:11:49.149334Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2604.11259"},"observation_digest":"sha256:98d8a85fc6fe200b0a443ccc28560f9a73625325937ee31524f07c3351949f0b","observation_id":"fd377ff2-8a5f-44e1-bfc0-9fec693a5a7f","resolution":{"observed_at":"2026-05-11T09:11:01.255353Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-07T17:10:44.708302Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2503.11701","doi":"10.48550/arxiv.2503.11701","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Direct Preference Optimization , journal =","venue":"arXiv (Cornell University)","work_id":"5ed16d1c-9ad4-4eb5-80e6-650d33cb9f66","year":2025},"citing_paper":{"arxiv_id":"2605.12288","last_updated":"2026-06-10T07:32:21Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T15:44:33Z","title":"TokenRatio: Principled Token-Level Preference Optimization via Ratio Matching","version":1},"reference_index":177,"source":"arxiv_source","source_observed_at":"2026-05-13T04:55:55.013900Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2605.12288"},"observation_digest":"sha256:939467d1d4ba9f6337f7f669ea9e2c9a984a0f27a0e8c254ef6e655362780900","observation_id":"9c1d35da-0d6c-45d9-8dd0-cd8bd70ac6c5","resolution":{"observed_at":"2026-05-13T04:57:16.671074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-07T17:10:44.708302Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2503.11701","doi":"10.48550/arxiv.2503.11701","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Direct Preference Optimization , journal =","venue":"arXiv (Cornell University)","work_id":"5ed16d1c-9ad4-4eb5-80e6-650d33cb9f66","year":2025},"citing_paper":{"arxiv_id":"2605.12288","last_updated":"2026-06-10T07:32:21Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T15:44:33Z","title":"TokenRatio: Principled Token-Level Preference Optimization via Ratio Matching","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-15T05:41:10.714594Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2605.12288"},"observation_digest":"sha256:253e055bd01baea2f66193132afee7d3d739ec976adaaea66834ee426783579b","observation_id":"6b978201-41a7-494c-915b-f4ea47e82fac","resolution":{"observed_at":"2026-05-15T05:45:05.018076Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-07T17:10:44.708302Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2503.11701","doi":"10.48550/arxiv.2503.11701","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Direct Preference Optimization , journal =","venue":"arXiv (Cornell University)","work_id":"5ed16d1c-9ad4-4eb5-80e6-650d33cb9f66","year":2025},"citing_paper":{"arxiv_id":"2605.30930","last_updated":"2026-05-29T07:19:58Z","snapshot_observed_at":"2026-08-02T17:43:14.199867Z","submitted_at":"2026-05-29T07:19:58Z","title":"TUX: Measuring Human--AI Tacit Understanding","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-28T21:18:37.366258Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2605.30930"},"observation_digest":"sha256:226709e3ff3286c5395e08b05939f0e5c9068d99b2318d5636e4e145a806cabb","observation_id":"62e96638-a393-4a34-84f2-c538b10ce10c","resolution":{"observed_at":"2026-06-28T21:22:38.748817Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-07T17:10:44.708302Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":"2503.11701","doi":"10.48550/arxiv.2503.11701","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Direct Preference Optimization , journal =","venue":"arXiv (Cornell University)","work_id":"5ed16d1c-9ad4-4eb5-80e6-650d33cb9f66","year":2025},"citing_paper":{"arxiv_id":"2606.18323","last_updated":"2026-06-16T15:41:44Z","snapshot_observed_at":"2026-08-06T02:49:06.057401Z","submitted_at":"2026-06-16T15:41:44Z","title":"Reliable Neural-Codec Text-to-Speech by ASR Self-Verification and Distillation: Near-Zero Catastrophic Failures Across Models and Codecs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T22:46:47.786929Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2606.18323"},"observation_digest":"sha256:5646366d90510ceae343e24f1dc34734f788ef715529f3ca1845b947ad32dd73","observation_id":"20ac0933-1d06-433f-bea2-65123a72cac4","resolution":{"observed_at":"2026-07-03T23:19:02.939868Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-07T17:10:44.708302Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-02T13:36:56.375550Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21610","last_updated":"2026-05-20T04:43:02Z","snapshot_observed_at":"2026-08-06T13:09:35.487490Z","submitted_at":"2026-05-20T04:43:02Z","title":"SCOPE and SCION: A Benchmark and an Auditable Reference Pipeline for Schema Induction and Fusion from Text","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T13:36:56.375550Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2607.21610"},"observation_digest":"sha256:8739c51b38d07214663863b28bab271c51bbd81a7aa52f423eca5d8a11d192cb","observation_id":"35783b72-aa3d-4470-8121-0eaf885c9031","resolution":{"observed_at":"2026-08-02T13:36:56.375550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","snapshot_observed_at":"2026-08-07T17:10:44.708302Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11701","snapshot_observed_at":"2026-08-03T00:22:51.122740Z","title":"arXiv preprint arXiv:2503.11701 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28814","last_updated":"2026-07-30T20:16:03Z","snapshot_observed_at":"2026-08-07T13:55:38.676905Z","submitted_at":"2026-07-30T20:16:03Z","title":"Rolling With Resistance: Preference-Optimized LLM Counselors Can Trade Goal Persistence for Relational Attunement in Motivational Interviewing","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-03T00:22:51.122740Z"},"links":{"cited_paper":"/paper/2503.11701","citing_paper":"/paper/2607.28814"},"observation_digest":"sha256:9f58a078b853cdea48ed6515b09da962dfb7de00e6272f28a9f6f8f9b8ad68d1","observation_id":"6f2b483e-719d-4b54-a9a6-702675fde444","resolution":{"observed_at":"2026-08-03T00:22:51.122740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2503.11701/citation-record","integrity":"/paper/2503.11701/integrity","json":"/paper/2503.11701/citation-record.json","paper":"/paper/2503.11701"},"outbound":[],"paper":{"arxiv_id":"2503.11701","last_updated":"2025-03-12T08:45:15Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T17:10:44.708302Z","submitted_at":"2025-03-12T08:45:15Z","title":"A Survey of Direct Preference Optimization"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2503.11701."}