{"as_of":"2026-08-12T23:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9b6ec01b620775584f3ba68ad59c49e7c6d318b0b74962d08ad3459b4e0a9de8","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T15:57:22.808390Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.18239/citation-record","integrity":"/paper/2604.18239/integrity","json":"/paper/2604.18239/citation-record.json","paper":"/paper/2604.18239"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T15:57:20.675979Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.18239","last_updated":"2026-07-23T15:30:50Z","snapshot_observed_at":"2026-08-08T20:34:18.479871Z","submitted_at":"2026-04-20T13:23:27Z","title":"Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T15:57:20.675979Z"},"links":{"citing_paper":"/paper/2604.18239"},"observation_digest":"sha256:bb7f35a8a02931adf89af02b992367c3f008c93b6bbee2b70060deacdd7f864a","observation_id":"ed02e5cb-4f79-4b94-b74c-7d36adc85df9","resolution":{"observed_at":"2026-08-02T15:57:20.675979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T15:57:21.079138Z","title":"Li, J., Chen, W., Liu, Y ., Yang, J., Zeng, D., and Zhou, Z","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.18239","last_updated":"2026-07-23T15:30:50Z","snapshot_observed_at":"2026-08-08T20:34:18.479871Z","submitted_at":"2026-04-20T13:23:27Z","title":"Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T15:57:21.079138Z"},"links":{"citing_paper":"/paper/2604.18239"},"observation_digest":"sha256:a16e5a0081a73929dc9c7bce12b0571045a4db0cc751b9f29de4dc2a91c3fe00","observation_id":"8c3dd996-5c70-4b40-934f-2fb3d16de745","resolution":{"observed_at":"2026-08-02T15:57:21.079138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13228","last_updated":"2024-07-03T13:46:33Z","snapshot_observed_at":"2026-08-08T16:03:10.053914Z","submitted_at":"2024-02-20T18:42:34Z","title":"Smaug: Fixing Failure Modes of Preference Optimisation with DPO-Positive","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13228","snapshot_observed_at":"2026-08-02T15:57:21.269332Z","title":"Munos, R., Valko, M., Calandriello, D., Azar, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.18239","last_updated":"2026-07-23T15:30:50Z","snapshot_observed_at":"2026-08-08T20:34:18.479871Z","submitted_at":"2026-04-20T13:23:27Z","title":"Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T15:57:21.269332Z"},"links":{"cited_paper":"/paper/2402.13228","citing_paper":"/paper/2604.18239"},"observation_digest":"sha256:7d8306c195b6b175433bedf22c4b53cb2e01893ddd44cb6b731302a86970eb3f","observation_id":"6ff9588e-e5c6-46a1-b969-5f7f158cfa14","resolution":{"observed_at":"2026-08-02T15:57:21.269332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T15:57:21.500647Z","title":"Razin, N., Malladi, S., Bhaskar, A., Chen, D., Arora, S., and Hanin, B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.18239","last_updated":"2026-07-23T15:30:50Z","snapshot_observed_at":"2026-08-08T20:34:18.479871Z","submitted_at":"2026-04-20T13:23:27Z","title":"Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T15:57:21.500647Z"},"links":{"citing_paper":"/paper/2604.18239"},"observation_digest":"sha256:6362c9257f464855526d3444c5b43dd308de55f716bba8cf6fd87b8ab2ef5921","observation_id":"383d8080-aede-45ec-b06c-084084af2df4","resolution":{"observed_at":"2026-08-02T15:57:21.500647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-02T15:57:21.707722Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.18239","last_updated":"2026-07-23T15:30:50Z","snapshot_observed_at":"2026-08-08T20:34:18.479871Z","submitted_at":"2026-04-20T13:23:27Z","title":"Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T15:57:21.707722Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2604.18239"},"observation_digest":"sha256:2a693b0b6960132f6b858e80d95924b4737152f05f0163aa9bf126cd545e5943","observation_id":"3f1fcaca-4824-4e75-bd9d-7b4e4ca0c61b","resolution":{"observed_at":"2026-08-02T15:57:21.707722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T15:57:22.566238Z","title":"org/CorpusID:274859421","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.18239","last_updated":"2026-07-23T15:30:50Z","snapshot_observed_at":"2026-08-08T20:34:18.479871Z","submitted_at":"2026-04-20T13:23:27Z","title":"Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T15:57:22.566238Z"},"links":{"citing_paper":"/paper/2604.18239"},"observation_digest":"sha256:3396f675969bbeb487fd275b2100122434bcf11d23a0a3b9b63381700f7ad13b","observation_id":"0f8cf12b-f05d-45d5-9a0d-4440303b316c","resolution":{"observed_at":"2026-08-02T15:57:22.566238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T15:57:22.644269Z","title":"Yuan, H., Yuan, Z., Tan, C., Wang, W., Huang, S., and Huang, F","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.18239","last_updated":"2026-07-23T15:30:50Z","snapshot_observed_at":"2026-08-08T20:34:18.479871Z","submitted_at":"2026-04-20T13:23:27Z","title":"Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T15:57:22.644269Z"},"links":{"citing_paper":"/paper/2604.18239"},"observation_digest":"sha256:66d5a9996b29f0cbdceff354ef4ebd569e512c84b26e8ec3c7e3e919cd6547c6","observation_id":"4ae23a2a-babf-42dc-84f5-065a128dbc3a","resolution":{"observed_at":"2026-08-02T15:57:22.644269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T15:57:22.746322Z","title":"Zeng, Y ., Liu, G., Ma, W., Yang, N., Zhang, H., and Wang, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.18239","last_updated":"2026-07-23T15:30:50Z","snapshot_observed_at":"2026-08-08T20:34:18.479871Z","submitted_at":"2026-04-20T13:23:27Z","title":"Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T15:57:22.746322Z"},"links":{"citing_paper":"/paper/2604.18239"},"observation_digest":"sha256:a0c8078e02f6d80e771fe1a8d6658ca83660c8c4a73a4c2a21475cbd4e1dca47","observation_id":"3c43a103-a3d0-4bdc-928e-da3b95fd21fc","resolution":{"observed_at":"2026-08-02T15:57:22.746322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.24765","last_updated":"2026-04-22T06:35:36Z","snapshot_observed_at":"2026-08-10T21:02:28.717303Z","submitted_at":"2025-09-29T13:31:22Z","title":"Semantic-Aware Logical Reasoning via a Semiotic Framework","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.24765","snapshot_observed_at":"2026-08-02T15:57:22.808390Z","title":"Base w/o RC","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2604.18239","last_updated":"2026-07-23T15:30:50Z","snapshot_observed_at":"2026-08-08T20:34:18.479871Z","submitted_at":"2026-04-20T13:23:27Z","title":"Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T15:57:22.808390Z"},"links":{"cited_paper":"/paper/2509.24765","citing_paper":"/paper/2604.18239"},"observation_digest":"sha256:9e282ceb34e751b12728885662c27fee78db57083f14482c776300cefd8b6b0d","observation_id":"2c3cf895-0603-4e0c-bd38-353f1448397c","resolution":{"observed_at":"2026-08-02T15:57:22.808390Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-02T15:57:20.848345Z","title":"org/CorpusID:58068920","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2604.18239","last_updated":"2026-07-23T15:30:50Z","snapshot_observed_at":"2026-08-08T20:34:18.479871Z","submitted_at":"2026-04-20T13:23:27Z","title":"Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner","version":4},"reference_index":2001,"source":"pdf_text","source_observed_at":"2026-08-02T15:57:20.848345Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2604.18239"},"observation_digest":"sha256:072d477a5ed536b2acb258a109e074fa08b8a881c6b2c3920cb73bbd45d68cf2","observation_id":"8a5ce3ed-3eaa-478d-a5fd-1f96f64a4f1d","resolution":{"observed_at":"2026-08-02T15:57:20.848345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T15:57:21.944889Z","title":"org/CorpusID:44112860","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.18239","last_updated":"2026-07-23T15:30:50Z","snapshot_observed_at":"2026-08-08T20:34:18.479871Z","submitted_at":"2026-04-20T13:23:27Z","title":"Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner","version":4},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-02T15:57:21.944889Z"},"links":{"citing_paper":"/paper/2604.18239"},"observation_digest":"sha256:10404efc7ed40f8b24602580bf0596b63a16eea73939ec4b08b4574d5412476d","observation_id":"97ac27b5-c67e-475f-bfed-2669eb1af9d6","resolution":{"observed_at":"2026-08-02T15:57:21.944889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-06T00:29:17.674418Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01574","snapshot_observed_at":"2026-08-02T15:57:22.150586Z","title":"org/CorpusID:46615544","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2604.18239","last_updated":"2026-07-23T15:30:50Z","snapshot_observed_at":"2026-08-08T20:34:18.479871Z","submitted_at":"2026-04-20T13:23:27Z","title":"Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner","version":4},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-02T15:57:22.150586Z"},"links":{"cited_paper":"/paper/2406.01574","citing_paper":"/paper/2604.18239"},"observation_digest":"sha256:8e1695d0d5ba3f7ba43262eab47dc3cc79d7ee03be833c908259dd3cd3a7d62d","observation_id":"c3b268b7-6730-49c6-b7a8-8003c6578aac","resolution":{"observed_at":"2026-08-02T15:57:22.150586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T15:57:20.055196Z","title":"org/CorpusID:244478113","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.18239","last_updated":"2026-07-23T15:30:50Z","snapshot_observed_at":"2026-08-08T20:34:18.479871Z","submitted_at":"2026-04-20T13:23:27Z","title":"Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner","version":4},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-02T15:57:20.055196Z"},"links":{"citing_paper":"/paper/2604.18239"},"observation_digest":"sha256:4a24e27cc216284eab1d61ec4e1ac9f6f258d2c73eae998ae6cfd6ba1e647bf4","observation_id":"397a7f76-438b-4f00-b3c1-3d5e9d3a3029","resolution":{"observed_at":"2026-08-02T15:57:20.055196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-02T15:57:20.515549Z","title":"Dubois, Y ., Galambosi, B., Liang, P., and Hashimoto, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.18239","last_updated":"2026-07-23T15:30:50Z","snapshot_observed_at":"2026-08-08T20:34:18.479871Z","submitted_at":"2026-04-20T13:23:27Z","title":"Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner","version":4},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T15:57:20.515549Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2604.18239"},"observation_digest":"sha256:7a8a8489b61b6f668f85ddbd3202a76beb3247727ffdb4cf9888c240fd9ca37b","observation_id":"2ab998f5-6a8a-4fd7-aa39-5d6206574981","resolution":{"observed_at":"2026-08-02T15:57:20.515549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-02T15:57:20.248367Z","title":"Christiano, P","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2604.18239","last_updated":"2026-07-23T15:30:50Z","snapshot_observed_at":"2026-08-08T20:34:18.479871Z","submitted_at":"2026-04-20T13:23:27Z","title":"Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T15:57:20.248367Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2604.18239"},"observation_digest":"sha256:e4edadf340d16b310d4dd47a2884c71d7ab1acb347b09ce7f422d526ec89f395","observation_id":"563c051b-2318-443e-9735-177bf98dcc7e","resolution":{"observed_at":"2026-08-02T15:57:20.248367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01373","last_updated":"2023-05-31T17:54:07Z","snapshot_observed_at":"2026-08-07T23:49:29.478548Z","submitted_at":"2023-04-03T20:58:15Z","title":"Pythia: A Suite for Analyzing Large Language Models Across Training and Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01373","snapshot_observed_at":"2026-08-02T15:57:19.944569Z","title":"Beeching, E., Fourrier, C., Habib, N., Han, S., Lam- bert, N., Rajani, N., Sanseviero, O., Tunstall, L., and Wolf, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.18239","last_updated":"2026-07-23T15:30:50Z","snapshot_observed_at":"2026-08-08T20:34:18.479871Z","submitted_at":"2026-04-20T13:23:27Z","title":"Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner","version":4},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T15:57:19.944569Z"},"links":{"cited_paper":"/paper/2304.01373","citing_paper":"/paper/2604.18239"},"observation_digest":"sha256:c2e6ddf1054a42a2332629ce98a49811fd49f7980e34648a034bc0ef607d3ab3","observation_id":"25e3e511-d3fb-433c-ad6c-2e30300deb58","resolution":{"observed_at":"2026-08-02T15:57:19.944569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-02T15:57:22.408332Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.18239","last_updated":"2026-07-23T15:30:50Z","snapshot_observed_at":"2026-08-08T20:34:18.479871Z","submitted_at":"2026-04-20T13:23:27Z","title":"Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner","version":4},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-02T15:57:22.408332Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2604.18239"},"observation_digest":"sha256:1ecf273c5d8642f31cc0644817ad85cf98a2b15eb4fb22a4bb5b90d7b19fc9d5","observation_id":"7c0e464d-ba3c-448d-b2a2-294b1bcf9ce7","resolution":{"observed_at":"2026-08-02T15:57:22.408332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2604.18239","last_updated":"2026-07-23T15:30:50Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T20:34:18.479871Z","submitted_at":"2026-04-20T13:23:27Z","title":"Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2604.18239."}