{"as_of":"2026-08-13T13:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5970d199cc7b691c699e9f25f276debf486a05cca3f66082780b624e26e3bb96","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T10:39:36.971073Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T00:51:18.786861Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T22:47:25.851906Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"cited_work":{"arxiv_id":"2411.19039","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.19039","snapshot_observed_at":"2026-07-02T22:47:25.851906Z","title":"Mars-PO: Multi-agent reasoning system preference optimization,","venue":null,"work_id":"ea490869-8733-476e-a11b-e759e35db45a","year":2024},"citing_paper":{"arxiv_id":"2606.08728","last_updated":"2026-07-26T11:27:42Z","snapshot_observed_at":"2026-08-02T12:04:58.846884Z","submitted_at":"2026-06-07T16:50:07Z","title":"Artificial Intelligence for Mathematical Reasoning: An Integrated Survey of Language Models, Neuro-symbolic Systems, and Verified Discovery","version":1},"reference_index":160,"source":"pdf_text","source_observed_at":"2026-06-27T18:39:44.696961Z"},"links":{"cited_paper":"/paper/2411.19039","citing_paper":"/paper/2606.08728"},"observation_digest":"sha256:077e943c40580e9ef725a94063fcf5dcd1ff182a62956804b90a40eddf74f226","observation_id":"e0fde64d-8c8e-47f3-8ec0-1608e7cb85ed","resolution":{"observed_at":"2026-07-02T22:47:25.853804Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19039","snapshot_observed_at":"2026-08-02T12:05:17.904146Z","title":"Mars-PO: Multi-agent reasoning system preference optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08728","last_updated":"2026-07-26T11:27:42Z","snapshot_observed_at":"2026-08-02T12:04:58.846884Z","submitted_at":"2026-06-07T16:50:07Z","title":"Artificial Intelligence for Mathematical Reasoning: An Integrated Survey of Language Models, Neuro-symbolic Systems, and Verified Discovery","version":4},"reference_index":160,"source":"pdf_text","source_observed_at":"2026-08-02T12:05:17.904146Z"},"links":{"cited_paper":"/paper/2411.19039","citing_paper":"/paper/2606.08728"},"observation_digest":"sha256:17f103f8026f2d18b741ec929773991629725ed5968b2bda5f59c259f7361a1a","observation_id":"fad21fef-7abb-4ae9-bb49-ef5246c26335","resolution":{"observed_at":"2026-08-02T12:05:17.904146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19039","snapshot_observed_at":"2026-08-08T00:51:18.786861Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04056","last_updated":"2026-08-04T11:35:30Z","snapshot_observed_at":"2026-08-13T11:28:59.870000Z","submitted_at":"2026-08-04T11:35:30Z","title":"Learning Sexism Detection Using Multi-Agent Perspectivist Preference Optimization","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T00:51:18.786861Z"},"links":{"cited_paper":"/paper/2411.19039","citing_paper":"/paper/2608.04056"},"observation_digest":"sha256:64f39f0ba6a5eb67ec0f230065d6ca774111b97ade487a1d9b7b637468d917d7","observation_id":"89acc868-36dd-4f4b-a1b6-66445ed40372","resolution":{"observed_at":"2026-08-08T00:51:18.786861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.19039/citation-record","integrity":"/paper/2411.19039/integrity","json":"/paper/2411.19039/citation-record.json","paper":"/paper/2411.19039"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:39:36.844729Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.844729Z"},"links":{"citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:a765fe2e51eee4cacd165b9d0c08f5659a23e9d49678ae07cccf0e4520a05fc8","observation_id":"44978676-6343-4ace-ac84-4735b30733d9","resolution":{"observed_at":"2026-08-12T10:39:36.844729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:39:36.849582Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.849582Z"},"links":{"citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:52dfb5076d7327e212dd3cc60d841757500790b9697fe57a3fbbfb1ca8d877ca","observation_id":"fe1978fb-381b-4230-a4f3-3abbd91516c3","resolution":{"observed_at":"2026-08-12T10:39:36.849582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10631","last_updated":"2024-03-15T19:14:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-16T17:54:07Z","title":"Llemma: An Open Language Model For Mathematics","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10631","snapshot_observed_at":"2026-08-12T10:39:36.853722Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.853722Z"},"links":{"cited_paper":"/paper/2310.10631","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:17c1877bc51f4294165d2a028831d214cf8389707b5ab80d96088bc1a549ff4f","observation_id":"b69d1bd1-275c-4047-8019-3f99d87201af","resolution":{"observed_at":"2026-08-12T10:39:36.853722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12588","last_updated":"2023-10-23T01:27:38Z","snapshot_observed_at":"2026-08-02T13:06:11.850456Z","submitted_at":"2022-11-22T21:06:00Z","title":"Program of Thoughts Prompting: Disentangling Computation from Reasoning for Numerical Reasoning Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12588","snapshot_observed_at":"2026-08-12T10:39:36.858175Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.858175Z"},"links":{"cited_paper":"/paper/2211.12588","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:dc75b87186be68731ed7e03aa2bd03179af1e7c714918de7f9725f719c0b213e","observation_id":"a2e3ab6e-0316-465f-9de5-6442ec872262","resolution":{"observed_at":"2026-08-12T10:39:36.858175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-12T10:39:36.862423Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.862423Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:56ac7a306fd38bbadc34030b074cca284a7491507174bd646daf34312b91e528","observation_id":"4c76c731-d74f-4767-b21a-cd4ce34a847c","resolution":{"observed_at":"2026-08-12T10:39:36.862423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:39:36.866310Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.866310Z"},"links":{"citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:139e5e3acdc654c2accb56e02e19961ac99767e31ed03ac8d7276163a155dd06","observation_id":"5bc2d494-1f8e-4a1e-bdd4-cccab19ecc91","resolution":{"observed_at":"2026-08-12T10:39:36.866310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17452","last_updated":"2024-02-21T12:59:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:59:38Z","title":"ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17452","snapshot_observed_at":"2026-08-12T10:39:36.871101Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.871101Z"},"links":{"cited_paper":"/paper/2309.17452","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:77db2b53d4272ead7a1cf9784ad2812e7289d7ae73fd389dacd0e2b5babe6022","observation_id":"90534f5e-f1eb-4eda-bd20-e0875d954a79","resolution":{"observed_at":"2026-08-12T10:39:36.871101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-12T10:39:36.875004Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.875004Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:ad0c17fb7097b0103e0f8fe5a35d49f04abd2925d0ff5e1ca07aa5cee38429e2","observation_id":"bdafeecc-3b85-4da4-a92d-de7193ada97d","resolution":{"observed_at":"2026-08-12T10:39:36.875004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00658","last_updated":"2024-10-15T09:16:38Z","snapshot_observed_at":"2026-08-13T04:29:11.649710Z","submitted_at":"2024-02-01T15:18:33Z","title":"Learning Planning-based Reasoning by Trajectories Collection and Process Reward Synthesizing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00658","snapshot_observed_at":"2026-08-12T10:39:36.879146Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.879146Z"},"links":{"cited_paper":"/paper/2402.00658","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:6e9e4464c33b7b1c03f4f965bb5728643ffce41ff8b0005fe5caced2a429bcae","observation_id":"da187040-5038-43de-a5f9-d2fffd4447d7","resolution":{"observed_at":"2026-08-12T10:39:36.879146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18629","last_updated":"2024-06-26T17:43:06Z","snapshot_observed_at":"2026-08-06T00:24:52.274888Z","submitted_at":"2024-06-26T17:43:06Z","title":"Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18629","snapshot_observed_at":"2026-08-12T10:39:36.883872Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.883872Z"},"links":{"cited_paper":"/paper/2406.18629","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:c1b5f2ffd81a71013bcefab046f3bdd001a426671788ec85819e17710eac1064","observation_id":"90bd06fd-699c-4981-a096-0ddeb21a5be2","resolution":{"observed_at":"2026-08-12T10:39:36.883872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16352","last_updated":"2024-09-11T08:23:58Z","snapshot_observed_at":"2026-08-13T04:10:19.092794Z","submitted_at":"2024-02-26T07:17:25Z","title":"MathGenie: Generating Synthetic Data with Question Back-translation for Enhancing Mathematical Reasoning of LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16352","snapshot_observed_at":"2026-08-12T10:39:36.887300Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.887300Z"},"links":{"cited_paper":"/paper/2402.16352","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:df2e9ebf318f7da6ec40a0bf0e2ff2160ffac8f1669ff6dc57e3c249fd518a7c","observation_id":"aea2ab23-3e97-4f52-8a6c-2a852797e6cc","resolution":{"observed_at":"2026-08-12T10:39:36.887300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00782","last_updated":"2024-07-15T02:03:54Z","snapshot_observed_at":"2026-08-12T23:31:49.344042Z","submitted_at":"2024-06-30T17:59:07Z","title":"Step-Controlled DPO: Leveraging Stepwise Error for Enhanced Mathematical Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00782","snapshot_observed_at":"2026-08-12T10:39:36.892177Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.892177Z"},"links":{"cited_paper":"/paper/2407.00782","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:0b9bcc9f3b4fb2c89a16611645ce84092568fa114c159dc250dc6c2e30fad24a","observation_id":"092308c8-8fbf-432d-a907-950982865d6b","resolution":{"observed_at":"2026-08-12T10:39:36.892177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09583","last_updated":"2025-06-04T08:58:56Z","snapshot_observed_at":"2026-08-02T06:48:43.121988Z","submitted_at":"2023-08-18T14:23:21Z","title":"WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09583","snapshot_observed_at":"2026-08-12T10:39:36.896228Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.896228Z"},"links":{"cited_paper":"/paper/2308.09583","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:d48a1b868f261c8d4abce279d25bc977a3983faa6764044b6ddcc70fc2fc1085","observation_id":"dbba573a-fd9e-4537-a313-a3d9919ee766","resolution":{"observed_at":"2026-08-12T10:39:36.896228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19733","last_updated":"2024-06-26T01:28:35Z","snapshot_observed_at":"2026-08-13T03:45:12.203086Z","submitted_at":"2024-04-30T17:28:05Z","title":"Iterative Reasoning Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19733","snapshot_observed_at":"2026-08-12T10:39:36.900256Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.900256Z"},"links":{"cited_paper":"/paper/2404.19733","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:a0925bf81d6a9987c365a146331d0bed40584fe2d648d54526aebd2654f4b507","observation_id":"5196a5bb-39d1-4d20-88ca-3d17f19d2bbb","resolution":{"observed_at":"2026-08-12T10:39:36.900256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:39:37.251897Z","title":null,"venue":null,"work_id":"7c6fdea8-ae43-4d8b-8a51-184730a76e85","year":2024},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.904514Z"},"links":{"citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:2aa3f7de046d99ffa97f13433de1e7e54fc7339425b1b4b2a27f994903e9945e","observation_id":"3c7ce10d-34d5-4ea7-a7b7-f48b5feb2f5a","resolution":{"observed_at":"2026-08-12T10:39:37.256819Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:39:36.908574Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.908574Z"},"links":{"citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:47e7f66362e609ecac180a0e2b3f15172aca85291a1dee60324929fdf6b24d10","observation_id":"862f3825-faaa-4363-ac4d-35ecea58e809","resolution":{"observed_at":"2026-08-12T10:39:36.908574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-12T10:39:36.912463Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.912463Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:921beeb9338d8b3adef3adb0e5283fb80b9b991102dc9af292f08af90028da5a","observation_id":"0c753632-aed5-457f-9e7c-86c04c976b40","resolution":{"observed_at":"2026-08-12T10:39:36.912463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-12T10:39:36.917079Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.917079Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:768e7a8f121bd68c7748c61e3afdaec7f89584faf9f0f56518035fec11cddf35","observation_id":"2fca0c12-0183-414e-8c32-758177f048b7","resolution":{"observed_at":"2026-08-12T10:39:36.917079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-12T10:39:36.921843Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.921843Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:b3c151e212ce30e14a28bc410c34370225be6588e13313c406fb5f73e0c70aed","observation_id":"7338620b-1acc-47d1-be50-6ee3f5322206","resolution":{"observed_at":"2026-08-12T10:39:36.921843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03731","last_updated":"2023-10-05T17:52:09Z","snapshot_observed_at":"2026-08-13T05:55:59.432178Z","submitted_at":"2023-10-05T17:52:09Z","title":"MathCoder: Seamless Code Integration in LLMs for Enhanced Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03731","snapshot_observed_at":"2026-08-12T10:39:36.927288Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.927288Z"},"links":{"cited_paper":"/paper/2310.03731","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:b8030c234bd9d3da829bdc246eb8775bf696cdd13d5c196f634594fa2a04bf68","observation_id":"3b8ff6cf-443f-466f-ade9-ed8745ad3009","resolution":{"observed_at":"2026-08-12T10:39:36.927288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17120","last_updated":"2024-10-29T17:02:45Z","snapshot_observed_at":"2026-08-13T04:52:46.970158Z","submitted_at":"2023-12-28T16:55:40Z","title":"MathPile: A Billion-Token-Scale Pretraining Corpus for Math","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17120","snapshot_observed_at":"2026-08-12T10:39:36.932384Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.932384Z"},"links":{"cited_paper":"/paper/2312.17120","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:af0577cbfd1d273fe19a67c294413ce5f3da7cf17560ba42bea128b5165affef","observation_id":"e5b6f45e-af7c-439c-9150-1561a4ece9ba","resolution":{"observed_at":"2026-08-12T10:39:36.932384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:39:36.936765Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.936765Z"},"links":{"citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:e32bd31b2d51cd45523ccba6202f2c488dc7ecfdb0901b31b5a8178a46db8495","observation_id":"f3b16405-76e5-4512-84d3-52bc351c91b2","resolution":{"observed_at":"2026-08-12T10:39:36.936765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02893","last_updated":"2024-04-03T17:51:18Z","snapshot_observed_at":"2026-08-13T00:38:17.242638Z","submitted_at":"2024-04-03T17:51:18Z","title":"ChatGLM-Math: Improving Math Problem-Solving in Large Language Models with a Self-Critique Pipeline","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02893","snapshot_observed_at":"2026-08-12T10:39:36.940937Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.940937Z"},"links":{"cited_paper":"/paper/2404.02893","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:1719d1a022c314eff25be2683e2e11f01e2f90df65fa99f0a85d1f32b177c797","observation_id":"721c0176-7414-437d-b0a2-011c714ec572","resolution":{"observed_at":"2026-08-12T10:39:36.940937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-12T10:39:36.945956Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.945956Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:ec3a0b3d4854219ebe621c71740321954ec19fc160e8ab04bb25bb423eb58485","observation_id":"7adcefdb-fd75-4394-af8b-c99317d899a1","resolution":{"observed_at":"2026-08-12T10:39:36.945956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03241","last_updated":"2023-09-12T11:01:25Z","snapshot_observed_at":"2026-08-13T10:19:33.700830Z","submitted_at":"2023-09-06T06:18:16Z","title":"GPT Can Solve Mathematical Problems Without a Calculator","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03241","snapshot_observed_at":"2026-08-12T10:39:36.950309Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.950309Z"},"links":{"cited_paper":"/paper/2309.03241","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:7f15b5b0638f57752a84e27cef6d2e13f431ba6c9505cbe02fac0ea04cbd46c8","observation_id":"a1da0a09-133b-419e-a065-991a3d39e13e","resolution":{"observed_at":"2026-08-12T10:39:36.950309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:39:36.954267Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.954267Z"},"links":{"citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:9acfd0af741d7fcf835b07477bdd74748a6e9c3783fb4eca44dd45c8c82b3b60","observation_id":"761051ce-13c4-49a1-9b8f-20f48b49cc5b","resolution":{"observed_at":"2026-08-12T10:39:36.954267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-13T10:57:13.012119Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-12T10:39:36.958091Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.958091Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:44ad4f42dd3a44c567a49b84ce8d435de0ac4c2e0e1b8366dbabcf59a664d0eb","observation_id":"305984be-5c6d-4764-8f89-5b14cf9c8b2d","resolution":{"observed_at":"2026-08-12T10:39:36.958091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01825","last_updated":"2023-09-13T03:57:29Z","snapshot_observed_at":"2026-08-13T12:20:57.788212Z","submitted_at":"2023-08-03T15:34:01Z","title":"Scaling Relationship on Learning Mathematical Reasoning with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01825","snapshot_observed_at":"2026-08-12T10:39:36.961902Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.961902Z"},"links":{"cited_paper":"/paper/2308.01825","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:e0b5e92322983766f1549ae7a3856c2bc430566c897e7c5ff658bc6206001897","observation_id":"dda0896e-d2c9-4f86-b7a2-0b527704616a","resolution":{"observed_at":"2026-08-12T10:39:36.961902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05653","last_updated":"2023-10-03T02:48:42Z","snapshot_observed_at":"2026-08-07T14:43:09.380195Z","submitted_at":"2023-09-11T17:47:22Z","title":"MAmmoTH: Building Math Generalist Models through Hybrid Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05653","snapshot_observed_at":"2026-08-12T10:39:36.966610Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.966610Z"},"links":{"cited_paper":"/paper/2309.05653","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:15504089d44b2af29b14af71feb41236d896c2ee41e672f87d87bed3a5ec3c18","observation_id":"2df16948-1a9b-4da4-a342-2654562421b1","resolution":{"observed_at":"2026-08-12T10:39:36.966610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07921","last_updated":"2023-08-15T17:58:45Z","snapshot_observed_at":"2026-08-13T10:34:06.970583Z","submitted_at":"2023-08-15T17:58:45Z","title":"Solving Challenging Math Word Problems Using GPT-4 Code Interpreter with Code-based Self-Verification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07921","snapshot_observed_at":"2026-08-12T10:39:36.971073Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T10:39:36.971073Z"},"links":{"cited_paper":"/paper/2308.07921","citing_paper":"/paper/2411.19039"},"observation_digest":"sha256:1053f7ea3eb771666a260ce8d9ef9d7de148d15ce1ab2054e9df61915fcb4bdc","observation_id":"ec6e52b0-60f0-4bfc-a642-8abeb6402a57","resolution":{"observed_at":"2026-08-12T10:39:36.971073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.19039","last_updated":"2024-11-28T10:35:16Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-13T08:54:43.440176Z","submitted_at":"2024-11-28T10:35:16Z","title":"Mars-PO: Multi-Agent Reasoning System Preference Optimization"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 3 inbound Pith citation observations for arXiv:2411.19039."}