{"as_of":"2026-08-11T15:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:607b1af3edf3962d81e173d0b240e99b59a3fc3b115edc3587476231869d3e00","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T15:49:44.048289Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T13:15:43.851865Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.13622","last_updated":"2025-08-22T14:48:22Z","snapshot_observed_at":"2026-08-10T15:43:37.677974Z","submitted_at":"2025-01-23T12:44:45Z","title":"Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13622","snapshot_observed_at":"2026-08-04T13:15:43.851865Z","title":"Coarse-to-fine process reward modeling for mathematical reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.01167","last_updated":"2026-05-30T06:40:26Z","snapshot_observed_at":"2026-08-09T12:10:30.690264Z","submitted_at":"2025-10-01T17:54:15Z","title":"Simultaneous Multi-objective Alignment Across Verifiable and Non-verifiable Rewards","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T13:15:43.851865Z"},"links":{"cited_paper":"/paper/2501.13622","citing_paper":"/paper/2510.01167"},"observation_digest":"sha256:6363108ef6489f1c423da83274199db72ade34f99d3e3b3d22cc32df7dafde40","observation_id":"e405932f-9075-4701-adf2-ceb39301c7c2","resolution":{"observed_at":"2026-08-04T13:15:43.851865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.13622/citation-record","integrity":"/paper/2501.13622/integrity","json":"/paper/2501.13622/citation-record.json","paper":"/paper/2501.13622"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:49:43.968146Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13622","last_updated":"2025-08-22T14:48:22Z","snapshot_observed_at":"2026-08-10T15:43:37.677974Z","submitted_at":"2025-01-23T12:44:45Z","title":"Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning","version":4},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T15:49:43.968146Z"},"links":{"citing_paper":"/paper/2501.13622"},"observation_digest":"sha256:3f93d60647857fb915943a5668dbbfc2eb0aea54edc37ff793b33cd2a7fcb131","observation_id":"30225360-2779-46b4-b106-f34e737d8793","resolution":{"observed_at":"2026-08-10T15:49:43.968146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:49:43.973589Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13622","last_updated":"2025-08-22T14:48:22Z","snapshot_observed_at":"2026-08-10T15:43:37.677974Z","submitted_at":"2025-01-23T12:44:45Z","title":"Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning","version":4},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T15:49:43.973589Z"},"links":{"citing_paper":"/paper/2501.13622"},"observation_digest":"sha256:c3f2704ccc516acad91d3eeab07cd76300b6a8d0d9128a2fe2b609e7f7a4506e","observation_id":"34fad8ee-bea0-4340-818f-fcf21558aaf5","resolution":{"observed_at":"2026-08-10T15:49:43.973589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-10T15:49:43.978622Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13622","last_updated":"2025-08-22T14:48:22Z","snapshot_observed_at":"2026-08-10T15:43:37.677974Z","submitted_at":"2025-01-23T12:44:45Z","title":"Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning","version":4},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T15:49:43.978622Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2501.13622"},"observation_digest":"sha256:100db7abdfffafed3271b668669b92efb0625281e7dc5aa2305aa5cdf8842589","observation_id":"f8461951-039b-4288-8846-adbdee47537f","resolution":{"observed_at":"2026-08-10T15:49:43.978622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-10T15:49:43.984230Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13622","last_updated":"2025-08-22T14:48:22Z","snapshot_observed_at":"2026-08-10T15:43:37.677974Z","submitted_at":"2025-01-23T12:44:45Z","title":"Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning","version":4},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T15:49:43.984230Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2501.13622"},"observation_digest":"sha256:ffa734861caaf045bb630f82fc1b1cb0cb610a78111a4073a9cc1aaf73e811e0","observation_id":"60c2bd3b-5c17-4f89-b76e-d5d59204aa6d","resolution":{"observed_at":"2026-08-10T15:49:43.984230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-10T15:49:43.989758Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13622","last_updated":"2025-08-22T14:48:22Z","snapshot_observed_at":"2026-08-10T15:43:37.677974Z","submitted_at":"2025-01-23T12:44:45Z","title":"Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning","version":4},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T15:49:43.989758Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2501.13622"},"observation_digest":"sha256:b1d4605fb4df7e859385d3fe4a97a2539a819ee102beaeda41b5f11f2f33e4de","observation_id":"ed242d56-0d17-457c-838f-be991575e9ad","resolution":{"observed_at":"2026-08-10T15:49:43.989758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-10T15:49:43.994609Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13622","last_updated":"2025-08-22T14:48:22Z","snapshot_observed_at":"2026-08-10T15:43:37.677974Z","submitted_at":"2025-01-23T12:44:45Z","title":"Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning","version":4},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T15:49:43.994609Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2501.13622"},"observation_digest":"sha256:52c8786f4c9a3b1a1735eb56b027c31925f5799b99b4bb38f7ff9ea8556e9b7a","observation_id":"934a5e0f-c222-4324-86dd-443c7b3077c5","resolution":{"observed_at":"2026-08-10T15:49:43.994609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01798","last_updated":"2024-03-14T04:27:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-03T04:56:12Z","title":"Large Language Models Cannot Self-Correct Reasoning Yet","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01798","snapshot_observed_at":"2026-08-10T15:49:44.000861Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13622","last_updated":"2025-08-22T14:48:22Z","snapshot_observed_at":"2026-08-10T15:43:37.677974Z","submitted_at":"2025-01-23T12:44:45Z","title":"Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning","version":4},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T15:49:44.000861Z"},"links":{"cited_paper":"/paper/2310.01798","citing_paper":"/paper/2501.13622"},"observation_digest":"sha256:cbf7bf677682a9f9ab2c71a5228083192573b48378c0b8875150b476dc8d7c37","observation_id":"9ff8ff86-e8e8-4441-b94f-6aa4fc42a896","resolution":{"observed_at":"2026-08-10T15:49:44.000861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10169","last_updated":"2023-07-19T17:55:13Z","snapshot_observed_at":"2026-08-10T14:34:24.189939Z","submitted_at":"2023-07-19T17:55:13Z","title":"Challenges and Applications of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10169","snapshot_observed_at":"2026-08-10T15:49:44.005994Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13622","last_updated":"2025-08-22T14:48:22Z","snapshot_observed_at":"2026-08-10T15:43:37.677974Z","submitted_at":"2025-01-23T12:44:45Z","title":"Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning","version":4},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T15:49:44.005994Z"},"links":{"cited_paper":"/paper/2307.10169","citing_paper":"/paper/2501.13622"},"observation_digest":"sha256:13c23fe30571a4db45bab6bffcaa46fbf9d27f825b0eaf21a0761a0ecdc21d42","observation_id":"adfd210a-640d-43a1-9e64-37347db2a49e","resolution":{"observed_at":"2026-08-10T15:49:44.005994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19255","last_updated":"2024-07-02T03:46:03Z","snapshot_observed_at":"2026-08-06T12:10:50.595602Z","submitted_at":"2024-02-29T15:26:14Z","title":"GSM-Plus: A Comprehensive Benchmark for Evaluating the Robustness of LLMs as Mathematical Problem Solvers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19255","snapshot_observed_at":"2026-08-10T15:49:44.011913Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13622","last_updated":"2025-08-22T14:48:22Z","snapshot_observed_at":"2026-08-10T15:43:37.677974Z","submitted_at":"2025-01-23T12:44:45Z","title":"Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning","version":4},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T15:49:44.011913Z"},"links":{"cited_paper":"/paper/2402.19255","citing_paper":"/paper/2501.13622"},"observation_digest":"sha256:494f8d21384dcb8b0ec25c19f9b1cf9ff29ebd0889620b71fa46976734382aba","observation_id":"2c82e3f7-d0a7-4282-9afb-3a36ecf8df7f","resolution":{"observed_at":"2026-08-10T15:49:44.011913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11287","last_updated":"2025-02-11T05:41:41Z","snapshot_observed_at":"2026-08-06T19:03:24.746489Z","submitted_at":"2024-10-15T05:10:34Z","title":"Process Reward Model with Q-Value Rankings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11287","snapshot_observed_at":"2026-08-10T15:49:44.016691Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13622","last_updated":"2025-08-22T14:48:22Z","snapshot_observed_at":"2026-08-10T15:43:37.677974Z","submitted_at":"2025-01-23T12:44:45Z","title":"Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning","version":4},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T15:49:44.016691Z"},"links":{"cited_paper":"/paper/2410.11287","citing_paper":"/paper/2501.13622"},"observation_digest":"sha256:204d0ab337653f01118f5f2e342b5ec790e441952d21dc3c3c08d3d3cfe29741","observation_id":"71dbc219-e964-4d7b-b9f2-442416720d72","resolution":{"observed_at":"2026-08-10T15:49:44.016691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-11T13:05:29.313402Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-10T15:49:44.021340Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13622","last_updated":"2025-08-22T14:48:22Z","snapshot_observed_at":"2026-08-10T15:43:37.677974Z","submitted_at":"2025-01-23T12:44:45Z","title":"Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning","version":4},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T15:49:44.021340Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2501.13622"},"observation_digest":"sha256:a61e792fa3ab1d09715df61b206a6a0037ca0b2895b520dff337da6dca0e8b46","observation_id":"0ee91a7a-9306-4f5b-8098-5870b2a83679","resolution":{"observed_at":"2026-08-10T15:49:44.021340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08146","last_updated":"2024-10-10T17:31:23Z","snapshot_observed_at":"2026-08-02T06:08:09.777151Z","submitted_at":"2024-10-10T17:31:23Z","title":"Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08146","snapshot_observed_at":"2026-08-10T15:49:44.026345Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13622","last_updated":"2025-08-22T14:48:22Z","snapshot_observed_at":"2026-08-10T15:43:37.677974Z","submitted_at":"2025-01-23T12:44:45Z","title":"Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning","version":4},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T15:49:44.026345Z"},"links":{"cited_paper":"/paper/2410.08146","citing_paper":"/paper/2501.13622"},"observation_digest":"sha256:5f6c6147565087427645b39671f061b8a9650f9ecf709f43b27ba20e6ed45a8e","observation_id":"e32b0a2f-4069-4f64-a2d1-05e0f94038df","resolution":{"observed_at":"2026-08-10T15:49:44.026345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14275","last_updated":"2022-11-25T18:19:44Z","snapshot_observed_at":"2026-08-01T02:16:43.109337Z","submitted_at":"2022-11-25T18:19:44Z","title":"Solving math word problems with process- and outcome-based feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14275","snapshot_observed_at":"2026-08-10T15:49:44.033590Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13622","last_updated":"2025-08-22T14:48:22Z","snapshot_observed_at":"2026-08-10T15:43:37.677974Z","submitted_at":"2025-01-23T12:44:45Z","title":"Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning","version":4},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T15:49:44.033590Z"},"links":{"cited_paper":"/paper/2211.14275","citing_paper":"/paper/2501.13622"},"observation_digest":"sha256:2cd95921f251f15445d84d0f27ebe426a666b8e2e37a7a7e30779520c26b47dc","observation_id":"32143455-1347-4f23-999b-6242152982c5","resolution":{"observed_at":"2026-08-10T15:49:44.033590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:49:44.039314Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13622","last_updated":"2025-08-22T14:48:22Z","snapshot_observed_at":"2026-08-10T15:43:37.677974Z","submitted_at":"2025-01-23T12:44:45Z","title":"Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning","version":4},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T15:49:44.039314Z"},"links":{"citing_paper":"/paper/2501.13622"},"observation_digest":"sha256:c98276eb5575374e1d6e94a264cea74f1f413ef7446a75313f315031a6df4c11","observation_id":"1f472304-3412-4936-9631-e7a91b1b3ba7","resolution":{"observed_at":"2026-08-10T15:49:44.039314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-10T15:49:44.043784Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13622","last_updated":"2025-08-22T14:48:22Z","snapshot_observed_at":"2026-08-10T15:43:37.677974Z","submitted_at":"2025-01-23T12:44:45Z","title":"Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning","version":4},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T15:49:44.043784Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2501.13622"},"observation_digest":"sha256:616421264d19aaeeaddba56624924461698fe23d2499f02aa6353bb62f023b67","observation_id":"2c2921d5-4880-4ef2-b8af-9d34493337ae","resolution":{"observed_at":"2026-08-10T15:49:44.043784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03816","last_updated":"2024-11-18T05:36:16Z","snapshot_observed_at":"2026-08-04T20:04:21.125115Z","submitted_at":"2024-06-06T07:40:00Z","title":"ReST-MCTS*: LLM Self-Training via Process Reward Guided Tree Search","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03816","snapshot_observed_at":"2026-08-10T15:49:44.048289Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13622","last_updated":"2025-08-22T14:48:22Z","snapshot_observed_at":"2026-08-10T15:43:37.677974Z","submitted_at":"2025-01-23T12:44:45Z","title":"Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning","version":4},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T15:49:44.048289Z"},"links":{"cited_paper":"/paper/2406.03816","citing_paper":"/paper/2501.13622"},"observation_digest":"sha256:1f1d737704799bbc8253395ec112e885634d93edfc6da6f9ce7917594bad3d48","observation_id":"5044d472-b652-4884-99f1-01dd711cd724","resolution":{"observed_at":"2026-08-10T15:49:44.048289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.13622","last_updated":"2025-08-22T14:48:22Z","latest_version":4,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-10T15:43:37.677974Z","submitted_at":"2025-01-23T12:44:45Z","title":"Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 1 inbound Pith citation observation for arXiv:2501.13622."}