{"as_of":"2026-08-10T02:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f1ddca72dc1fd5ac47a631140e51de50b400ce3c082806c14f411fc243a7db48","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:45:20.428126Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.17829/citation-record","integrity":"/paper/2505.17829/integrity","json":"/paper/2505.17829/citation-record.json","paper":"/paper/2505.17829"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-06T08:53:09.095000Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-07T14:45:15.860789Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:15.860789Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:33b7b0c834d20229cb0aa3b718aeabbceed1e9941231402627efe2ab28dc464f","observation_id":"cbb5158a-e8f9-4d14-893a-453804d038da","resolution":{"observed_at":"2026-08-07T14:45:15.860789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:15.928935Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:15.928935Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:17d4ae4cfaa50ce121051b096f7a510a0c1d0d23b656928af4342a266c648e2f","observation_id":"d84d6c05-a592-4a30-9678-7e5de1b18f6f","resolution":{"observed_at":"2026-08-07T14:45:15.928935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09078","last_updated":"2025-04-01T12:48:43Z","snapshot_observed_at":"2026-08-08T09:53:22.230954Z","submitted_at":"2024-12-12T09:01:18Z","title":"Forest-of-Thought: Scaling Test-Time Compute for Enhancing LLM Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09078","snapshot_observed_at":"2026-08-07T14:45:15.995858Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:15.995858Z"},"links":{"cited_paper":"/paper/2412.09078","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:5bdc8e3a434064890cdb9712c8beb1e05b6d36182d4380d4d1ab34c6f7b7c70f","observation_id":"8198a83c-174c-47bb-9380-71fc6c8467c9","resolution":{"observed_at":"2026-08-07T14:45:15.995858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-07T14:45:16.052650Z","title":"Le, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.052650Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:736d62b1c21c24ce661b6874eb9d9db783fe6ab3f062c162ac70d915ae8f7af9","observation_id":"bf5dd1f9-059f-4b2f-83db-a84b73358037","resolution":{"observed_at":"2026-08-07T14:45:16.052650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:16.157711Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.157711Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:0c669c7a80c0be889f80b4d332dab64168f8d143978571bdaf23fa4a9bf7beea","observation_id":"5408ac83-e892-4b72-8be3-502414775fe8","resolution":{"observed_at":"2026-08-07T14:45:16.157711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04548","last_updated":"2025-03-06T15:34:27Z","snapshot_observed_at":"2026-08-07T17:24:22.925386Z","submitted_at":"2025-03-06T15:34:27Z","title":"An Empirical Study on Eliciting and Improving R1-like Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04548","snapshot_observed_at":"2026-08-07T14:45:16.258476Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.258476Z"},"links":{"cited_paper":"/paper/2503.04548","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:974fcb481d1b9d2128d436bafb8425ac453a7dab8c1f315e15ab6f39ee4e74f6","observation_id":"622a08fe-2874-4516-9be6-0009b06f3410","resolution":{"observed_at":"2026-08-07T14:45:16.258476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T14:45:16.355876Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.355876Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:cb2a354da51a8d4c1ba20bcbbd6968b823752c21318a336365197caa7723c268","observation_id":"f1958060-a26f-4663-849c-d564bdc09acb","resolution":{"observed_at":"2026-08-07T14:45:16.355876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15602","last_updated":"2025-06-19T07:05:12Z","snapshot_observed_at":"2026-07-06T20:26:21.639525Z","submitted_at":"2025-01-26T17:05:16Z","title":"Rethinking External Slow-Thinking: From Snowball Errors to Probability of Correct Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15602","snapshot_observed_at":"2026-08-07T14:45:16.471846Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.471846Z"},"links":{"cited_paper":"/paper/2501.15602","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:12693712afdc941d718bb817c175b6177a343470496333892b7ac79b7bb16de9","observation_id":"cc788a5d-fee3-4fcf-a0f5-5b710919b473","resolution":{"observed_at":"2026-08-07T14:45:16.471846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T14:45:16.567297Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.567297Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:9c78f4c416a722454a7794850f66d4288be805cb8ef84beaa863b52efe1aefe2","observation_id":"94ccc782-0e46-4550-b340-3a0efbd2a360","resolution":{"observed_at":"2026-08-07T14:45:16.567297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11504","last_updated":"2024-11-18T12:04:52Z","snapshot_observed_at":"2026-07-06T19:51:54.660531Z","submitted_at":"2024-11-18T12:04:52Z","title":"Search, Verify and Feedback: Towards Next Generation Post-training Paradigm of Foundation Models via Verifier Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11504","snapshot_observed_at":"2026-08-07T14:45:16.667323Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.667323Z"},"links":{"cited_paper":"/paper/2411.11504","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:59fc79fa2e3bec640012e4d20c3be7ece07fb1de63f8bc645d714f02fa602e1d","observation_id":"547bb6f3-c113-4139-be22-5ddb1d03a8c4","resolution":{"observed_at":"2026-08-07T14:45:16.667323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04519","last_updated":"2025-01-08T14:12:57Z","snapshot_observed_at":"2026-08-04T20:57:22.329262Z","submitted_at":"2025-01-08T14:12:57Z","title":"rStar-Math: Small LLMs Can Master Math Reasoning with Self-Evolved Deep Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04519","snapshot_observed_at":"2026-08-07T14:45:16.786796Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.786796Z"},"links":{"cited_paper":"/paper/2501.04519","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:bfd76f87d9e9f1dc8e346ce458e54f5788d78fcfd4a786e3b5db63afedf6258f","observation_id":"38b3018e-0145-4e90-a9ac-f5ecea67b504","resolution":{"observed_at":"2026-08-07T14:45:16.786796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:16.870979Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.870979Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:4c8a68d5c415abde43111fe0a99c4da057135a203756c51838f85e4826761c0e","observation_id":"91b7c566-b336-4bef-aefc-352dc56b0f58","resolution":{"observed_at":"2026-08-07T14:45:16.870979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19361","last_updated":"2025-03-30T14:48:59Z","snapshot_observed_at":"2026-08-07T17:45:25.804804Z","submitted_at":"2025-02-26T17:59:27Z","title":"Can Large Language Models Detect Errors in Long Chain-of-Thought Reasoning?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19361","snapshot_observed_at":"2026-08-07T14:45:16.967173Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.967173Z"},"links":{"cited_paper":"/paper/2502.19361","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:bd7c75a75077a028bedf437513d05d72194029b0ef4468a400ab984241a92577","observation_id":"a45e6103-0b37-4c7a-ace9-db5f77a7673e","resolution":{"observed_at":"2026-08-07T14:45:16.967173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:17.034269Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.034269Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:a8968787f57c3701e9aa4096c48c10c327c94c0ca39b7513d7a64ca5f325868f","observation_id":"69c03bf8-35d6-4f45-a1d2-c4ae7fd881da","resolution":{"observed_at":"2026-08-07T14:45:17.034269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13575","last_updated":"2025-06-11T21:59:20Z","snapshot_observed_at":"2026-08-07T18:06:06.265781Z","submitted_at":"2025-02-19T09:30:38Z","title":"ETS: Efficient Tree Search for Inference-Time Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13575","snapshot_observed_at":"2026-08-07T14:45:17.115091Z","title":"Mahoney, Sophia Shao, Kurt Keutzer, and Amir Gholami","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.115091Z"},"links":{"cited_paper":"/paper/2502.13575","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:105c8944165c35f9b3042355a84367a6b6305090a65a427fdd3baad1af2a6b8f","observation_id":"4c3263cb-f17e-41de-bd6a-ca488c2b2211","resolution":{"observed_at":"2026-08-07T14:45:17.115091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00031","last_updated":"2025-02-25T00:21:14Z","snapshot_observed_at":"2026-08-10T01:27:28.903517Z","submitted_at":"2025-02-25T00:21:14Z","title":"Efficient Test-Time Scaling via Self-Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00031","snapshot_observed_at":"2026-08-07T14:45:17.220177Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.220177Z"},"links":{"cited_paper":"/paper/2503.00031","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:04a53967228cc6384f1aeeed3260ab25470a1c57825de32f40facca9d01dc7af","observation_id":"895124a2-d20a-4fc3-8433-9edc9e6e7bd9","resolution":{"observed_at":"2026-08-07T14:45:17.220177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02497","last_updated":"2025-06-29T06:49:52Z","snapshot_observed_at":"2026-08-08T16:04:18.962646Z","submitted_at":"2025-01-05T10:24:20Z","title":"A Survey of Test-Time Compute: From Intuitive Inference to Deliberate Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02497","snapshot_observed_at":"2026-08-07T14:45:17.297639Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.297639Z"},"links":{"cited_paper":"/paper/2501.02497","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:ed256e80767de1c382cba907f97fc9ca5bbf414de5751772659c0593b3d19748","observation_id":"b0e05e90-6c61-41af-995c-45701c748fc2","resolution":{"observed_at":"2026-08-07T14:45:17.297639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11694","last_updated":"2024-12-31T01:38:12Z","snapshot_observed_at":"2026-08-09T03:55:09.041328Z","submitted_at":"2024-11-18T16:15:17Z","title":"Enhancing LLM Reasoning with Reward-guided Tree Search","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11694","snapshot_observed_at":"2026-08-07T14:45:17.406362Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.406362Z"},"links":{"cited_paper":"/paper/2411.11694","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:d7cd51a5b4f04e8da223363304cb53e095c1c5c78ff744ccb525a7e90a004d01","observation_id":"9f9ffe20-ea0b-4f37-9e95-257e32a45eae","resolution":{"observed_at":"2026-08-07T14:45:17.406362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:17.487613Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.487613Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:450838499b52c9766e719d139ca0b58e7aaab9c6fb4bc7aeea282638ab32a76e","observation_id":"1a881508-053e-43ab-953e-65baf416e635","resolution":{"observed_at":"2026-08-07T14:45:17.487613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10480","last_updated":"2024-01-19T04:03:59Z","snapshot_observed_at":"2026-07-06T17:17:44.177514Z","submitted_at":"2024-01-19T04:03:59Z","title":"Escape Sky-high Cost: Early-stopping Self-Consistency for Multi-step Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10480","snapshot_observed_at":"2026-08-07T14:45:17.591164Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.591164Z"},"links":{"cited_paper":"/paper/2401.10480","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:376446267dab6b05ee3ce183870b5b065c45b538bc50f04499d2ec16eb39042d","observation_id":"b25cc179-2cb9-4684-876d-15fefb5f7993","resolution":{"observed_at":"2026-08-07T14:45:17.591164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:17.671386Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.671386Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:2a16035cf7c8492096b3393a1f72100e2f66c364afb0614eb05f0ba3e6a9343e","observation_id":"21c2f839-5f79-4d08-a540-8d2ff69b315b","resolution":{"observed_at":"2026-08-07T14:45:17.671386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06703","last_updated":"2025-02-10T17:30:23Z","snapshot_observed_at":"2026-08-08T18:40:06.157350Z","submitted_at":"2025-02-10T17:30:23Z","title":"Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06703","snapshot_observed_at":"2026-08-07T14:45:17.775098Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.775098Z"},"links":{"cited_paper":"/paper/2502.06703","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:cd172fa766156544378c0e65d87b2788cec33a6d1ee3f4f13d365936431e4421","observation_id":"cec42c1f-e556-47dc-b89a-fa22ea3aa623","resolution":{"observed_at":"2026-08-07T14:45:17.775098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06592","last_updated":"2024-12-11T22:59:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T19:25:40Z","title":"Improve Mathematical Reasoning in Language Models by Automated Process Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06592","snapshot_observed_at":"2026-08-07T14:45:17.861908Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.861908Z"},"links":{"cited_paper":"/paper/2406.06592","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:65dee7af89dacd4f9e32327b9f97507e5c6314625184b11d633d4743aee04e2a","observation_id":"1249619d-e278-4318-80bc-9206c8487c21","resolution":{"observed_at":"2026-08-07T14:45:17.861908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:21.637677Z","title":null,"venue":null,"work_id":"3c89070f-227c-4aa1-9c0f-3e2db7f478f2","year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.962098Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:71a0527a236b1950af3557d06b33e1467b13cf93f3879d7b5ca78dac6b1e1e5b","observation_id":"91847d96-bfdd-4c5d-82ce-097a4fdeb616","resolution":{"observed_at":"2026-08-07T14:45:21.696466Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:18.067650Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.067650Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:5d5fc518aa203f866572a15a2cb619a978f376c01a2c413804d7b70c5d87b26a","observation_id":"f3feb280-534b-4aff-be6f-08be76e2c893","resolution":{"observed_at":"2026-08-07T14:45:18.067650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:18.171836Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.171836Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:2eed5db4dd9e7da556679ed10d4f451737f30f8bc4654725927734ad792a1fb0","observation_id":"8205ddc8-fe73-4af5-90ba-658f20f51cca","resolution":{"observed_at":"2026-08-07T14:45:18.171836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08146","last_updated":"2024-10-10T17:31:23Z","snapshot_observed_at":"2026-08-02T06:08:09.777151Z","submitted_at":"2024-10-10T17:31:23Z","title":"Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08146","snapshot_observed_at":"2026-08-07T14:45:18.293852Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.293852Z"},"links":{"cited_paper":"/paper/2410.08146","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:ee33e3d16d937ba98321074b389dcc7d7794a684ddb55f16201c022bd0b81982","observation_id":"eb92f12a-5360-4e3d-840b-43ff23e88e91","resolution":{"observed_at":"2026-08-07T14:45:18.293852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-07T14:45:18.388703Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.388703Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:a04d36a5b2dca10987674babd6ce1c9a9525ee3c255466c1c4e69d3bd7073aaf","observation_id":"8e2d8aad-fc61-4f3d-927e-56495a8c0ea2","resolution":{"observed_at":"2026-08-07T14:45:18.388703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-07T04:27:23.738927Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-07T14:45:18.474040Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.474040Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:8145dc1600bed71bd26848cb104db607d7a00399fae93ae115da50c227a3cf1c","observation_id":"d1c1ddc5-266a-468e-8699-bb896de78f2f","resolution":{"observed_at":"2026-08-07T14:45:18.474040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14275","last_updated":"2022-11-25T18:19:44Z","snapshot_observed_at":"2026-08-01T02:16:43.109337Z","submitted_at":"2022-11-25T18:19:44Z","title":"Solving math word problems with process- and outcome-based feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14275","snapshot_observed_at":"2026-08-07T14:45:18.564018Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.564018Z"},"links":{"cited_paper":"/paper/2211.14275","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:bab7f560798aeb50dc7b2d770759ac0e98eed11f85e166d53dd954458158d015","observation_id":"77f4f98b-17b4-4dde-9671-f1a15288d3a4","resolution":{"observed_at":"2026-08-07T14:45:18.564018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:21.462731Z","title":null,"venue":null,"work_id":"ffaeec83-e5d7-4f1c-b797-9420a0670f2a","year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.664750Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:703485a479009baf14d28c520071ae9fdaaf5c48789ebcf98f287a2cda8100ba","observation_id":"a15fb25e-acc2-4aea-84cd-154f347a5f9e","resolution":{"observed_at":"2026-08-07T14:45:21.514394Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09671","last_updated":"2024-10-12T23:42:16Z","snapshot_observed_at":"2026-08-08T14:45:36.681932Z","submitted_at":"2024-10-12T23:42:16Z","title":"OpenR: An Open Source Framework for Advanced Reasoning with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09671","snapshot_observed_at":"2026-08-07T14:45:18.769402Z","title":"Ni, Linyi Yang, Ying Wen, and Weinan Zhang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.769402Z"},"links":{"cited_paper":"/paper/2410.09671","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:fb80ee62ba4f0a6021a252055e7659478451e8f34bf8c1d75210ddb87c6ac351","observation_id":"3aa87878-559e-499f-a8ea-fbc5ec7b7e47","resolution":{"observed_at":"2026-08-07T14:45:18.769402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:18.860070Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.860070Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:6729c8a6bc4b8dc25f0b816e363856404c752f2416696cb38b85980c34ddb7de","observation_id":"db8b369f-b0ab-4444-9dac-49822359ca93","resolution":{"observed_at":"2026-08-07T14:45:18.860070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06508","last_updated":"2024-10-09T03:20:02Z","snapshot_observed_at":"2026-08-05T03:22:34.062603Z","submitted_at":"2024-10-09T03:20:02Z","title":"Towards Self-Improvement of LLMs via MCTS: Leveraging Stepwise Knowledge with Curriculum Preference Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06508","snapshot_observed_at":"2026-08-07T14:45:18.952147Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.952147Z"},"links":{"cited_paper":"/paper/2410.06508","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:46aaa94fb51e734261c0a106f88c6cd41af73f7b362c265443acf8464e217c14","observation_id":"a085871c-a7ba-4de6-806d-5b693720461d","resolution":{"observed_at":"2026-08-07T14:45:18.952147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:19.024357Z","title":"Chi, Sharan Narang, Aakanksha Chowdhery, and Denny Zhou","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.024357Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:1442455cea4b9557822c2a321844938b3cec9ed502cd955b40996d3f6cd4b456","observation_id":"86aacc1c-ec73-49e0-b39a-bd72eb478738","resolution":{"observed_at":"2026-08-07T14:45:19.024357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16144","last_updated":"2025-03-17T06:04:48Z","snapshot_observed_at":"2026-08-05T13:50:55.335296Z","submitted_at":"2024-06-23T15:50:22Z","title":"Chain-of-Probe: Examining the Necessity and Accuracy of CoT Step-by-Step","version":2},"cited_work":{"arxiv_id":"2406.16144","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16144","snapshot_observed_at":"2026-08-07T14:45:20.719720Z","title":"Chain-of-Probe: Examining the Necessity and Accuracy of CoT Step-by-Step","venue":"cs.CL","work_id":"537a7fb5-11bd-4615-84f8-89a509cccd90","year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.073344Z"},"links":{"cited_paper":"/paper/2406.16144","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:c4c8ba0c2de5bf3b1a09b140aa8f3374e4b65d564ec8777eb498ba98d4ae4cb8","observation_id":"38e75dee-09bc-464f-9e5b-dbbb4e5cc9e8","resolution":{"observed_at":"2026-08-07T14:45:20.790255Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:19.142078Z","title":"Chi, Quoc V","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.142078Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:ca1ce98869c0e21ef4e58decbe6ea0e0cab305ad5ae01b8e245453f6b686fdff","observation_id":"834c6eb3-761f-43ec-b151-317162dcc95a","resolution":{"observed_at":"2026-08-07T14:45:19.142078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18478","last_updated":"2025-06-02T14:26:19Z","snapshot_observed_at":"2026-08-09T13:23:20.877505Z","submitted_at":"2024-11-27T16:19:00Z","title":"Beyond Examples: High-level Automated Reasoning Paradigm in In-Context Learning via MCTS","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18478","snapshot_observed_at":"2026-08-07T14:45:19.217464Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.217464Z"},"links":{"cited_paper":"/paper/2411.18478","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:6897fb01aa1ddac4559238e97fb3a7cfe0e94ba3d3d4a13c34e9e841039ff21c","observation_id":"e76e0fb6-1f3d-40d6-b397-352717e997df","resolution":{"observed_at":"2026-08-07T14:45:19.217464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13639","last_updated":"2024-10-22T22:05:16Z","snapshot_observed_at":"2026-08-07T03:12:05.820669Z","submitted_at":"2024-10-17T15:09:03Z","title":"A Comparative Study on Reasoning Patterns of OpenAI's o1 Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13639","snapshot_observed_at":"2026-08-07T14:45:19.282901Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.282901Z"},"links":{"cited_paper":"/paper/2410.13639","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:20d8f605f5b207c65f3efb89efaa25b12d41d472d45dad58be510d27cc3e5ba0","observation_id":"984c6ccb-4398-4e84-a8da-5fdbe806bc49","resolution":{"observed_at":"2026-08-07T14:45:19.282901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07266","last_updated":"2025-05-27T02:56:52Z","snapshot_observed_at":"2026-08-08T13:14:58.702776Z","submitted_at":"2025-02-11T05:28:59Z","title":"When More is Less: Understanding Chain-of-Thought Length in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07266","snapshot_observed_at":"2026-08-07T14:45:19.333659Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.333659Z"},"links":{"cited_paper":"/paper/2502.07266","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:6bc19631645e7d43699f72ac20d72b9a9e6d8c6a449f168c5448a6fcf6c8251a","observation_id":"10c14ed8-4a82-4f5e-923e-154a71b61934","resolution":{"observed_at":"2026-08-07T14:45:19.333659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16579","last_updated":"2024-11-25T17:11:54Z","snapshot_observed_at":"2026-07-06T19:56:39.115630Z","submitted_at":"2024-11-25T17:11:54Z","title":"Enhancing LLM Reasoning via Critique Models with Test-Time and Training-Time Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16579","snapshot_observed_at":"2026-08-07T14:45:19.417118Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.417118Z"},"links":{"cited_paper":"/paper/2411.16579","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:5136232a489b203c16cbef519879fa28730f8ef6533d257a440d41b5b89fbaab","observation_id":"e23b3e40-b19e-44cb-9332-01a0262f1503","resolution":{"observed_at":"2026-08-07T14:45:19.417118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04682","last_updated":"2025-01-08T18:42:48Z","snapshot_observed_at":"2026-07-06T20:18:21.419068Z","submitted_at":"2025-01-08T18:42:48Z","title":"Towards System 2 Reasoning in LLMs: Learning How to Think With Meta Chain-of-Thought","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04682","snapshot_observed_at":"2026-08-07T14:45:19.472575Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.472575Z"},"links":{"cited_paper":"/paper/2501.04682","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:946ead569194a0e95e026a8db5adb4ab662ed2b34b8f59b3837ca8b133e146ed","observation_id":"13e43f31-d822-4b72-a7f6-63725eaf9c21","resolution":{"observed_at":"2026-08-07T14:45:19.472575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:19.536322Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.536322Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:ea19f5b67b7d179ea2d5fc6377ab71c9a73373bedc852fe2182b3aac75a1eacd","observation_id":"85cb7881-06b8-4663-b4dc-993a664390ef","resolution":{"observed_at":"2026-08-07T14:45:19.536322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T14:45:19.631357Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.631357Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:11f9484589ac91783fe0bc927097be7014c76f9f780308c87330170c8b83fdc0","observation_id":"0aee6a39-b94b-4531-8ad2-82b8a53dfab7","resolution":{"observed_at":"2026-08-07T14:45:19.631357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:21.305182Z","title":null,"venue":null,"work_id":"5ec1bb9e-c394-4af5-8fd9-428134419f5b","year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.734663Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:0ad9dd2c25ee90f0b531031e8a81d8852adc590d9e438ae209aaa338cd4656d7","observation_id":"62608014-6a3b-4aaa-9240-9b01f50e2ffb","resolution":{"observed_at":"2026-08-07T14:45:21.351151Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17256","last_updated":"2025-03-04T06:29:50Z","snapshot_observed_at":"2026-07-06T20:11:55.722067Z","submitted_at":"2024-12-23T03:58:34Z","title":"B-STaR: Monitoring and Balancing Exploration and Exploitation in Self-Taught Reasoners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17256","snapshot_observed_at":"2026-08-07T14:45:19.802170Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.802170Z"},"links":{"cited_paper":"/paper/2412.17256","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:59f1e672861d356bef4097685079f61523c06578a9e3441f42023e40f265d806","observation_id":"74de4af0-8adf-4a44-9744-56519d94e536","resolution":{"observed_at":"2026-08-07T14:45:19.802170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07394","last_updated":"2024-06-13T07:19:06Z","snapshot_observed_at":"2026-07-06T18:29:00.001236Z","submitted_at":"2024-06-11T16:01:07Z","title":"Accessing GPT-4 level Mathematical Olympiad Solutions via Monte Carlo Tree Self-refine with LLaMa-3 8B","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07394","snapshot_observed_at":"2026-08-07T14:45:19.883202Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.883202Z"},"links":{"cited_paper":"/paper/2406.07394","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:757686eab4758fbe964c9ec0cb3e2a364b0b7f5a0b5eb784bb5bb0fc18198c4b","observation_id":"fb9a8d92-a6fb-4231-9b1a-804b31ec998f","resolution":{"observed_at":"2026-08-07T14:45:19.883202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15240","last_updated":"2025-02-22T10:21:46Z","snapshot_observed_at":"2026-07-06T19:06:41.697671Z","submitted_at":"2024-08-27T17:57:45Z","title":"Generative Verifiers: Reward Modeling as Next-Token Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15240","snapshot_observed_at":"2026-08-07T14:45:19.980989Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.980989Z"},"links":{"cited_paper":"/paper/2408.15240","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:b3baae0a0cd37c0412a6aeafa5bc92b236e64ff247ca31272c140f06fc4bb385","observation_id":"f03cbe38-d485-4e5e-8883-c58344b01d95","resolution":{"observed_at":"2026-08-07T14:45:19.980989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24235","last_updated":"2025-05-04T15:48:08Z","snapshot_observed_at":"2026-08-07T23:06:45.603790Z","submitted_at":"2025-03-31T15:46:15Z","title":"A Survey on Test-Time Scaling in Large Language Models: What, How, Where, and How Well?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24235","snapshot_observed_at":"2026-08-07T14:45:20.078930Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:20.078930Z"},"links":{"cited_paper":"/paper/2503.24235","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:7715d912b781059ae69b41ea0bae5a487d576efe209ab0f0f28e315ec59734c8","observation_id":"9ac2fd92-d22d-4ebe-a714-758e178760ec","resolution":{"observed_at":"2026-08-07T14:45:20.078930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14405","last_updated":"2024-11-25T17:57:55Z","snapshot_observed_at":"2026-07-06T19:53:56.407834Z","submitted_at":"2024-11-21T18:37:33Z","title":"Marco-o1: Towards Open Reasoning Models for Open-Ended Solutions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14405","snapshot_observed_at":"2026-08-07T14:45:20.163992Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:20.163992Z"},"links":{"cited_paper":"/paper/2411.14405","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:473e252dae4e31e6101ef99f251be6cb4aadaa8ab8f3544d8dcdf36e7b768126","observation_id":"b5839cb0-47d4-4ac5-98dd-348c6f1c80cd","resolution":{"observed_at":"2026-08-07T14:45:20.163992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06559","last_updated":"2025-05-26T14:03:32Z","snapshot_observed_at":"2026-08-09T05:18:18.356511Z","submitted_at":"2024-12-09T15:11:40Z","title":"ProcessBench: Identifying Process Errors in Mathematical Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06559","snapshot_observed_at":"2026-08-07T14:45:20.276917Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:20.276917Z"},"links":{"cited_paper":"/paper/2412.06559","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:35a89bda1bd95684840e5c42664df0fa255b2028e649d4477dcedc674add1379","observation_id":"2e2d339d-9926-4eb1-a780-9707b0305fe9","resolution":{"observed_at":"2026-08-07T14:45:20.276917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:20.356452Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:20.356452Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:d14a0e5b78e551a060c2c26ee93ad9067b0ce997d72ef63d4834f2f3016e4122","observation_id":"9cc3677d-eeab-4864-a7b2-214235b9b7de","resolution":{"observed_at":"2026-08-07T14:45:20.356452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:20.428126Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:20.428126Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:5ba8e6043ea0c8cc5b47ba65927fa6a3739007eafcc8fc3c97498ff91c820d60","observation_id":"938ded77-216d-48cf-82da-478b2e82f1c6","resolution":{"observed_at":"2026-08-07T14:45:20.428126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T01:27:23.018231Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2505.17829."}