{"as_of":"2026-08-11T07:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b41f668588afe88828cbc8e92a9594b3c664e11f7870eba4ef22cbc09a2d729c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":56,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T23:09:44.269878Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":3,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2312.08935","last_updated":"2024-02-19T14:07:53Z","snapshot_observed_at":"2026-08-11T06:00:55.192366Z","submitted_at":"2023-12-14T13:41:54Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-14T22:34:15.638114Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2312.08935"},"observation_digest":"sha256:374447dd1c06107db474e8e0eec8f4e1ada7ac78d610f195f8b007847b34f550","observation_id":"aea7076a-c96b-45b0-84c0-e62d2b2c97e4","resolution":{"observed_at":"2026-05-14T22:34:15.902550Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2406.06592","last_updated":"2024-12-11T22:59:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T19:25:40Z","title":"Improve Mathematical Reasoning in Language Models by Automated Process Supervision","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T20:53:45.878221Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2406.06592"},"observation_digest":"sha256:1321f6faebf3f8141ce9babd4dce2b70ebd31f97cf6088f835cd8db639446dc0","observation_id":"a9446a2e-c207-429b-a153-efdfed86db07","resolution":{"observed_at":"2026-05-13T20:53:45.903535Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-10T23:09:44.269878Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.20993","last_updated":"2025-05-27T16:41:53Z","snapshot_observed_at":"2026-08-11T02:39:29.458364Z","submitted_at":"2024-12-30T14:57:53Z","title":"Efficiently Scaling LLM Reasoning with Certaindex","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T23:09:44.269878Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2412.20993"},"observation_digest":"sha256:742115a8891bc2fc8fd1ddc235ca4a4e79a66ccf7d51f1cad1af6cf3b505869a","observation_id":"fffcf75f-e6d4-474b-8407-31f54595ab11","resolution":{"observed_at":"2026-08-10T23:09:44.269878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-10T21:57:50.718863Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03226","last_updated":"2025-02-17T06:27:16Z","snapshot_observed_at":"2026-08-11T02:32:28.940981Z","submitted_at":"2025-01-06T18:59:13Z","title":"BoostStep: Boosting mathematical capability of Large Language Models via improved single-step reasoning","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T21:57:50.718863Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2501.03226"},"observation_digest":"sha256:054e505faedb436c97a82b09e4ea30c4780ef81d1d2cef0740ab46c99a63d20b","observation_id":"d7acb99e-dda2-4a48-8d3c-85826cb4ee4a","resolution":{"observed_at":"2026-08-10T21:57:50.718863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-10T20:26:29.165127Z","title":"M., Wen, Y., Zhang, W., and Wang, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08603","last_updated":"2025-01-31T05:28:15Z","snapshot_observed_at":"2026-08-11T02:32:30.180307Z","submitted_at":"2025-01-15T06:00:50Z","title":"Monte Carlo Tree Search for Comprehensive Exploration in LLM-Based Automatic Heuristic Design","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T20:26:29.165127Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2501.08603"},"observation_digest":"sha256:32cf33b580a1a5c07b0e7b59d1f1b420f090e6fd6aad757483c69dc49d1353c1","observation_id":"11b85831-dbcd-4a8f-acf3-7e651b70d0c8","resolution":{"observed_at":"2026-08-10T20:26:29.165127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-10T14:15:46.007079Z","title":"M., Wen, Y., Zhang, W., and Wang, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15602","last_updated":"2025-06-19T07:05:12Z","snapshot_observed_at":"2026-08-10T14:05:34.477007Z","submitted_at":"2025-01-26T17:05:16Z","title":"Rethinking External Slow-Thinking: From Snowball Errors to Probability of Correct Reasoning","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T14:15:46.007079Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2501.15602"},"observation_digest":"sha256:2a27b749fb5b8825e9fb5d1fe768a4849a65b683f81f88b239ec1c37deef4447","observation_id":"e221ac50-fc44-411f-b8c5-01529f990319","resolution":{"observed_at":"2026-08-10T14:15:46.007079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-10T14:01:55.493801Z","title":"M., Wen, Y ., Zhang, W., and Wang, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15781","last_updated":"2025-06-03T11:52:35Z","snapshot_observed_at":"2026-08-10T20:56:18.984497Z","submitted_at":"2025-01-27T04:59:29Z","title":"Large Language Models to Diffusion Finetuning","version":2},"reference_index":1969,"source":"pdf_text","source_observed_at":"2026-08-10T14:01:55.493801Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2501.15781"},"observation_digest":"sha256:122a13e18290d74829e91827db051a4c5d0362f5968eb36791e5965a492c822a","observation_id":"18bb0357-4e3d-4883-8230-f7d2ff9d439a","resolution":{"observed_at":"2026-08-10T14:01:55.493801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-09T17:37:40.626962Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01694","last_updated":"2025-03-01T10:27:24Z","snapshot_observed_at":"2026-08-09T20:41:13.212163Z","submitted_at":"2025-02-02T18:19:14Z","title":"Metastable Dynamics of Chain-of-Thought Reasoning: Provable Benefits of Search, RL and Distillation","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T17:37:40.626962Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2502.01694"},"observation_digest":"sha256:bdaeadd5d1e992b5e55b7368ddcec12382831bc4548b4675c07d1dbc91107c9c","observation_id":"469e47ad-84b8-460e-a008-a747f6fe8abb","resolution":{"observed_at":"2026-08-09T17:37:40.626962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-09T11:47:31.242429Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02584","last_updated":"2025-02-04T18:58:31Z","snapshot_observed_at":"2026-08-09T11:38:31.414567Z","submitted_at":"2025-02-04T18:58:31Z","title":"QLASS: Boosting Language Agent Inference via Q-Guided Stepwise Search","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T11:47:31.242429Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2502.02584"},"observation_digest":"sha256:59aed690a2fc0977ea6655ae7d504532700dc106801d3fa9e5a2a6920e9a5133","observation_id":"cfbc782a-e2b0-4875-8f83-4673f0a6e7f6","resolution":{"observed_at":"2026-08-09T11:47:31.242429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-08T14:25:53.332278Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06773","last_updated":"2025-02-10T18:52:04Z","snapshot_observed_at":"2026-08-10T11:31:53.867683Z","submitted_at":"2025-02-10T18:52:04Z","title":"On the Emergence of Thinking in LLMs I: Searching for the Right Intuition","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T14:25:53.332278Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2502.06773"},"observation_digest":"sha256:eccc5df049830169dcd5a479c64f50d2d1834ea33879d220df0795ef97473842","observation_id":"bdd185cc-189c-4585-a351-a8aeff4a8531","resolution":{"observed_at":"2026-08-08T14:25:53.332278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-09T11:20:31.753947Z","title":"M., Wen, Y., Zhang, W., and Wang, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06813","last_updated":"2025-02-04T22:08:20Z","snapshot_observed_at":"2026-08-09T12:19:32.223241Z","submitted_at":"2025-02-04T22:08:20Z","title":"Policy Guided Tree Search for Enhanced LLM Reasoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T11:20:31.753947Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2502.06813"},"observation_digest":"sha256:8c736546397d2bdb33180afac136c7d3a372a83a9d30f18c060c2ce5df48a68b","observation_id":"4ef57d7c-c201-481b-b7ab-80775d952152","resolution":{"observed_at":"2026-08-09T11:20:31.753947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-08T13:35:24.496163Z","title":"M., Wen, Y ., Zhang, W., and Wang, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07191","last_updated":"2025-02-17T03:54:05Z","snapshot_observed_at":"2026-08-10T14:09:50.964658Z","submitted_at":"2025-02-11T02:31:11Z","title":"Bag of Tricks for Inference-time Computation of LLM Reasoning","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T13:35:24.496163Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2502.07191"},"observation_digest":"sha256:6bbc521d30e598b1b9e2d455c3e5d9f851da1489901322bee3f214313f8bcd95","observation_id":"e92021b1-0c6e-4369-8774-ec43f7b0ccf9","resolution":{"observed_at":"2026-08-08T13:35:24.496163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2503.06520","last_updated":"2026-05-31T09:29:40Z","snapshot_observed_at":"2026-08-07T17:19:13.101842Z","submitted_at":"2025-03-09T08:48:51Z","title":"Seg-Zero: Reasoning-Chain Guided Segmentation via Cognitive Reinforcement","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T12:31:43.494099Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2503.06520"},"observation_digest":"sha256:9b7fe247b8168377f3a0c0ab07d99be16e8ef3d7ca75fb95817335931d9ad433","observation_id":"fb68f2ca-0621-4020-bd19-b463ba31ccd1","resolution":{"observed_at":"2026-05-16T12:31:43.547304Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2504.12334","last_updated":"2026-05-10T17:20:39Z","snapshot_observed_at":"2026-07-30T01:17:05.243178Z","submitted_at":"2025-04-13T12:32:25Z","title":"QM-ToT: A Medical Tree of Thoughts Reasoning Framework for Quantized Model","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-22T19:44:16.630377Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2504.12334"},"observation_digest":"sha256:dcd30d611977ca471dd3b95e1a0beb36c6d59de99933d1edd7c1ac58e8cc7d81","observation_id":"fb995c4c-c156-4409-a4c3-748bfb0c287a","resolution":{"observed_at":"2026-05-22T19:45:04.025581Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-07T14:23:07.912353Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.912353Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:3a4e222881fdf1d0c8adaa92e4cfebe5e79d68dc4607f1c8970d182ddf0d4334","observation_id":"beb2dcd8-ce09-4a45-ac89-9df398fc6e18","resolution":{"observed_at":"2026-08-07T14:23:07.912353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-07T13:53:55.952185Z","title":"Alphazero-like tree-search can guide large language model decoding and training.arXiv preprint arXiv:2309.17179,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20643","last_updated":"2025-05-27T02:44:00Z","snapshot_observed_at":"2026-08-07T21:57:04.990865Z","submitted_at":"2025-05-27T02:44:00Z","title":"Can Past Experience Accelerate LLM Reasoning?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:55.952185Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2505.20643"},"observation_digest":"sha256:808b81d931be5b9f337e0e07ba9f877f8b6755c32fe1b4df12694ef6f3600dc2","observation_id":"db427559-1d5c-4206-92ed-026d48eec8af","resolution":{"observed_at":"2026-08-07T13:53:55.952185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-07T12:32:21.438917Z","title":"Alphazero-like tree-search can guide large language model decoding and training, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24273","last_updated":"2026-08-09T16:14:48Z","snapshot_observed_at":"2026-08-11T07:21:35.416606Z","submitted_at":"2025-05-30T06:49:00Z","title":"How Much Backtracking is Enough? Exploring the Interplay of SFT and RL in Enhancing LLM Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:21.438917Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2505.24273"},"observation_digest":"sha256:ac72684859e12220b3142d411deb37be695ad2a997ba6b63a4282ac4fbcdefad","observation_id":"8769437d-e1a6-40e5-a546-f22ebb8d114b","resolution":{"observed_at":"2026-08-07T12:32:21.438917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-07T10:56:23.561140Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03978","last_updated":"2025-06-09T04:15:05Z","snapshot_observed_at":"2026-08-10T21:48:38.882804Z","submitted_at":"2025-06-04T14:08:44Z","title":"Structured Pruning for Diverse Best-of-N Reasoning Optimization","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T10:56:23.561140Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2506.03978"},"observation_digest":"sha256:589637727de17625e8610e1a2e0c6f42731c62b5ebd0d50927510052d8819adf","observation_id":"9ad7cede-ca98-4c61-8f14-ecbbdd2bc5ab","resolution":{"observed_at":"2026-08-07T10:56:23.561140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-07T10:30:34.180416Z","title":"Alphazero-like tree-search can guide large language model decoding and training.arXiv preprint arXiv:2309.17179,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.180416Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:683f87602001b5037a12eee5ad048da6f91f7076e32f9e6448e7ce981f67499a","observation_id":"650cc220-635d-40a7-87eb-790fc13501dd","resolution":{"observed_at":"2026-08-07T10:30:34.180416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-07T05:09:18.616592Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08691","last_updated":"2025-06-10T11:02:36Z","snapshot_observed_at":"2026-08-08T00:05:08.877544Z","submitted_at":"2025-06-10T11:02:36Z","title":"VReST: Enhancing Reasoning in Large Vision-Language Models through Tree Search and Self-Reward Mechanism","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T05:09:18.616592Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2506.08691"},"observation_digest":"sha256:2f1559b321f9fc3cb3e32ab52a41cfa9c62912cd2f225bf13a1f57fab946b6af","observation_id":"4234ff1d-a7b8-47fb-b9ec-4092ced0f56f","resolution":{"observed_at":"2026-08-07T05:09:18.616592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-07T04:38:09.465060Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10446","last_updated":"2025-06-12T07:49:24Z","snapshot_observed_at":"2026-08-09T14:59:18.671126Z","submitted_at":"2025-06-12T07:49:24Z","title":"Fast on the Easy, Deep on the Hard: Efficient Reasoning via Powered Length Penalty","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:38:09.465060Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2506.10446"},"observation_digest":"sha256:7053c42d22ea4339ca5f547d821d8205a88cb1caf297f0e27bab2bcf9f12d432","observation_id":"e67df85b-d344-4f51-8833-ae66fee42643","resolution":{"observed_at":"2026-08-07T04:38:09.465060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-07T01:08:20.750335Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11902","last_updated":"2025-06-13T15:52:37Z","snapshot_observed_at":"2026-08-07T00:58:51.821987Z","submitted_at":"2025-06-13T15:52:37Z","title":"TreeRL: LLM Reinforcement Learning with On-Policy Tree Search","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T01:08:20.750335Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2506.11902"},"observation_digest":"sha256:04af8240db1287d2bf623f6447bd99e94b1066ce6db237afee35de17f9acd320","observation_id":"c54a79fa-7e5e-42a8-85a3-f7797b28d389","resolution":{"observed_at":"2026-08-07T01:08:20.750335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2506.19807","last_updated":"2026-04-16T16:50:02Z","snapshot_observed_at":"2026-07-06T21:47:01.972372Z","submitted_at":"2025-06-24T17:17:17Z","title":"KnowRL: Exploring Knowledgeable Reinforcement Learning for Factuality","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-19T07:33:08.719028Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2506.19807"},"observation_digest":"sha256:07022696b9a607b1b4d01806444757187b89fdded5887f12cb294ffbe8d07676","observation_id":"2c47a8aa-1244-4b5e-bdc4-7b2deac56277","resolution":{"observed_at":"2026-05-19T07:37:08.989689Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-06T22:30:14.714930Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21497","last_updated":"2025-06-26T17:26:17Z","snapshot_observed_at":"2026-08-11T07:09:44.547805Z","submitted_at":"2025-06-26T17:26:17Z","title":"Enhancing User Engagement in Socially-Driven Dialogue through Interactive LLM Alignments","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T22:30:14.714930Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2506.21497"},"observation_digest":"sha256:67f09389bb12c9defbff8bb3fc9a80f4da84cbc264cdb6eabb38e7ed269953a5","observation_id":"6b7d3b68-72f8-48e2-94ec-d7f9494fb526","resolution":{"observed_at":"2026-08-06T22:30:14.714930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-06T22:16:18.579086Z","title":"arXiv preprint arXiv:2309.17179 (2023) 33","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22075","last_updated":"2026-06-30T08:35:07Z","snapshot_observed_at":"2026-08-07T02:36:35.155158Z","submitted_at":"2025-06-27T10:03:05Z","title":"Reasoning in machine vision by learning fast and slow thinking","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:16:18.579086Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2506.22075"},"observation_digest":"sha256:87b2b325b54e7f5ffa14f7803ca3f2d0970be4117534e520eb1957e393d88012","observation_id":"5eeb45b6-3c6d-4900-93a7-03e4147598f1","resolution":{"observed_at":"2026-08-06T22:16:18.579086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-06T20:43:26.040552Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02173","last_updated":"2025-07-02T22:12:03Z","snapshot_observed_at":"2026-08-07T13:56:29.658636Z","submitted_at":"2025-07-02T22:12:03Z","title":"Data Diversification Methods In Alignment Enhance Math Performance In LLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T20:43:26.040552Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2507.02173"},"observation_digest":"sha256:96781870d06682b4cb9228313acea1b242e318c5d20399ebb6dafd83998287c5","observation_id":"2a1f5f4c-bd4b-4007-af55-873c9248df71","resolution":{"observed_at":"2026-08-06T20:43:26.040552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-06T19:28:12.161024Z","title":"arXiv preprint arXiv:2309.17179","venue":null,"work_id":null,"year":1985},"citing_paper":{"arxiv_id":"2507.05557","last_updated":"2025-07-08T00:41:12Z","snapshot_observed_at":"2026-08-06T19:21:14.781528Z","submitted_at":"2025-07-08T00:41:12Z","title":"Enhancing Test-Time Scaling of Large Language Models with Hierarchical Retrieval-Augmented MCTS","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T19:28:12.161024Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2507.05557"},"observation_digest":"sha256:196c9515f03b2478f2329bd7c9bc1557c0b4ee7609e28377e5e0c2a46d2e5aa3","observation_id":"e1d90dd1-c705-42d0-baef-f00aca515744","resolution":{"observed_at":"2026-08-06T19:28:12.161024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-06T17:47:40.209380Z","title":"Alphazero-like tree-search can guide large language model decoding and training,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09955","last_updated":"2025-07-14T06:10:30Z","snapshot_observed_at":"2026-08-07T11:12:53.489576Z","submitted_at":"2025-07-14T06:10:30Z","title":"DeepSeek: Paradigm Shifts and Technical Evolution in Large AI Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T17:47:40.209380Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2507.09955"},"observation_digest":"sha256:1ed203d35fb962721a2bcec0fb04ac218eb9f2904e3fca395d4a5e52c5f684a5","observation_id":"60d6e2b2-8357-4380-9b77-2c4b9d9fc6b8","resolution":{"observed_at":"2026-08-06T17:47:40.209380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-06T16:09:04.281051Z","title":"Kanishk Gandhi, Denise Lee, Gabriel Grand, Muxin Liu, Winson Cheng, Archit Sharma, and Noah D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-10T09:38:06.291838Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:04.281051Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:8f4dc8f442458a706746143b806372a279e7c5bcc6a7607e186d5ba4d71cf9b6","observation_id":"2a39a040-6db1-4621-9b31-ed1e1b145f3a","resolution":{"observed_at":"2026-08-06T16:09:04.281051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-06T15:28:42.237425Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15815","last_updated":"2025-07-21T17:21:14Z","snapshot_observed_at":"2026-08-07T09:07:30.265550Z","submitted_at":"2025-07-21T17:21:14Z","title":"LLM Economist: Large Population Models and Mechanism Design in Multi-Agent Generative Simulacra","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:28:42.237425Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2507.15815"},"observation_digest":"sha256:414a6ddd26664fca968dc6dd35e86d6196a65d7769d40acfbc06ae234953675f","observation_id":"6bacaa48-b2da-445a-9bf2-4aa70ba0a491","resolution":{"observed_at":"2026-08-06T15:28:42.237425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T22:09:46.343818Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07434","last_updated":"2025-08-10T17:11:56Z","snapshot_observed_at":"2026-08-07T02:35:17.826871Z","submitted_at":"2025-08-10T17:11:56Z","title":"Let's Revise Step-by-Step: A Unified Local Search Framework for Code Generation with LLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T22:09:46.343818Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2508.07434"},"observation_digest":"sha256:d86818005595abbcad90dc030aac082c3a613622244e08ae43b40e5833430cea","observation_id":"84845823-462d-4b71-adb7-056d11f47575","resolution":{"observed_at":"2026-08-05T22:09:46.343818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T11:57:16.716582Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-10T13:43:39.475451Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:16.716582Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:0a53ed7c94832044c10abc0c693309002d5b300dabfc062e1079a2071b984893","observation_id":"14285457-87e1-4d05-a671-243df4b6e228","resolution":{"observed_at":"2026-08-05T11:57:16.716582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-04T18:53:02.654971Z","title":"Alphazero-like tree-search can guide large language model decoding and training.arXiv preprint arXiv:2309.17179,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09675","last_updated":"2025-09-11T17:59:17Z","snapshot_observed_at":"2026-08-07T12:25:43.109797Z","submitted_at":"2025-09-11T17:59:17Z","title":"CDE: Curiosity-Driven Exploration for Efficient Reinforcement Learning in Large Language Models","version":1},"reference_index":1997,"source":"pdf_text","source_observed_at":"2026-08-04T18:53:02.654971Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2509.09675"},"observation_digest":"sha256:6e6477dc3438896c0bf0fe63be9b56f1535746750fd98bc0431fafa5f695ecee","observation_id":"398b7170-af66-43e5-b8c6-f39c12d228aa","resolution":{"observed_at":"2026-08-04T18:53:02.654971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-04T12:52:26.719841Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.01833","last_updated":"2026-05-25T18:23:42Z","snapshot_observed_at":"2026-08-04T12:52:24.589866Z","submitted_at":"2025-10-02T09:28:13Z","title":"Plan Then Action:High-Level Planning Guidance Reinforcement Learning for LLM Reasoning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T12:52:26.719841Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2510.01833"},"observation_digest":"sha256:81e7eb8a6f7dc5c88cb836b962af309f7cb023311b93e9e2ea583f16b79cd20e","observation_id":"3f246477-bd08-4ba3-8922-04f6a7bc2519","resolution":{"observed_at":"2026-08-04T12:52:26.719841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2601.03559","last_updated":"2026-04-19T03:10:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-07T03:58:42Z","title":"DiffCoT: Diffusion-styled Chain-of-Thought Reasoning in LLMs","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T17:19:58.334098Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2601.03559"},"observation_digest":"sha256:e041bfdece1b5443ef89f599a8ae6b3cc160a2a8431033bacbe2d5fdef6eecc0","observation_id":"028a9c3e-e00f-4664-bf40-d95bf6581261","resolution":{"observed_at":"2026-05-16T17:21:07.901256Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2601.11340","last_updated":"2026-04-15T07:21:40Z","snapshot_observed_at":"2026-08-02T05:43:35.759183Z","submitted_at":"2026-01-16T14:38:18Z","title":"Neural Chain-of-Thought Search: Searching the Optimal Reasoning Path to Enhance Large Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T13:21:36.606855Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2601.11340"},"observation_digest":"sha256:aea6c7913463fbfacfae1a6b87238279d9344bbbd165e33066dc56bfd0a94ea9","observation_id":"788d1018-d4fc-4a17-8e50-9b4dfe58040a","resolution":{"observed_at":"2026-05-16T13:22:55.276086Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2601.12538","last_updated":"2026-01-18T18:58:23Z","snapshot_observed_at":"2026-08-04T22:42:23.171653Z","submitted_at":"2026-01-18T18:58:23Z","title":"Agentic Reasoning for Large Language Models","version":1},"reference_index":120,"source":"pdf_text","source_observed_at":"2026-05-17T15:14:25.558878Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2601.12538"},"observation_digest":"sha256:ddb410c1689b43263f2b0b7eca74315d72a6e9cbb3dbf4dc0aa8322e946160a6","observation_id":"0754fcb6-bf24-483b-9a0b-0deb0bafddd8","resolution":{"observed_at":"2026-05-17T15:14:26.052180Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-03T03:04:43.542090Z","title":"Alphazero-like tree-search can guide large language model decoding and training.arXiv preprint arXiv:2309.17179,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.09305","last_updated":"2026-06-28T18:13:37Z","snapshot_observed_at":"2026-08-08T13:06:41.126177Z","submitted_at":"2026-02-10T00:45:24Z","title":"Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T03:04:43.542090Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2602.09305"},"observation_digest":"sha256:72191e651860a29ceab159f2be89beb4290b53c9789a05d6dd6cf4d79c42e1d8","observation_id":"a5728366-d70a-4ffb-9660-d96556437e88","resolution":{"observed_at":"2026-08-03T03:04:43.542090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2604.04379","last_updated":"2026-04-06T03:01:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-06T03:01:52Z","title":"Reinforce to Learn, Elect to Reason: A Dual Paradigm for Video Reasoning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T19:40:41.642852Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2604.04379"},"observation_digest":"sha256:7a4bd65ab2e1f92d725ecd759513734b749e1fc5ccd73027761eb1aeb2bb8816","observation_id":"2a2df38d-1ab1-4573-b6f5-5d192859296b","resolution":{"observed_at":"2026-05-10T22:35:52.722018Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2604.05868","last_updated":"2026-04-07T13:28:09Z","snapshot_observed_at":"2026-08-11T06:44:12.828877Z","submitted_at":"2026-04-07T13:28:09Z","title":"Understanding Performance Gap Between Parallel and Sequential Sampling in Large Reasoning Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T18:36:01.200412Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2604.05868"},"observation_digest":"sha256:ec197655beecf60b3c88a7a838e127f0d4f07e051ef2af58633da7c3c5ad538b","observation_id":"761dd4d6-29a3-4eb1-8972-b07c89f37a19","resolution":{"observed_at":"2026-05-11T00:20:52.418936Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:66c63bf505c0b58174bc10ed9a61be89c3bdd3e881280951050a30500b67faea","observation_id":"66be9b4c-024e-473f-ae01-4a23529ff515","resolution":{"observed_at":"2026-05-11T12:26:05.589442Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2605.02290","last_updated":"2026-05-04T07:26:41Z","snapshot_observed_at":"2026-08-10T20:20:22.759976Z","submitted_at":"2026-05-04T07:26:41Z","title":"Distilling Long-CoT Reasoning through Collaborative Step-wise Multi-Teacher Decoding","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-09T16:29:05.186607Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2605.02290"},"observation_digest":"sha256:9e80386ac80fdbae47bcdca88ef40fb220c34bf30819b1b131fb4c2ae7b75b6f","observation_id":"93f3611e-068a-4ac9-b5a0-fb844a575fd3","resolution":{"observed_at":"2026-05-11T16:31:08.919771Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2605.05216","last_updated":"2026-04-17T01:45:30Z","snapshot_observed_at":"2026-07-06T23:17:52.987860Z","submitted_at":"2026-04-17T01:45:30Z","title":"SAT: Sequential Agent Tuning for Coordinator Free Plug and Play Multi-LLM Training with Monotonic Improvement Guarantees","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T09:34:33.271537Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2605.05216"},"observation_digest":"sha256:a08ae76a5f2b8d421c072dc8b78394736e31e2397db35d465cb848f6c3ec853e","observation_id":"64f389a3-ece9-4f54-8a47-654524236766","resolution":{"observed_at":"2026-05-10T09:38:42.293790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2605.05262","last_updated":"2026-05-06T06:17:48Z","snapshot_observed_at":"2026-08-10T21:00:34.695006Z","submitted_at":"2026-05-06T06:17:48Z","title":"Maximizing Rollout Informativeness under a Fixed Budget: A Submodular View of Tree Search for Tool-Use Agentic Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T17:16:00.499779Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2605.05262"},"observation_digest":"sha256:4c74fc902da780240388e10828ed6a59392363c71ffa71af6e492034a6248d66","observation_id":"5210ee3d-d234-4f0a-a335-3a0f50e898ff","resolution":{"observed_at":"2026-05-11T17:46:06.956367Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2605.08057","last_updated":"2026-05-08T17:44:15Z","snapshot_observed_at":"2026-08-11T07:32:29.834666Z","submitted_at":"2026-05-08T17:44:15Z","title":"CA-SQL: Complexity-Aware Inference Time Reasoning for Text-to-SQL via Exploration and Compute Budget Allocation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-11T02:28:20.366674Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2605.08057"},"observation_digest":"sha256:c5d5c08656178378fd762c96cdb50b0a6dbbbef9ad8ab3d3277f1dd0f8808916","observation_id":"ff54ab4a-a1f1-47c5-8e7f-8ebbb47b3abf","resolution":{"observed_at":"2026-05-11T03:25:58.264821Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2605.10172","last_updated":"2026-05-11T08:21:52Z","snapshot_observed_at":"2026-08-11T02:47:42.778982Z","submitted_at":"2026-05-11T08:21:52Z","title":"V-ABS: Action-Observer Driven Beam Search for Dynamic Visual Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T04:03:01.612516Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2605.10172"},"observation_digest":"sha256:18f000e28d1bc117af5671fed62b2a5218d498585e26a00b9bf39371b0f716b6","observation_id":"ada3a1b9-1026-41b1-9cad-17bf54fbcee6","resolution":{"observed_at":"2026-05-12T06:41:42.171923Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2605.10195","last_updated":"2026-05-14T07:42:56Z","snapshot_observed_at":"2026-08-03T09:42:12.047946Z","submitted_at":"2026-05-11T08:45:17Z","title":"Breaking the Reward Barrier: Accelerating Tree-of-Thought Reasoning via Speculative Exploration","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T03:51:52.375703Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2605.10195"},"observation_digest":"sha256:dd7fe02d375124b3a1d04f024d4cd8528547ad6f22fca5ccde123d05fcf4e0c8","observation_id":"cb9cf998-12a0-426d-826e-0ab8d015ecb7","resolution":{"observed_at":"2026-05-12T06:51:30.023684Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2605.10195","last_updated":"2026-05-14T07:42:56Z","snapshot_observed_at":"2026-08-03T09:42:12.047946Z","submitted_at":"2026-05-11T08:45:17Z","title":"Breaking the Reward Barrier: Accelerating Tree-of-Thought Reasoning via Speculative Exploration","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T05:11:32.053440Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2605.10195"},"observation_digest":"sha256:2d44393cb2d8fdd0717656489bbea9ce627218696d1940af56777c698104afb0","observation_id":"4f34326e-528b-4d96-9ad3-1fc96a76fa5d","resolution":{"observed_at":"2026-05-15T05:15:03.262296Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2606.03102","last_updated":"2026-06-02T03:42:04Z","snapshot_observed_at":"2026-08-03T04:21:57.609394Z","submitted_at":"2026-06-02T03:42:04Z","title":"Small RL Controller, Large Language Model: RL-Guided Adaptive Sampling for Test-Time Scaling","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-28T10:25:10.559953Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2606.03102"},"observation_digest":"sha256:67b90da60251a1549b921e6ce5a0d919fc21265768f1263cc12881b00cd6484b","observation_id":"4077066b-ce29-43c3-ad50-fc741a014a0d","resolution":{"observed_at":"2026-07-02T02:56:30.042468Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2606.05464","last_updated":"2026-06-03T21:43:38Z","snapshot_observed_at":"2026-08-03T10:19:08.677126Z","submitted_at":"2026-06-03T21:43:38Z","title":"Step-by-Step Optimization-like Reasoning in LLMs over Expanding Search Spaces","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T05:46:26.938277Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2606.05464"},"observation_digest":"sha256:2896dc09e20b827fb349a4580c5bc3ac535ced14ba6e2e7b84de591cf7d2239e","observation_id":"9c889228-de92-44ce-852a-8375a79b6547","resolution":{"observed_at":"2026-07-02T08:46:48.956800Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2606.08068","last_updated":"2026-07-08T15:21:39Z","snapshot_observed_at":"2026-07-12T14:47:31.355938Z","submitted_at":"2026-06-06T09:33:32Z","title":"DICE: Entropy-Regularized Equilibrium Selection for Stable Multi-Agent LLM Coordination","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-27T19:58:32.016341Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2606.08068"},"observation_digest":"sha256:2c778a20161d335ccb3d50d9a3ce81693a354946ad7f2d180f340b5d50901b3e","observation_id":"1cc95fe5-48ec-40d7-879e-988120a46c37","resolution":{"observed_at":"2026-07-02T20:57:23.900391Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2606.11119","last_updated":"2026-06-09T17:16:03Z","snapshot_observed_at":"2026-07-31T16:22:30.560541Z","submitted_at":"2026-06-09T17:16:03Z","title":"TRACE: A Unified Rollout Budget Allocation Framework for Efficient Agentic Reinforcement Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-06-27T13:55:35.363377Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2606.11119"},"observation_digest":"sha256:bc0d51654bb8ad3ba23842406c0aa348e9351cb76402906964a0eb02f2f0e5cf","observation_id":"3c60c9d5-bffe-4fc4-937f-e71ab1969215","resolution":{"observed_at":"2026-07-03T04:27:36.750084Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2606.12384","last_updated":"2026-07-31T08:54:09Z","snapshot_observed_at":"2026-08-05T23:10:46.327902Z","submitted_at":"2026-06-10T17:47:07Z","title":"APPO: Agentic Procedural Policy Optimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T10:21:55.485624Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2606.12384"},"observation_digest":"sha256:1ee727c78cec2adab130b3f091891a11b26ff09627513fdf36fc890adb792016","observation_id":"e84f6b6a-14d9-492c-acf4-7991eabb59ea","resolution":{"observed_at":"2026-07-03T09:37:49.320578Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-03T02:12:26.571855Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.12384","last_updated":"2026-07-31T08:54:09Z","snapshot_observed_at":"2026-08-05T23:10:46.327902Z","submitted_at":"2026-06-10T17:47:07Z","title":"APPO: Agentic Procedural Policy Optimization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T02:12:26.571855Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2606.12384"},"observation_digest":"sha256:325a5744f445e6c49eafb560ac5e6e4d89adc229a244250d75bd6544aedb081d","observation_id":"956695dc-6775-41b4-930a-08ea6cbae14b","resolution":{"observed_at":"2026-08-03T02:12:26.571855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2606.20599","last_updated":"2026-05-19T09:13:21Z","snapshot_observed_at":"2026-08-02T11:31:41.725373Z","submitted_at":"2026-05-19T09:13:21Z","title":"Beyond Fixed Budgets: Characterizing the Inelasticity and Limitations of Tree-of-Thought Reasoning Strategies","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T18:38:48.512777Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2606.20599"},"observation_digest":"sha256:0880fd8684aee488c48cec5fc4e825f17a3506698fcf4ce1ab92804abfde2bb3","observation_id":"26e4a92d-54d2-45ef-982a-7632f69be8e3","resolution":{"observed_at":"2026-06-30T18:44:59.784865Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":"2309.17179","doi":"10.48550/arxiv.2309.17179","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":"arXiv (Cornell University)","work_id":"23ee3c7d-8b2b-419e-bc0b-2ca969d47457","year":2024},"citing_paper":{"arxiv_id":"2607.02390","last_updated":"2026-07-02T16:25:10Z","snapshot_observed_at":"2026-08-03T00:49:51.748486Z","submitted_at":"2026-07-02T16:25:10Z","title":"DecompRL: Solving Harder Problems by Learning Modular Code Generation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-03T16:30:34.793328Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2607.02390"},"observation_digest":"sha256:ba7f1129fe5bcb0ee70923d33c51bc967cbc0c8c4cb0b261e2dc819f56458ad3","observation_id":"c83a8d58-2ff5-4cae-ac64-129a2da31a2c","resolution":{"observed_at":"2026-07-03T16:38:39.805075Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2309.17179/citation-record","integrity":"/paper/2309.17179/integrity","json":"/paper/2309.17179/citation-record.json","paper":"/paper/2309.17179"},"outbound":[],"paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-11T02:32:39.494378Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 56 inbound Pith citation observations for arXiv:2309.17179."}