{"as_of":"2026-08-09T20:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:837ac1c459303690808a491b177347e1c824bdcb2d16a3ed332e4185f2cd154c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":24,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T13:33:57.666272Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":9,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-09T13:33:57.666272Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02061","last_updated":"2026-07-28T04:34:05Z","snapshot_observed_at":"2026-08-09T13:27:02.735069Z","submitted_at":"2025-02-04T07:17:54Z","title":"Reason4Rec: Deliberative User Preference Alignment of Large Language Models for Recommendation","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T13:33:57.666272Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2502.02061"},"observation_digest":"sha256:26fc84453a66d9e5817d5a9f5aeec216b0eba76ed615df016a081a41e8dac533","observation_id":"12bd5ae0-7fdf-458a-91cb-088bb32bb134","resolution":{"observed_at":"2026-08-09T13:33:57.666272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-09T11:47:31.339452Z","title":"Q*: Improving multi-step reasoning for llms with deliberative planning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02584","last_updated":"2025-02-04T18:58:31Z","snapshot_observed_at":"2026-08-09T11:38:31.414567Z","submitted_at":"2025-02-04T18:58:31Z","title":"QLASS: Boosting Language Agent Inference via Q-Guided Stepwise Search","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T11:47:31.339452Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2502.02584"},"observation_digest":"sha256:8c69d1063704d3b8cc6b53ecd6cdfa98a5627aad47ef376ab3b28732cc7bb5a1","observation_id":"18124b8a-0cbb-413f-b156-cce6ef0cd6a1","resolution":{"observed_at":"2026-08-09T11:47:31.339452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-08T21:40:26.935996Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04751","last_updated":"2025-02-07T08:36:39Z","snapshot_observed_at":"2026-08-09T03:57:00.818497Z","submitted_at":"2025-02-07T08:36:39Z","title":"Holistically Guided Monte Carlo Tree Search for Intricate Information Seeking","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T21:40:26.935996Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2502.04751"},"observation_digest":"sha256:dd6ce648d17d6b934c5740aa56e15c2da734ccbd50bf39a6539f5021eae6bb67","observation_id":"cca85fd6-0516-4ebf-bfc5-840f237f4d72","resolution":{"observed_at":"2026-08-08T21:40:26.935996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-08T21:40:26.940923Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04751","last_updated":"2025-02-07T08:36:39Z","snapshot_observed_at":"2026-08-09T03:57:00.818497Z","submitted_at":"2025-02-07T08:36:39Z","title":"Holistically Guided Monte Carlo Tree Search for Intricate Information Seeking","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T21:40:26.940923Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2502.04751"},"observation_digest":"sha256:90342d01c60683811090a067a225c954f8131c8f2adfff1ed5cce9f18db12ed5","observation_id":"d3394951-336a-43db-a1bc-90b509e2403a","resolution":{"observed_at":"2026-08-08T21:40:26.940923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-08T14:25:53.567513Z","title":"Q*: Improving multi-step reasoning for llms with deliberative planning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06773","last_updated":"2025-02-10T18:52:04Z","snapshot_observed_at":"2026-08-08T22:57:17.515334Z","submitted_at":"2025-02-10T18:52:04Z","title":"On the Emergence of Thinking in LLMs I: Searching for the Right Intuition","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-08T14:25:53.567513Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2502.06773"},"observation_digest":"sha256:2260d7691578f7759c651220a2ad4015bbd2dd55007a887d07bbb0163c362dbe","observation_id":"02e6b3c6-4fce-4229-bd2a-91e10e91dc0b","resolution":{"observed_at":"2026-08-08T14:25:53.567513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-09T11:20:31.898539Z","title":"Q*: Improving multi-step reasoning for llms with deliberative planning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06813","last_updated":"2025-02-04T22:08:20Z","snapshot_observed_at":"2026-08-09T12:19:32.223241Z","submitted_at":"2025-02-04T22:08:20Z","title":"Policy Guided Tree Search for Enhanced LLM Reasoning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-09T11:20:31.898539Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2502.06813"},"observation_digest":"sha256:b5253e012f3b456bbc485bc4eede376bf818e507f072f517ba3c8e94fc016780","observation_id":"76cd48da-cc93-4392-b2b0-fee689104cab","resolution":{"observed_at":"2026-08-09T11:20:31.898539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-08T13:35:24.562156Z","title":"Q*: Improving multi-step reasoning for llms with deliberative planning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07191","last_updated":"2025-02-17T03:54:05Z","snapshot_observed_at":"2026-08-09T05:18:33.083500Z","submitted_at":"2025-02-11T02:31:11Z","title":"Bag of Tricks for Inference-time Computation of LLM Reasoning","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T13:35:24.562156Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2502.07191"},"observation_digest":"sha256:c13096298ebf955fd28868091b5041ba9998df171f6092c17acf3c78125594eb","observation_id":"ee4d89ca-474f-448c-b6c4-f9fc2a16800b","resolution":{"observed_at":"2026-08-08T13:35:24.562156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":"2406.14283","doi":"10.48550/arxiv.2406.14283","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Q*: Improving multi-step reasoning for llms with deliberative planning","venue":"arXiv (Cornell University)","work_id":"ae61abbd-38eb-47ce-aac7-4886bf80c5d0","year":2024},"citing_paper":{"arxiv_id":"2505.17016","last_updated":"2025-05-22T17:59:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-22T17:59:45Z","title":"Interactive Post-Training for Vision-Language-Action Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-21T14:25:47.178714Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2505.17016"},"observation_digest":"sha256:8c35d814b1abf85596f8b018e07349206d2b5f85104c7d39421ddb9f2a75f892","observation_id":"c8c40f3d-f2c3-4a9d-b0fd-941c90ec8c8b","resolution":{"observed_at":"2026-05-21T14:25:47.236938Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-07T14:23:47.820977Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19112","last_updated":"2025-05-25T12:10:24Z","snapshot_observed_at":"2026-08-09T15:46:33.033320Z","submitted_at":"2025-05-25T12:10:24Z","title":"Self-Critique Guided Iterative Reasoning for Multi-hop Question Answering","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:47.820977Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2505.19112"},"observation_digest":"sha256:af76642ebefde325e40c987668e9db40e519111701590db57df0c57767b93568","observation_id":"51023dc1-8e3c-4885-ac74-d59dbc822151","resolution":{"observed_at":"2026-08-07T14:23:47.820977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-07T14:12:07.611284Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19683","last_updated":"2025-05-26T08:44:53Z","snapshot_observed_at":"2026-08-08T09:25:43.689145Z","submitted_at":"2025-05-26T08:44:53Z","title":"Large Language Models for Planning: A Comprehensive and Systematic Survey","version":1},"reference_index":252,"source":"pdf_text","source_observed_at":"2026-08-07T14:12:07.611284Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2505.19683"},"observation_digest":"sha256:b3601c2608b9a07799340485c8ae78e5123b94bcb1d80f761e1852275aff3ba7","observation_id":"9fed6fb4-c5ca-4ca0-b9e2-a3c83dae54bb","resolution":{"observed_at":"2026-08-07T14:12:07.611284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-07T14:01:13.678294Z","title":"Q*: Improving multi-step reasoning for llms with deliberative planning.arXiv preprint arXiv:2406.14283, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20296","last_updated":"2025-05-26T17:59:53Z","snapshot_observed_at":"2026-08-09T09:53:26.313801Z","submitted_at":"2025-05-26T17:59:53Z","title":"Reasoning LLMs are Wandering Solution Explorers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:13.678294Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2505.20296"},"observation_digest":"sha256:c75ed1ab08d02f33e6d3263177afdc68bc65870007a3429b1402a3534b852b5d","observation_id":"dbbb6368-36b0-4206-be47-b8f5c9665306","resolution":{"observed_at":"2026-08-07T14:01:13.678294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-07T11:30:40.339030Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02338","last_updated":"2025-06-03T00:29:15Z","snapshot_observed_at":"2026-08-08T15:09:47.963101Z","submitted_at":"2025-06-03T00:29:15Z","title":"One Missing Piece for Open-Source Reasoning Models: A Dataset to Mitigate Cold-Starting Short CoT LLMs in RL","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:40.339030Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2506.02338"},"observation_digest":"sha256:8050898472b17de81802c9f1d6fd9f4dfdebc0e856a6cad162dca3dcca701f32","observation_id":"37be43d1-c47d-4fa3-bea9-6bf92ae3e265","resolution":{"observed_at":"2026-08-07T11:30:40.339030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-07T11:06:42.008548Z","title":"Q*: Improving multi-step reasoning for llms with deliberative planning.arXiv preprint arXiv:2406.14283, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03570","last_updated":"2025-06-04T04:33:53Z","snapshot_observed_at":"2026-08-09T05:18:46.785523Z","submitted_at":"2025-06-04T04:33:53Z","title":"FreePRM: Training Process Reward Models Without Ground Truth Process Labels","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:06:42.008548Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2506.03570"},"observation_digest":"sha256:e73b9df7e51375e1ded46eb9218d2d07e13e29303f10a2fb4b9412ca663adc36","observation_id":"e88e6dc7-a111-4a8e-8439-e4c2192d5cd3","resolution":{"observed_at":"2026-08-07T11:06:42.008548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-05T22:09:46.348559Z","title":"Q*: I mproving multi-step reasoning for LLM s with deliberative planning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07434","last_updated":"2025-08-10T17:11:56Z","snapshot_observed_at":"2026-08-07T02:35:17.826871Z","submitted_at":"2025-08-10T17:11:56Z","title":"Let's Revise Step-by-Step: A Unified Local Search Framework for Code Generation with LLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T22:09:46.348559Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2508.07434"},"observation_digest":"sha256:ef4d0e259abcee74f97d5a45516c84f6f3e19ab695258692b518c4ec9440b36f","observation_id":"22076380-86b1-435c-9ce2-0aebe7c31ed4","resolution":{"observed_at":"2026-08-05T22:09:46.348559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":"2406.14283","doi":"10.48550/arxiv.2406.14283","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Q*: Improving multi-step reasoning for llms with deliberative planning","venue":"arXiv (Cornell University)","work_id":"ae61abbd-38eb-47ce-aac7-4886bf80c5d0","year":2024},"citing_paper":{"arxiv_id":"2509.26238","last_updated":"2026-04-21T11:04:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-30T13:32:59Z","title":"Beyond Linear Probes: Dynamic Safety Monitoring for Language Models","version":4},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-18T12:41:48.620040Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2509.26238"},"observation_digest":"sha256:2cc0a12d5f74b249e4beaa051979e8d254f81407ad8b886a090a3739873a30bc","observation_id":"a504796f-b7c5-4b82-8f82-e852a7351783","resolution":{"observed_at":"2026-05-18T12:42:36.865021Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":"2406.14283","doi":"10.48550/arxiv.2406.14283","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Q*: Improving multi-step reasoning for llms with deliberative planning","venue":"arXiv (Cornell University)","work_id":"ae61abbd-38eb-47ce-aac7-4886bf80c5d0","year":2024},"citing_paper":{"arxiv_id":"2601.12538","last_updated":"2026-01-18T18:58:23Z","snapshot_observed_at":"2026-08-04T22:42:23.171653Z","submitted_at":"2026-01-18T18:58:23Z","title":"Agentic Reasoning for Large Language Models","version":1},"reference_index":109,"source":"pdf_text","source_observed_at":"2026-05-17T15:14:25.558878Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2601.12538"},"observation_digest":"sha256:76f472bf37895d76db7682d361b520e064017674aea8a067184e8a09126c9300","observation_id":"329921e6-7667-47c8-bc7b-37c87a97f4d5","resolution":{"observed_at":"2026-05-17T15:14:26.008209Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-02T19:46:43.187057Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.01152","last_updated":"2026-06-20T09:26:23Z","snapshot_observed_at":"2026-08-08T15:14:07.565399Z","submitted_at":"2026-03-01T15:36:10Z","title":"DeepResearch-9K: A Challenging Benchmark Dataset of Deep-Research Agent","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-02T19:46:43.187057Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2603.01152"},"observation_digest":"sha256:317e842d9043c04517613bd3b481ed5336098473d0b4525890814238c8a8a59b","observation_id":"ec8c5023-e6f9-4d50-ba88-74a9af2fd8d5","resolution":{"observed_at":"2026-08-02T19:46:43.187057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":"2406.14283","doi":"10.48550/arxiv.2406.14283","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Q*: Improving multi-step reasoning for llms with deliberative planning","venue":"arXiv (Cornell University)","work_id":"ae61abbd-38eb-47ce-aac7-4886bf80c5d0","year":2024},"citing_paper":{"arxiv_id":"2603.29908","last_updated":"2026-03-31T15:53:29Z","snapshot_observed_at":"2026-08-06T01:33:29.158513Z","submitted_at":"2026-03-31T15:53:29Z","title":"C-TRAIL: A Commonsense World Framework for Trajectory Planning in Autonomous Driving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T23:27:31.054348Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2603.29908"},"observation_digest":"sha256:cc3a766b0a22717e277c177acbd8a77e84c2da92c44a5f51e7fc88aa3daa1881","observation_id":"235fde31-3dba-4229-9f32-8fd0c75b7696","resolution":{"observed_at":"2026-05-13T23:28:26.090582Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":"2406.14283","doi":"10.48550/arxiv.2406.14283","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Q*: Improving multi-step reasoning for llms with deliberative planning","venue":"arXiv (Cornell University)","work_id":"ae61abbd-38eb-47ce-aac7-4886bf80c5d0","year":2024},"citing_paper":{"arxiv_id":"2604.21027","last_updated":"2026-08-02T16:15:42Z","snapshot_observed_at":"2026-08-06T23:24:26.820832Z","submitted_at":"2026-04-22T19:18:36Z","title":"HypEHR: Hyperbolic Modeling of Electronic Health Records for Efficient Question Answering","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-09T23:51:47.724033Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2604.21027"},"observation_digest":"sha256:a156da3e73dda21b348d14efeaf3d391a1f56c2132656a1ff2466c1c216f5107","observation_id":"5cf1ca7e-1e7a-4e6b-98ef-9c377b8cba9f","resolution":{"observed_at":"2026-05-09T23:54:45.454674Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":"2406.14283","doi":"10.48550/arxiv.2406.14283","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Q*: Improving multi-step reasoning for llms with deliberative planning","venue":"arXiv (Cornell University)","work_id":"ae61abbd-38eb-47ce-aac7-4886bf80c5d0","year":2024},"citing_paper":{"arxiv_id":"2605.10195","last_updated":"2026-05-14T07:42:56Z","snapshot_observed_at":"2026-08-03T09:42:12.047946Z","submitted_at":"2026-05-11T08:45:17Z","title":"Breaking the Reward Barrier: Accelerating Tree-of-Thought Reasoning via Speculative Exploration","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-12T03:51:52.375703Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2605.10195"},"observation_digest":"sha256:85cf498b65ae54be737fc889c77f51e6adbe6bb91b6c24ed46bc9ed9f81089ee","observation_id":"cac4d1a0-e808-47e4-bbdd-f5a01cffc835","resolution":{"observed_at":"2026-05-12T06:51:30.224331Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":"2406.14283","doi":"10.48550/arxiv.2406.14283","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Q*: Improving multi-step reasoning for llms with deliberative planning","venue":"arXiv (Cornell University)","work_id":"ae61abbd-38eb-47ce-aac7-4886bf80c5d0","year":2024},"citing_paper":{"arxiv_id":"2605.10195","last_updated":"2026-05-14T07:42:56Z","snapshot_observed_at":"2026-08-03T09:42:12.047946Z","submitted_at":"2026-05-11T08:45:17Z","title":"Breaking the Reward Barrier: Accelerating Tree-of-Thought Reasoning via Speculative Exploration","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-15T05:11:32.053440Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2605.10195"},"observation_digest":"sha256:7766fe8271f8457f123e880a74b1e846d42408c97e080238fa101a5ed8791ce2","observation_id":"6c00c4ca-adc2-43c3-96fe-516764254e4b","resolution":{"observed_at":"2026-05-15T05:15:03.212080Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":"2406.14283","doi":"10.48550/arxiv.2406.14283","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Q*: Improving multi-step reasoning for llms with deliberative planning","venue":"arXiv (Cornell University)","work_id":"ae61abbd-38eb-47ce-aac7-4886bf80c5d0","year":2024},"citing_paper":{"arxiv_id":"2606.21740","last_updated":"2026-06-19T20:53:10Z","snapshot_observed_at":"2026-08-01T23:24:43.869329Z","submitted_at":"2026-06-19T20:53:10Z","title":"Training the Orchestrator: A Supervised Approach to End-to-End PDDL Planning with LLM Agents","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-26T13:56:51.914966Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2606.21740"},"observation_digest":"sha256:f080d6c5fa4dcee4125c937578a365d73a339f5c7700cb51000cf1cfc41d5b19","observation_id":"0e2bdf8b-6f9c-4412-baff-d254f61d7b41","resolution":{"observed_at":"2026-07-04T06:59:38.134654Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":"2406.14283","doi":"10.48550/arxiv.2406.14283","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Q*: Improving multi-step reasoning for llms with deliberative planning","venue":"arXiv (Cornell University)","work_id":"ae61abbd-38eb-47ce-aac7-4886bf80c5d0","year":2024},"citing_paper":{"arxiv_id":"2606.30339","last_updated":"2026-06-29T14:17:53Z","snapshot_observed_at":"2026-08-06T09:00:57.347237Z","submitted_at":"2026-06-29T14:17:53Z","title":"REAR: Test-time Preference Realignment through Reward Decomposition","version":1},"reference_index":146,"source":"arxiv_source","source_observed_at":"2026-06-30T06:20:36.864229Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2606.30339"},"observation_digest":"sha256:4ee9a70c9239757c159e357912191f4472339e8843d774909488b666525aca80","observation_id":"ceb18a38-89d6-42bf-ba72-1e84b1f82223","resolution":{"observed_at":"2026-06-30T06:24:19.164064Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14283","snapshot_observed_at":"2026-08-01T15:07:28.704221Z","title":"Q*: Improving multi-step reasoning for llms with deliberative planning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18548","last_updated":"2026-07-20T22:28:16Z","snapshot_observed_at":"2026-08-04T05:23:32.973903Z","submitted_at":"2026-07-20T22:28:16Z","title":"Engineering Trustworthy Agentic AI for Critical Systems","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T15:07:28.704221Z"},"links":{"cited_paper":"/paper/2406.14283","citing_paper":"/paper/2607.18548"},"observation_digest":"sha256:4d744733dbe2ca85212be6ae7c19c906d47563062d7e27ffbbb216385eb902a1","observation_id":"690d9359-25a2-45b1-ac17-5f455d648fac","resolution":{"observed_at":"2026-08-01T15:07:28.704221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.14283/citation-record","integrity":"/paper/2406.14283/integrity","json":"/paper/2406.14283/citation-record.json","paper":"/paper/2406.14283"},"outbound":[],"paper":{"arxiv_id":"2406.14283","last_updated":"2024-07-22T10:01:49Z","latest_version":4,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T13:14:49.508020Z","submitted_at":"2024-06-20T13:08:09Z","title":"Q*: Improving Multi-step Reasoning for LLMs with Deliberative Planning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 24 inbound Pith citation observations for arXiv:2406.14283."}