{"as_of":"2026-08-22T00:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bd7b9e3863cbd32fb503866e97a44460b5a2e86179d8b09eae3ab93b7803fd94","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:43:14.035973Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:53:41.436053Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T10:39:45.816513Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"cited_work":{"arxiv_id":"2507.02076","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02076","snapshot_observed_at":"2026-07-04T10:39:45.816513Z","title":"Reasoning on a budget: A survey of adaptive and controllable test-time compute in llms","venue":null,"work_id":"ce2ea139-eaf6-4e82-a16d-cfa8657ac65c","year":2025},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2507.02076","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:616006202ec6c3942229831ddd9c5c47780be2c094f441bde131060670c5d5d9","observation_id":"5ecd0787-4ef1-4047-901f-709a2efeba2a","resolution":{"observed_at":"2026-05-12T08:40:41.306422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02076","snapshot_observed_at":"2026-08-06T17:53:41.436053Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09662","last_updated":"2025-07-13T14:51:59Z","snapshot_observed_at":"2026-08-20T12:31:43.651320Z","submitted_at":"2025-07-13T14:51:59Z","title":"Towards Concise and Adaptive Thinking in Large Reasoning Models: A Survey","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T17:53:41.436053Z"},"links":{"cited_paper":"/paper/2507.02076","citing_paper":"/paper/2507.09662"},"observation_digest":"sha256:eaf9c1fde3a9eed03774292e1f786a65b2bcecb624f8d3a2ecae36a502cef5e6","observation_id":"71c0072f-ab49-48f3-8486-0ac8865522ee","resolution":{"observed_at":"2026-08-06T17:53:41.436053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02076","snapshot_observed_at":"2026-07-13T23:28:12.790404Z","title":"Reasoning on a budget: A survey of adaptive and controllable test-time compute in llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.16867","last_updated":"2026-06-03T09:37:20Z","snapshot_observed_at":"2026-08-14T22:25:11.633208Z","submitted_at":"2026-03-17T17:59:51Z","title":"Efficient Reasoning on the Edge","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T23:28:12.790404Z"},"links":{"cited_paper":"/paper/2507.02076","citing_paper":"/paper/2603.16867"},"observation_digest":"sha256:7b26c209bc1f46ec549ddb8057f0e85bf86df1a292c2783fbaae8054f602089a","observation_id":"a621ebbc-27c2-40d2-a369-2f58274ed11d","resolution":{"observed_at":"2026-07-13T23:28:12.790404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"cited_work":{"arxiv_id":"2507.02076","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02076","snapshot_observed_at":"2026-07-04T10:39:45.816513Z","title":"Reasoning on a budget: A survey of adaptive and controllable test-time compute in llms","venue":null,"work_id":"ce2ea139-eaf6-4e82-a16d-cfa8657ac65c","year":2025},"citing_paper":{"arxiv_id":"2605.04461","last_updated":"2026-05-06T03:40:05Z","snapshot_observed_at":"2026-08-01T01:47:15.158535Z","submitted_at":"2026-05-06T03:40:05Z","title":"Stream-T1: Test-Time Scaling for Streaming Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T18:16:14.985693Z"},"links":{"cited_paper":"/paper/2507.02076","citing_paper":"/paper/2605.04461"},"observation_digest":"sha256:28717563e676f87dfbf4fcf45abb9a022a3cad17c4ca038cb25044328e3f594a","observation_id":"4f7159f5-d5ca-4da8-a1fe-9bbd642afe20","resolution":{"observed_at":"2026-05-09T06:40:39.447330Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"cited_work":{"arxiv_id":"2507.02076","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02076","snapshot_observed_at":"2026-07-04T10:39:45.816513Z","title":"Reasoning on a budget: A survey of adaptive and controllable test-time compute in llms","venue":null,"work_id":"ce2ea139-eaf6-4e82-a16d-cfa8657ac65c","year":2025},"citing_paper":{"arxiv_id":"2605.07316","last_updated":"2026-05-08T06:25:08Z","snapshot_observed_at":"2026-08-16T02:30:36.876054Z","submitted_at":"2026-05-08T06:25:08Z","title":"Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-11T01:12:20.864362Z"},"links":{"cited_paper":"/paper/2507.02076","citing_paper":"/paper/2605.07316"},"observation_digest":"sha256:2461f58f371989d22a76e2a0805730e09830f22d89161727e34a6bdddecc3afd","observation_id":"a17cc85f-a316-4bef-adcc-640fb215f5ba","resolution":{"observed_at":"2026-05-11T04:35:59.813805Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"cited_work":{"arxiv_id":"2507.02076","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02076","snapshot_observed_at":"2026-07-04T10:39:45.816513Z","title":"Reasoning on a budget: A survey of adaptive and controllable test-time compute in llms","venue":null,"work_id":"ce2ea139-eaf6-4e82-a16d-cfa8657ac65c","year":2025},"citing_paper":{"arxiv_id":"2606.04402","last_updated":"2026-06-03T03:29:57Z","snapshot_observed_at":"2026-08-02T03:47:44.360604Z","submitted_at":"2026-06-03T03:29:57Z","title":"Not All Errors Are Equal: Consequence-Aware Reasoning Compute Allocation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T06:40:12.178170Z"},"links":{"cited_paper":"/paper/2507.02076","citing_paper":"/paper/2606.04402"},"observation_digest":"sha256:475d0975f364c78659ad1fb6c202a6ed894fb13aa1c1d68d6410a66fd67d76b1","observation_id":"860fe285-77cf-43cf-a159-9aa984cb7422","resolution":{"observed_at":"2026-07-02T07:46:46.319201Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"cited_work":{"arxiv_id":"2507.02076","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02076","snapshot_observed_at":"2026-07-04T10:39:45.816513Z","title":"Reasoning on a budget: A survey of adaptive and controllable test-time compute in llms","venue":null,"work_id":"ce2ea139-eaf6-4e82-a16d-cfa8657ac65c","year":2025},"citing_paper":{"arxiv_id":"2606.23181","last_updated":"2026-06-22T11:24:59Z","snapshot_observed_at":"2026-08-12T17:21:45.250298Z","submitted_at":"2026-06-22T11:24:59Z","title":"DART: Draft-Agreement Routing for Training-Free Adaptive Thinking Budgets in Hybrid Reasoning Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-26T08:35:36.580490Z"},"links":{"cited_paper":"/paper/2507.02076","citing_paper":"/paper/2606.23181"},"observation_digest":"sha256:6246daa37c1f1bf6e3eac9c0909876a3953560b5accf868f2c68fd9ac4f36a5f","observation_id":"3b277870-b69e-4a7a-bda4-8acbbdb1e1cd","resolution":{"observed_at":"2026-07-04T10:39:45.818180Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02076","snapshot_observed_at":"2026-07-30T19:53:04.470253Z","title":"Reasoning on a budget: A survey of adaptive and controllable test-time compute in llms.arXiv preprint arXiv:2507.02076,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26828","last_updated":"2026-07-30T03:06:21Z","snapshot_observed_at":"2026-08-18T23:08:59.354867Z","submitted_at":"2026-07-29T12:21:28Z","title":"Budget-Aware LLM Discovery via Cost-Calibrated Frontier Utility","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-30T19:53:04.470253Z"},"links":{"cited_paper":"/paper/2507.02076","citing_paper":"/paper/2607.26828"},"observation_digest":"sha256:334bdbd9ecfa828f61d36b0ee5005ace21713f8bab44b1438572e86f36d8347d","observation_id":"9fa708e6-2395-4fce-9cf7-227078a9fdb2","resolution":{"observed_at":"2026-07-30T19:53:04.470253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02076","snapshot_observed_at":"2026-08-01T10:47:32.732851Z","title":"Reasoning on a budget: A survey of adaptive and controllable test-time compute in llms.arXiv preprint arXiv:2507.02076,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26828","last_updated":"2026-07-30T03:06:21Z","snapshot_observed_at":"2026-08-18T23:08:59.354867Z","submitted_at":"2026-07-29T12:21:28Z","title":"Budget-Aware LLM Discovery via Cost-Calibrated Frontier Utility","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T10:47:32.732851Z"},"links":{"cited_paper":"/paper/2507.02076","citing_paper":"/paper/2607.26828"},"observation_digest":"sha256:72d48cbbdd17e413ce2ec54d415885c0d012778313fb5eb410c49003cf7f0da7","observation_id":"4db737b8-317e-49a0-bf67-5fad7ede9a83","resolution":{"observed_at":"2026-08-01T10:47:32.732851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02076","snapshot_observed_at":"2026-07-31T23:48:03.164747Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27879","last_updated":"2026-07-30T08:53:32Z","snapshot_observed_at":"2026-08-19T17:54:16.852437Z","submitted_at":"2026-07-30T08:53:32Z","title":"ARES: Adaptive Reasoning-Effort Steering for PPA- and Cost-Aware RTL Optimization with LLM Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-31T23:48:03.164747Z"},"links":{"cited_paper":"/paper/2507.02076","citing_paper":"/paper/2607.27879"},"observation_digest":"sha256:63641859406b8dc3476d25e8860fae6cb99bdf5769652e7c385bb53adcece46e","observation_id":"ee9e0a6d-5632-4b70-9f7f-05d75de5abf2","resolution":{"observed_at":"2026-07-31T23:48:03.164747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02076","snapshot_observed_at":"2026-07-31T06:48:41.240335Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28457","last_updated":"2026-07-30T16:20:58Z","snapshot_observed_at":"2026-08-18T14:28:06.282643Z","submitted_at":"2026-07-30T16:20:58Z","title":"SVR: Self-Verifying Refinement via Joint Verdict-Confidence Reinforcement Learning for Adaptive Test-Time Compute","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-31T06:48:41.240335Z"},"links":{"cited_paper":"/paper/2507.02076","citing_paper":"/paper/2607.28457"},"observation_digest":"sha256:77288d05c73277c2d0d2585f252f207f72f96fa58f778bd0c751aa491d20f484","observation_id":"a825b8a0-ae52-4f03-be07-a13e398d6c2e","resolution":{"observed_at":"2026-07-31T06:48:41.240335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.02076/citation-record","integrity":"/paper/2507.02076/integrity","json":"/paper/2507.02076/citation-record.json","paper":"/paper/2507.02076"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.00515","last_updated":"2024-11-10T22:02:27Z","snapshot_observed_at":"2026-08-14T16:40:35.729198Z","submitted_at":"2024-06-01T17:48:15Z","title":"A Survey on Large Language Models for Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00515","snapshot_observed_at":"2026-08-06T20:43:08.761362Z","title":"A survey on large language models for code generation.arXiv preprint arXiv:2406.00515,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:08.761362Z"},"links":{"cited_paper":"/paper/2406.00515","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:184e3181aa308ae46bc738f678047276d41a38cda4d835b627f58817221fb289","observation_id":"97f59d01-bd30-4303-9026-d00b61e03299","resolution":{"observed_at":"2026-08-06T20:43:08.761362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1436.0171","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:43:14.356869Z","title":"on\" setting corresponds to a thinking budget of 24,576 tokens, while","venue":null,"work_id":"09b19f94-5d18-4ed3-b2d5-20712fdf9f86","year":2024},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:14.035973Z"},"links":{"citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:35c8bb06abb46633e34ec6b9c7e63fa00ba1aa13d4ed2002df9cb1cda5af8cfc","observation_id":"d80ce121-b003-4112-aedf-a6c4e8dfb28b","resolution":{"observed_at":"2026-08-06T20:43:14.461497Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T20:43:09.135243Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:09.135243Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:328dd3a72b2e4ab5ce40be1033712f73da2f8f60a91cdc6615371f86da9e2969","observation_id":"86e3d6dd-907f-407b-8b55-69c05a1fe84f","resolution":{"observed_at":"2026-08-06T20:43:09.135243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-06T20:43:09.297529Z","title":"Scaling llm test-time compute optimally can be more effective than scaling model parameters.arXiv preprint arXiv:2408.03314,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:09.297529Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:270fecdd45799487ddff7fa74c8d7253c20eb3c2570a92b212e18ddc7a51951a","observation_id":"aeafcfda-5083-44af-953e-c65b13b08d91","resolution":{"observed_at":"2026-08-06T20:43:09.297529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-20T11:42:35.796814Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-06T20:43:09.464477Z","title":"Do not think that much for 2+3=? on the overthinking of o1-like llms.arXiv preprint arXiv:2412.21187, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:09.464477Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:5ff3b0db199874ef0db82230041bf99e991abde521b7a428f1a3125e9bfb0d3e","observation_id":"f3da6fd9-88b6-4ecc-859c-703397d6bf97","resolution":{"observed_at":"2026-08-06T20:43:09.464477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01141","last_updated":"2025-04-01T00:41:36Z","snapshot_observed_at":"2026-08-18T08:05:54.612758Z","submitted_at":"2025-03-03T03:48:20Z","title":"How Well do LLMs Compress Their Own Chain-of-Thought? A Token Complexity Approach","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01141","snapshot_observed_at":"2026-08-06T20:43:09.527822Z","title":"How well do llms compress their own chain-of-thought? a token complexity approach.arXiv preprint arXiv:2503.01141,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:09.527822Z"},"links":{"cited_paper":"/paper/2503.01141","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:65ca0a0d53f27af90affcdee6af3f1bb18dcc187b359a19ec9dee45eef4a70af","observation_id":"5c0c275e-816f-4fe9-92d5-9b3b91d06193","resolution":{"observed_at":"2026-08-06T20:43:09.527822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18600","last_updated":"2025-03-03T17:08:21Z","snapshot_observed_at":"2026-08-18T14:29:54.622995Z","submitted_at":"2025-02-25T19:36:06Z","title":"Chain of Draft: Thinking Faster by Writing Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18600","snapshot_observed_at":"2026-08-06T20:43:09.623420Z","title":"Chain of draft: Thinking faster by writing less.arXiv preprint arXiv:2502.18600, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:09.623420Z"},"links":{"cited_paper":"/paper/2502.18600","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:425db5dbbc35e27dc73af3ad1a8f5cdf83b4b49a6d9671e234b31a9af3f863f9","observation_id":"80062928-066b-4bd5-9459-7e2336bebae2","resolution":{"observed_at":"2026-08-06T20:43:09.623420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-17T16:48:59.674177Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-06T20:43:09.677847Z","title":"L1: Controlling how long a reasoning model thinks with reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:09.677847Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:8476c2a032fd6be5fcf77fce6e7eca9bdc86328339f10b9659c84e75844a6e6d","observation_id":"27f35f66-cf46-418a-80c7-54ed7b1e5e67","resolution":{"observed_at":"2026-08-06T20:43:09.677847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:43:09.745508Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:09.745508Z"},"links":{"citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:339c32d76301f6e0569b4136ca2e2f0b59bbce72c9e8b84cbda549bad63dd8cb","observation_id":"c1fa2898-b10f-4a14-addc-b4a5e31cc82c","resolution":{"observed_at":"2026-08-06T20:43:09.745508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-11T13:10:23.709172Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-06T20:43:09.804299Z","title":"Stop overthinking: A survey on efficient reasoning for large language models.arXiv preprint arXiv:2503.16419, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:09.804299Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:05e82767d8ff751549eb7063937795699de2603bdd70f220efcd82a596aab294","observation_id":"ec56e8d5-74b1-4aa5-b1f5-ff3c8bdbdef4","resolution":{"observed_at":"2026-08-06T20:43:09.804299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19825","last_updated":"2025-01-23T08:45:52Z","snapshot_observed_at":"2026-08-16T13:30:18.557142Z","submitted_at":"2024-07-29T09:21:52Z","title":"Concise Thoughts: Impact of Output Length on LLM Reasoning and Cost","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19825","snapshot_observed_at":"2026-08-06T20:43:09.869520Z","title":"Concise thoughts: Impact of output length on llm reasoning and cost.arXiv preprint arXiv:2407.19825,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:09.869520Z"},"links":{"cited_paper":"/paper/2407.19825","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:50b6ebc2a13dfee5f2d1f33a8e34981f72b2bd66a8640e753b18644afe041e07","observation_id":"d4c14954-7ffb-4d1a-a828-2ee7cd8ce4bd","resolution":{"observed_at":"2026-08-06T20:43:09.869520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-08-17T11:00:39.333660Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-06T20:43:09.920706Z","title":"s1: Simple test-time scaling.arXiv preprint arXiv:2501.19393,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:09.920706Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:2677c3a2b0e9e5ce342e3a3720016e03697a38ff3bb320d85f705abafa8d4bbb","observation_id":"186f4172-0b71-4c36-b577-5e3d98d2985a","resolution":{"observed_at":"2026-08-06T20:43:09.920706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09601","last_updated":"2025-02-13T18:52:36Z","snapshot_observed_at":"2026-08-15T01:40:51.444222Z","submitted_at":"2025-02-13T18:52:36Z","title":"CoT-Valve: Length-Compressible Chain-of-Thought Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09601","snapshot_observed_at":"2026-08-06T20:43:09.958987Z","title":"Cot-valve: Length-compressible chain-of-thought tuning.arXiv preprint arXiv:2502.09601,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:09.958987Z"},"links":{"cited_paper":"/paper/2502.09601","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:cf67e18eb8425fc098358aa8f1ba4b2c544aba7a497e6f66925e8661d8bc5b43","observation_id":"0a69ef1d-ca20-409a-aa5d-cacd4737285f","resolution":{"observed_at":"2026-08-06T20:43:09.958987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05315","last_updated":"2025-05-21T05:40:27Z","snapshot_observed_at":"2026-08-18T03:20:04.325807Z","submitted_at":"2025-05-08T15:01:06Z","title":"Scalable Chain of Thoughts via Elastic Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05315","snapshot_observed_at":"2026-08-06T20:43:10.016291Z","title":"Scalable chain of thoughts via elastic reasoning.arXiv preprint arXiv:2505.05315, 2025b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.016291Z"},"links":{"cited_paper":"/paper/2505.05315","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:0124d6c85c4f7e8f95ec8361c7d00044fa4fa4111e6898241f69ef729cf7e466","observation_id":"ccfdd36d-26f2-471b-af18-0f05f4ecf18a","resolution":{"observed_at":"2026-08-06T20:43:10.016291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:43:10.084290Z","title":"Path-Consistency: Prefix Enhancement for Efficient Inference in LLM.arXiv preprint arXiv:2409.01281,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.084290Z"},"links":{"citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:3c762aeb71d2af8aa739af942bc79392f70a61477dce8a5aeeed7e69dfe7e0cd","observation_id":"7e711825-6ac7-479f-b0ae-689038cc819c","resolution":{"observed_at":"2026-08-06T20:43:10.084290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13457","last_updated":"2025-02-12T02:52:25Z","snapshot_observed_at":"2026-08-16T20:49:49.325170Z","submitted_at":"2024-08-24T04:03:35Z","title":"Make Every Penny Count: Difficulty-Adaptive Self-Consistency for Cost-Efficient Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13457","snapshot_observed_at":"2026-08-06T20:43:10.152789Z","title":"Make every penny count: Difficulty-adaptive self-consistency for cost-efficient reasoning.arXiv preprint arXiv:2408.13457, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.152789Z"},"links":{"cited_paper":"/paper/2408.13457","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:533f3766e23ccd83b7ff9967f302bb80ea514cf935e1a66ba8ee408032d593f4","observation_id":"cd31cadc-038b-4d77-bf61-788a293e891a","resolution":{"observed_at":"2026-08-06T20:43:10.152789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20993","last_updated":"2025-05-27T16:41:53Z","snapshot_observed_at":"2026-08-12T17:14:32.746931Z","submitted_at":"2024-12-30T14:57:53Z","title":"Efficiently Scaling LLM Reasoning with Certaindex","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20993","snapshot_observed_at":"2026-08-06T20:43:10.229212Z","title":"Efficiently Serving LLM Reasoning Programs with Certaindex.arXiv preprint arXiv:2412.20993,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.229212Z"},"links":{"cited_paper":"/paper/2412.20993","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:ba378d3928b85d3e1556124c9a29d8ae64965c3a495ee92c8fb96d0d1efdc478","observation_id":"ef5b7085-cc35-4f6c-b1f1-8f8d5fafae89","resolution":{"observed_at":"2026-08-06T20:43:10.229212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16235","last_updated":"2025-02-27T06:39:06Z","snapshot_observed_at":"2026-08-18T08:03:59.881016Z","submitted_at":"2025-02-22T14:13:37Z","title":"Dynamic Parallel Tree Search for Efficient LLM Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.16235","snapshot_observed_at":"2026-08-06T20:43:10.273660Z","title":"When more is less: Understanding chain-of-thought length in LLMs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.273660Z"},"links":{"cited_paper":"/paper/2502.16235","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:33a4bb7ca8671c8e0d37ab20b347b2a9043c840d31d75604f101e3564d27ef1f","observation_id":"87e5a839-404a-4717-90ad-3c27acf4f4e0","resolution":{"observed_at":"2026-08-06T20:43:10.273660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:43:10.315116Z","title":"Sampling-Efficient Test-Time Scaling: Self-Estimating the Best-of-N Sampling in Early Decoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.315116Z"},"links":{"citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:012b9f431cd7c2f09444fffd160643a1cc453e2ccd8096553dfec099839390d7","observation_id":"2f773857-9d39-4520-8079-189673a25d32","resolution":{"observed_at":"2026-08-06T20:43:10.315116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.17017","last_updated":"2025-02-04T03:59:49Z","snapshot_observed_at":"2026-08-16T13:22:44.821985Z","submitted_at":"2024-08-30T05:14:59Z","title":"Reasoning Aware Self-Consistency: Leveraging Reasoning Paths for Efficient LLM Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.17017","snapshot_observed_at":"2026-08-06T20:43:10.362509Z","title":"Are more LLM calls all you need? towards the scaling properties of compound AI systems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.362509Z"},"links":{"cited_paper":"/paper/2408.17017","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:b162267e858003f46f27ea1823ef96f7e813038cb721e39d95367d25ce2d7a4c","observation_id":"6f3ee461-baab-4b45-9737-855345b9f88c","resolution":{"observed_at":"2026-08-06T20:43:10.362509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02725","last_updated":"2024-10-03T17:47:29Z","snapshot_observed_at":"2026-08-19T21:14:58.741186Z","submitted_at":"2024-10-03T17:47:29Z","title":"Adaptive Inference-Time Compute: LLMs Can Predict if They Can Do Better, Even Mid-Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02725","snapshot_observed_at":"2026-08-06T20:43:10.441733Z","title":"Adaptive Inference-Time Compute: LLMs Can Predict if They Can Do Better, Even Mid-Generation.arXiv preprint arXiv:2410.02725,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.441733Z"},"links":{"cited_paper":"/paper/2410.02725","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:36f9140ff0f638f9995bde22b2ce256a02ed6093ffd0817ddd36de0b686c302d","observation_id":"30fd29c9-404d-46f5-9d34-d6f2248beb88","resolution":{"observed_at":"2026-08-06T20:43:10.441733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00031","last_updated":"2025-02-25T00:21:14Z","snapshot_observed_at":"2026-08-16T12:55:33.152261Z","submitted_at":"2025-02-25T00:21:14Z","title":"Efficient Test-Time Scaling via Self-Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00031","snapshot_observed_at":"2026-08-06T20:43:10.487393Z","title":"Efficient Test-Time Scaling via Self-Calibration.arXiv preprint arXiv:2503.00031,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.487393Z"},"links":{"cited_paper":"/paper/2503.00031","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:434acec5fb04f3f70b0de02df043691daf3c89d969098e2357b0d8c739af20f6","observation_id":"12a18604-f904-4086-80b3-652a7e821b24","resolution":{"observed_at":"2026-08-06T20:43:10.487393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01306","last_updated":"2025-01-03T08:29:37Z","snapshot_observed_at":"2026-08-14T19:11:08.554167Z","submitted_at":"2025-01-02T15:36:50Z","title":"Think More, Hallucinate Less: Mitigating Hallucinations via Dual Process of Fast and Slow Thinking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01306","snapshot_observed_at":"2026-08-06T20:43:10.550098Z","title":"Think more, hallucinate less: Mitigating hallu- cinations via dual process of fast and slow thinking.arXiv preprint arXiv:2501.01306,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.550098Z"},"links":{"cited_paper":"/paper/2501.01306","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:173377865e9e262a373f992a6acafed3fe03c4add183aae43c82afc777cda59c","observation_id":"e50f7959-a515-474c-b644-600be201f4f1","resolution":{"observed_at":"2026-08-06T20:43:10.550098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15466","last_updated":"2025-08-17T18:23:42Z","snapshot_observed_at":"2026-08-19T17:15:23.530282Z","submitted_at":"2025-04-21T22:29:02Z","title":"Learning Adaptive Parallel Reasoning with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15466","snapshot_observed_at":"2026-08-06T20:43:10.612245Z","title":"Learning adaptive parallel reasoning with language models.arXiv preprint arXiv:2504.15466,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.612245Z"},"links":{"cited_paper":"/paper/2504.15466","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:59c5c9dffe94a08fc347e6cb1c50ac1355545fac7403a1c2d51855f224d037ac","observation_id":"087a7916-5195-44d3-b404-6393ec5f32f2","resolution":{"observed_at":"2026-08-06T20:43:10.612245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:43:10.659026Z","title":"Aytes, Jinheon Baek, and Sung Ju Hwang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.659026Z"},"links":{"citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:ab0670985bfeb245671ec329a1ed6ad6122dcc4fd360acddbb84007e675dd6ba","observation_id":"8f820d29-5b39-4f73-8a19-f0e9e703d872","resolution":{"observed_at":"2026-08-06T20:43:10.659026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18585","last_updated":"2025-02-18T16:51:53Z","snapshot_observed_at":"2026-08-15T06:19:06.009960Z","submitted_at":"2025-01-30T18:58:18Z","title":"Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18585","snapshot_observed_at":"2026-08-06T20:43:10.721707Z","title":"Thoughts are all over the place: On the underthinking of o1-like llms.arXiv preprint arXiv:2501.18585, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.721707Z"},"links":{"cited_paper":"/paper/2501.18585","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:1d79121e615014e518e49392136610228da270311299618cde857c8eb4651e25","observation_id":"a031feb2-6343-424f-a645-7b04a53d4087","resolution":{"observed_at":"2026-08-06T20:43:10.721707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07572","last_updated":"2025-03-10T17:40:43Z","snapshot_observed_at":"2026-08-16T12:51:25.160206Z","submitted_at":"2025-03-10T17:40:43Z","title":"Optimizing Test-Time Compute via Meta Reinforcement Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07572","snapshot_observed_at":"2026-08-06T20:43:10.775809Z","title":"Optimizing test-time compute via meta reinforcement fine-tuning.arXiv preprint arXiv:2503.07572, 2025b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.775809Z"},"links":{"cited_paper":"/paper/2503.07572","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:04a63de0d9ff77563c4a1677cdf13aade75ed9ad3e2303d7a6535e5eec872d9d","observation_id":"636d64aa-4260-403f-b138-5acc801f305a","resolution":{"observed_at":"2026-08-06T20:43:10.775809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11664","last_updated":"2024-12-16T11:12:45Z","snapshot_observed_at":"2026-08-13T21:39:06.494517Z","submitted_at":"2024-12-16T11:12:45Z","title":"C3oT: Generating Shorter Chain-of-Thought without Compromising Effectiveness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.11664","snapshot_observed_at":"2026-08-06T20:43:10.822267Z","title":"C3ot: Generating shorter chain-of-thought without compromising effectiveness.arXiv preprint arXiv:2412.11664, 2024b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.822267Z"},"links":{"cited_paper":"/paper/2412.11664","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:4fe33643204a7f8a3ce6ccf19eec69aa66331353ac47442d855a33acd28be50f","observation_id":"d65f467f-b820-45d0-8b3a-a9b78f6f5868","resolution":{"observed_at":"2026-08-06T20:43:10.822267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00810","last_updated":"2025-04-01T14:01:50Z","snapshot_observed_at":"2026-08-16T12:44:56.257040Z","submitted_at":"2025-04-01T14:01:50Z","title":"Z1: Efficient Test-time Scaling with Code","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00810","snapshot_observed_at":"2026-08-06T20:43:10.876259Z","title":"Z1: Efficient test-time scaling with code.arXiv preprint arXiv:2504.00810, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.876259Z"},"links":{"cited_paper":"/paper/2504.00810","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:f174d8353ffc4839bd3cab19bf544898518b0b3de7369041bca6989ed82f1eda","observation_id":"cac35caa-48ac-4387-a62c-cc1b0ddcc02d","resolution":{"observed_at":"2026-08-06T20:43:10.876259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06023","last_updated":"2024-07-24T18:40:36Z","snapshot_observed_at":"2026-08-17T02:05:35.367393Z","submitted_at":"2024-07-08T15:17:46Z","title":"Distilling System 2 into System 1","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06023","snapshot_observed_at":"2026-08-06T20:43:10.962760Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.962760Z"},"links":{"cited_paper":"/paper/2407.06023","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:bc993e72ad5e2a79ba3cd600441c1fbcab850cd383fc17b4aecb5c86363e672a","observation_id":"39542602-6445-4595-8bf8-8aea9305df13","resolution":{"observed_at":"2026-08-06T20:43:10.962760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04383","last_updated":"2025-04-15T14:07:31Z","snapshot_observed_at":"2026-08-16T12:43:39.695451Z","submitted_at":"2025-04-06T06:23:27Z","title":"Retro-Search: Exploring Untaken Paths for Deeper and Efficient Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04383","snapshot_observed_at":"2026-08-06T20:43:10.966932Z","title":"Retro-search: Exploring untaken paths for deeper and efficient reasoning.arXiv preprint arXiv:2504.04383,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.966932Z"},"links":{"cited_paper":"/paper/2504.04383","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:d504b067ab6c99b98c5c22edd53ac427c7e61ff28fd07c5ec038d5430ff46c10","observation_id":"bfb63d2a-a5c9-4887-8216-1dcd13bda5ed","resolution":{"observed_at":"2026-08-06T20:43:10.966932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12134","last_updated":"2025-05-27T14:54:51Z","snapshot_observed_at":"2026-08-20T04:20:50.868517Z","submitted_at":"2025-02-17T18:52:29Z","title":"SoftCoT: Soft Chain-of-Thought for Efficient Reasoning with LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12134","snapshot_observed_at":"2026-08-06T20:43:10.970286Z","title":"Softcot: Soft chain-of-thought for efficient reasoning with llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:10.970286Z"},"links":{"cited_paper":"/paper/2502.12134","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:f0f6b6bcb8a1d78126853ed16a6609e367d83ec8f10ac3b45ac98314ab755b09","observation_id":"940832f4-6610-434e-a01d-26b89129ce53","resolution":{"observed_at":"2026-08-06T20:43:10.970286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.21074","last_updated":"2025-09-23T08:16:08Z","snapshot_observed_at":"2026-08-07T17:46:47.440455Z","submitted_at":"2025-02-28T14:07:48Z","title":"CODI: Compressing Chain-of-Thought into Continuous Space via Self-Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.21074","snapshot_observed_at":"2026-08-06T20:43:11.003540Z","title":"Codi: Compressing chain-of- thought into continuous space via self-distillation.arXiv preprint arXiv:2502.21074, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:11.003540Z"},"links":{"cited_paper":"/paper/2502.21074","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:3a96f84be4dff6c5470c9bbe0db0e7cd9478d0a383cbb76ca0ed549fc4ea961f","observation_id":"f8fba156-355d-497a-b1dd-50d650a65220","resolution":{"observed_at":"2026-08-06T20:43:11.003540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:43:11.053673Z","title":"Dast: Difficulty-adaptive slow-thinking for large reasoning models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:11.053673Z"},"links":{"citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:efadb7ab1b46309e6aa5c2b7848f80efe63726463f6f23b3686dadcdba6a8280","observation_id":"c64a2784-9bfb-4a16-81b1-094284f2c1d3","resolution":{"observed_at":"2026-08-06T20:43:11.053673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17974","last_updated":"2025-01-31T16:06:26Z","snapshot_observed_at":"2026-08-18T10:19:50.807399Z","submitted_at":"2025-01-29T20:20:48Z","title":"Think Smarter not Harder: Adaptive Reasoning with Inference Aware Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17974","snapshot_observed_at":"2026-08-06T20:43:11.127950Z","title":"Think smarter not harder: Adaptive reasoning with inference aware optimization.arXiv preprint arXiv:2501.17974, 2025b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:11.127950Z"},"links":{"cited_paper":"/paper/2501.17974","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:3b7d4a932800417ebea4f1a7ab560c3ba401f430e48f8feb391bd040dcdd3d59","observation_id":"016d3f15-43cc-47f7-9ab4-f0a4e79ab472","resolution":{"observed_at":"2026-08-06T20:43:11.127950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05449","last_updated":"2025-06-01T20:14:16Z","snapshot_observed_at":"2026-08-18T23:34:51.560822Z","submitted_at":"2025-02-08T04:39:51Z","title":"Iterative Deepening Sampling as Efficient Test-Time Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05449","snapshot_observed_at":"2026-08-06T20:43:11.199591Z","title":"Iterative deepening sampling for large language models.arXiv preprint arXiv:2502.05449, 2025c","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:11.199591Z"},"links":{"cited_paper":"/paper/2502.05449","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:c16645c6b21d5d5751f291cf15076190b9ca1f79ae634941122555276b98504a","observation_id":"45f3e798-c635-4d6e-b844-b006fe003d35","resolution":{"observed_at":"2026-08-06T20:43:11.199591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T20:43:11.273137Z","title":"Universal self-consistency for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:11.273137Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:bfe81562823a4526979c8e9315d276e56cb08ed7e2969432a8f29e462cddb0ce","observation_id":"8066ae76-a501-41c5-b356-8209946de9bd","resolution":{"observed_at":"2026-08-06T20:43:11.273137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:43:11.479606Z","title":"Let llms break free from overthinking via self-braking tuning.arXiv preprint arXiv:2505.14604,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:11.479606Z"},"links":{"citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:8c8427556c1dc79784b4aae3a481883b9179991e7d2de96c840360649d429879","observation_id":"87bdfa46-2020-4bb4-b3b9-09b422e80d5a","resolution":{"observed_at":"2026-08-06T20:43:11.479606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03469","last_updated":"2025-05-21T06:17:56Z","snapshot_observed_at":"2026-08-20T14:00:28.683849Z","submitted_at":"2025-05-06T12:18:11Z","title":"Long-Short Chain-of-Thought Mixture Supervised Fine-Tuning Eliciting Efficient Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03469","snapshot_observed_at":"2026-08-06T20:43:11.584022Z","title":"Long-short chain-of-thoughtmixturesupervisedfine-tuningelicitingefficientreasoninginlargelanguagemodels","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:11.584022Z"},"links":{"cited_paper":"/paper/2505.03469","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:3c25431c2c27efc80b55d8ec96683ac9d8833be0e6b97a91872bb5c69e1162e6","observation_id":"24b9dd8e-c2af-4876-a4d0-47fe83c59cac","resolution":{"observed_at":"2026-08-06T20:43:11.584022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:43:11.724669Z","title":"Lightthinker: Thinking step-by-step compression.arXiv preprint arXiv:2502.15589, 2025b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:11.724669Z"},"links":{"citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:79e127457fb0667fd8c347d95e1332c2228447a54eb314678ffb95f2499ad6a6","observation_id":"09f71da1-e222-47fe-92fa-80ff561f1849","resolution":{"observed_at":"2026-08-06T20:43:11.724669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13842","last_updated":"2025-02-23T04:31:53Z","snapshot_observed_at":"2026-08-19T15:14:40.650808Z","submitted_at":"2025-02-19T16:02:23Z","title":"Inner Thinking Transformer: Leveraging Dynamic Depth Scaling to Foster Adaptive Internal Thinking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13842","snapshot_observed_at":"2026-08-06T20:43:11.853423Z","title":"Inner thinking transformer: Leveraging dynamic depth scaling to foster adap- tive internal thinking.arXiv preprint arXiv:2502.13842, 2025d","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:11.853423Z"},"links":{"cited_paper":"/paper/2502.13842","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:099ee881aa98fcffb512b910ba984d5d509c25bebc1f222523363ddb43757746","observation_id":"0594972e-5cc6-4ebe-8925-f9bf4810b1d7","resolution":{"observed_at":"2026-08-06T20:43:11.853423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05118","last_updated":"2025-04-11T02:54:58Z","snapshot_observed_at":"2026-08-14T16:01:52.772456Z","submitted_at":"2025-04-07T14:21:11Z","title":"VAPO: Efficient and Reliable Reinforcement Learning for Advanced Reasoning Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05118","snapshot_observed_at":"2026-08-06T20:43:12.002417Z","title":"Vapo: Efficient and reliable reinforcement learning for advanced reasoning tasks.arXiv preprint arXiv:2504.05118,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:12.002417Z"},"links":{"cited_paper":"/paper/2504.05118","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:8a013ea82499f6aed85bb1eac845c1abf1b1b5cdb7972e12555aa460739dc99a","observation_id":"a892dcce-a0ce-4d20-ac7f-b1ce29ef605d","resolution":{"observed_at":"2026-08-06T20:43:12.002417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20101","last_updated":"2025-05-27T12:54:28Z","snapshot_observed_at":"2026-08-17T02:42:11.295323Z","submitted_at":"2025-05-26T15:08:51Z","title":"Adaptive Deep Reasoning: Triggering Deep Thinking When Needed","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20101","snapshot_observed_at":"2026-08-06T20:43:12.153392Z","title":"Adaptive deep reasoning: Triggering deep thinking when needed.arXiv preprint arXiv:2505.20101, 2025b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:12.153392Z"},"links":{"cited_paper":"/paper/2505.20101","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:9a857daf8338228f298b1c7813ae9f987663a6d328ed09be2e25cb572bf31b2b","observation_id":"aef5b66e-6ac9-4285-a535-cc65d7772db1","resolution":{"observed_at":"2026-08-06T20:43:12.153392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-08-13T12:34:54.476684Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-06T20:43:12.286981Z","title":"Un- derstanding r1-zero-like training: A critical perspective.arXiv preprint arXiv:2503.20783, 2025b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:12.286981Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:77c5c5b702911ae3f37e8a3ebad7009f36ae61f25ad64aa175ad4a56d672d4ac","observation_id":"c41f67a0-fe79-4bca-9907-9f73f0e44bcb","resolution":{"observed_at":"2026-08-06T20:43:12.286981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:43:15.885192Z","title":"Demystifying long chain-of-thought reasoning in LLMs","venue":null,"work_id":"e8ff8f44-ef7e-4b29-b08a-46e976dfd0dd","year":2025},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:12.434319Z"},"links":{"citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:fb924716f31e542d4aafd7cfc134c91d06c330f716e136fd10736ec109ef95ed","observation_id":"b590812f-183d-40be-a2c5-8e2889bf90cc","resolution":{"observed_at":"2026-08-06T20:43:16.002998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20641","last_updated":"2025-05-23T02:41:43Z","snapshot_observed_at":"2026-08-18T04:48:01.868748Z","submitted_at":"2025-03-26T15:34:37Z","title":"Unlocking Efficient Long-to-Short LLM Reasoning with Model Merging","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20641","snapshot_observed_at":"2026-08-06T20:43:12.588405Z","title":"Unlocking efficient long-to-short llm reasoning with model merging.arXiv preprint arXiv:2503.20641, 2025c","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:12.588405Z"},"links":{"cited_paper":"/paper/2503.20641","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:407fc439857c02fab05d8ab306d5a80e01bd29fc7c3e5e6ee065ca6f5eb01c13","observation_id":"b7e9225e-7221-469c-b540-fcaf5c94295f","resolution":{"observed_at":"2026-08-06T20:43:12.588405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09992","last_updated":"2025-10-18T15:35:05Z","snapshot_observed_at":"2026-08-04T04:34:22.998376Z","submitted_at":"2025-02-14T08:23:51Z","title":"Large Language Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09992","snapshot_observed_at":"2026-08-06T20:43:12.709763Z","title":"Shen Nie, Fengqi Zhu, Zebin You, Xiaolu Zhang, Jingyang Ou, Jun Hu, Jun Zhou, Yankai Lin, Ji-Rong Wen, and Chongxuan Li","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:12.709763Z"},"links":{"cited_paper":"/paper/2502.09992","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:f8325e8ca6a3a0eacf0ebfd2fdba94141acd61e9fba5d74eae2f5bf22259692c","observation_id":"71209fe2-95cf-41bb-be7a-ff23c247811c","resolution":{"observed_at":"2026-08-06T20:43:12.709763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10615","last_updated":"2025-03-18T08:52:34Z","snapshot_observed_at":"2026-08-15T09:44:57.157415Z","submitted_at":"2025-03-13T17:56:05Z","title":"R1-Onevision: Advancing Generalized Multimodal Reasoning through Cross-Modal Formalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10615","snapshot_observed_at":"2026-08-06T20:43:12.871809Z","title":"R1-onevision: Advancing generalized multimodal reasoning through cross-modal formalization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:12.871809Z"},"links":{"cited_paper":"/paper/2503.10615","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:3b51d4ade6c56879f34fe5a3ced59639471c388d20c6f3e1cc39cc4c6793cf49","observation_id":"8b71f0bb-bec7-4369-a61e-205807feb636","resolution":{"observed_at":"2026-08-06T20:43:12.871809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05132","last_updated":"2025-03-10T01:52:08Z","snapshot_observed_at":"2026-08-14T19:11:11.139675Z","submitted_at":"2025-03-07T04:21:47Z","title":"R1-Zero's \"Aha Moment\" in Visual Reasoning on a 2B Non-SFT Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05132","snapshot_observed_at":"2026-08-06T20:43:13.000062Z","title":"aha moment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:13.000062Z"},"links":{"cited_paper":"/paper/2503.05132","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:da53e1ebc91d56975f6b9c1d727316146c02d6e088b11430b9b33d32adb800ed","observation_id":"6a658c94-e32f-4094-9187-726e12e341ba","resolution":{"observed_at":"2026-08-06T20:43:13.000062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-16T02:03:48.252223Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-06T20:43:13.109252Z","title":"Vision-r1: Incentivizing reasoning capability in multimodal large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:13.109252Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:78b93f82c9f6c21f17d345c84f81f098169e8a8a79c2781f49a07a58fe5956f4","observation_id":"4f8397e1-bfd0-4c07-b375-56ac86a7284b","resolution":{"observed_at":"2026-08-06T20:43:13.109252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05599","last_updated":"2025-06-09T11:44:18Z","snapshot_observed_at":"2026-08-16T12:43:10.838199Z","submitted_at":"2025-04-08T01:19:20Z","title":"Skywork R1V: Pioneering Multimodal Reasoning with Chain-of-Thought","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05599","snapshot_observed_at":"2026-08-06T20:43:13.212648Z","title":"Skywork r1v: Pioneering multimodal reasoning with chain-of-thought.arXiv preprint arXiv:2504.05599,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:13.212648Z"},"links":{"cited_paper":"/paper/2504.05599","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:8e9395ae274a6a1ceec060eac6f5287c031b94af0b9ca3143129688025541a2d","observation_id":"6af19083-4476-41ec-9c25-8ae61921f423","resolution":{"observed_at":"2026-08-06T20:43:13.212648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07615","last_updated":"2025-04-14T15:15:54Z","snapshot_observed_at":"2026-08-14T23:38:19.973422Z","submitted_at":"2025-04-10T10:05:15Z","title":"VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07615","snapshot_observed_at":"2026-08-06T20:43:13.323509Z","title":"Vlm-r1: A stable and generalizable r1-style large vision-language model.arXiv preprint arXiv:2504.07615, 2025d","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:13.323509Z"},"links":{"cited_paper":"/paper/2504.07615","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:030684576e0a6675856c2c8729aeef217b9ee108497e37577d57f27efc64e79e","observation_id":"a20c72f3-589a-4fa7-b6bf-b5d8e0f65fde","resolution":{"observed_at":"2026-08-06T20:43:13.323509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07234","last_updated":"2025-03-10T12:17:38Z","snapshot_observed_at":"2026-08-16T12:51:33.103151Z","submitted_at":"2025-03-10T12:17:38Z","title":"CoT-Drive: Efficient Motion Forecasting for Autonomous Driving with LLMs and Chain-of-Thought Prompting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07234","snapshot_observed_at":"2026-08-06T20:43:13.460364Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:13.460364Z"},"links":{"cited_paper":"/paper/2503.07234","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:c5f0132efda2b35f6f741bef18c8389423be66ea8eaf21d4c0c68acb2236450c","observation_id":"1cdcb4a9-eefe-49aa-978a-fa6314d6cd46","resolution":{"observed_at":"2026-08-06T20:43:13.460364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:43:15.675627Z","title":"LLM4drive: A survey of large language models for autonomous driving","venue":null,"work_id":"a77d8898-0e48-402f-be10-2f7cdf9262e1","year":2024},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:13.596342Z"},"links":{"citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:9a5c5465660cd73f038e5d6b2bda81f436191ddd7d11f0015e34c35df9416082","observation_id":"bc49ccde-88c8-4ed1-b4ff-9100b2f23119","resolution":{"observed_at":"2026-08-06T20:43:15.776122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08693","last_updated":"2025-03-06T19:29:03Z","snapshot_observed_at":"2026-08-07T02:44:43.738657Z","submitted_at":"2024-07-11T17:31:01Z","title":"Robotic Control via Embodied Chain-of-Thought Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08693","snapshot_observed_at":"2026-08-06T20:43:13.735340Z","title":"Robotic control via embodied chain-of-thought reasoning.arXiv preprint arXiv:2407.08693,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:13.735340Z"},"links":{"cited_paper":"/paper/2407.08693","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:0dd28ddef573f59a999bc81954fbd5ef2a4cd9e0560ee288272b015bf9d0f5b4","observation_id":"62107ada-80c0-414b-bf1d-7ec068568403","resolution":{"observed_at":"2026-08-06T20:43:13.735340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09757","last_updated":"2025-01-16T18:59:53Z","snapshot_observed_at":"2026-08-14T20:39:52.547885Z","submitted_at":"2025-01-16T18:59:53Z","title":"Distilling Multi-modal Large Language Models for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09757","snapshot_observed_at":"2026-08-06T20:43:13.874387Z","title":"Patel, and Fatih Porikli","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:13.874387Z"},"links":{"cited_paper":"/paper/2501.09757","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:8bfe5896ffe3fd7ad338ff6be54dc9937abce08dcfab31136924cedb08bfd04f","observation_id":"a90c5221-dfc2-42f2-9c20-51b77e29fbc6","resolution":{"observed_at":"2026-08-06T20:43:13.874387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-06T20:43:08.973715Z","title":"Brown, Benjamin Chess, Rewon Child, Scott Gray, Alec Radford, Jeffrey Wu, and Dario Amodei","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:08.973715Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:ddbcee1fdc1c07de0010d057ed62f42e517b2ebc76501b54eefcba53a1e950fb","observation_id":"1f2cf374-a765-4949-a173-7dfa9852b306","resolution":{"observed_at":"2026-08-06T20:43:08.973715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06703","last_updated":"2025-02-10T17:30:23Z","snapshot_observed_at":"2026-08-18T20:31:50.522103Z","submitted_at":"2025-02-10T17:30:23Z","title":"Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06703","snapshot_observed_at":"2026-08-06T20:43:11.344018Z","title":"Can 1b llm surpass 405b llm? rethinking compute-optimal test-time scaling.arXiv preprint arXiv:2502.06703, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:11.344018Z"},"links":{"cited_paper":"/paper/2502.06703","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:f4f7816a4aa55a1e2c65821b8c492dcb600278b86647ad6dd661f6910126c4fa","observation_id":"19d5599b-be23-49fd-9f3b-148432ac69ae","resolution":{"observed_at":"2026-08-06T20:43:11.344018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-08-14T10:00:52.343929Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-06T20:43:09.225380Z","title":"Le, Christopher Ré, and Azalia Mirho- seini","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:09.225380Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:141862dbdc8a22e1566e4b33cf3750cf0fd7a9593a74c52d19e4f84035e3e968","observation_id":"54cafa12-b74f-43e3-9ae7-2df4c5fbc3fe","resolution":{"observed_at":"2026-08-06T20:43:09.225380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11476","last_updated":"2025-07-21T07:06:53Z","snapshot_observed_at":"2026-08-19T16:29:54.099700Z","submitted_at":"2025-02-17T06:27:57Z","title":"FastMCTS: A Simple Sampling Strategy for Data Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11476","snapshot_observed_at":"2026-08-06T20:43:09.074721Z","title":"Fastmcts: A simple sampling strategy for data synthesis.arXiv preprint arXiv:2502.11476, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:09.074721Z"},"links":{"cited_paper":"/paper/2502.11476","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:3b0a22c44bab1de711462fe149978fd9a7ce96e3345dc9eb338f92fa24a98cb3","observation_id":"712c1d75-968f-4bef-8ca5-3a0ee74d6cfa","resolution":{"observed_at":"2026-08-06T20:43:09.074721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-08-06T20:43:08.851463Z","title":"Introducing 4o image generation, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:08.851463Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:1b9e25768e98957fe7f70195bf2f00675bd9f2ec937d3d45d25b7400e1769282","observation_id":"9acab96e-46d3-4dc3-a947-9b01db42f415","resolution":{"observed_at":"2026-08-06T20:43:08.851463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-08-15T22:38:53.825110Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-06T20:43:09.389403Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T20:43:09.389403Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2507.02076"},"observation_digest":"sha256:9a5d1ff43923c45dcbe32dd19d7005ff00612a4af1fbe1275db09dad8c495c24","observation_id":"205ee521-e4d2-4baf-ace6-10344429b8f8","resolution":{"observed_at":"2026-08-06T20:43:09.389403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.02076","last_updated":"2025-07-02T18:27:42Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-14T10:43:51.935390Z","submitted_at":"2025-07-02T18:27:42Z","title":"Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":59,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 11 inbound Pith citation observations for arXiv:2507.02076."}