{"as_of":"2026-08-12T22:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d68e5870532c0958aa976248f4ef74fe4809cc0b7f82fa416ee2dbf60d036ef0","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:45:11.904232Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:53:45.466886Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T10:39:45.836079Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"cited_work":{"arxiv_id":"2506.23840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23840","snapshot_observed_at":"2026-07-04T10:39:45.836079Z","title":"emnlp-main.232/","venue":null,"work_id":"5c46ef72-c90c-4a57-892b-d0d41c19a029","year":2023},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":156,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2506.23840","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:f83a23048edc76c1e94c800c395d747d82b835d65dfc5e28746070e3bfa5b798","observation_id":"21e56c44-1e3a-4ffd-ac55-aa98adf9a977","resolution":{"observed_at":"2026-05-12T08:40:42.125528Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23840","snapshot_observed_at":"2026-08-06T17:53:45.466886Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09662","last_updated":"2025-07-13T14:51:59Z","snapshot_observed_at":"2026-08-11T20:23:03.012064Z","submitted_at":"2025-07-13T14:51:59Z","title":"Towards Concise and Adaptive Thinking in Large Reasoning Models: A Survey","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T17:53:45.466886Z"},"links":{"cited_paper":"/paper/2506.23840","citing_paper":"/paper/2507.09662"},"observation_digest":"sha256:45db7cdda692fec8cdb078c720e826b6f97a3f0a093c7fef4abded3bc8e83a7e","observation_id":"7f79b699-5894-46b6-a425-456a09a5a222","resolution":{"observed_at":"2026-08-06T17:53:45.466886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"cited_work":{"arxiv_id":"2506.23840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23840","snapshot_observed_at":"2026-07-04T10:39:45.836079Z","title":"emnlp-main.232/","venue":null,"work_id":"5c46ef72-c90c-4a57-892b-d0d41c19a029","year":2023},"citing_paper":{"arxiv_id":"2603.12529","last_updated":"2026-05-14T02:32:10Z","snapshot_observed_at":"2026-08-07T19:28:33.818488Z","submitted_at":"2026-03-13T00:07:18Z","title":"TERMINATOR: Learning Optimal Exit Points for Early Stopping in Chain-of-Thought Reasoning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T11:16:04.614045Z"},"links":{"cited_paper":"/paper/2506.23840","citing_paper":"/paper/2603.12529"},"observation_digest":"sha256:8ab3c6ffdc04f4ddbf587edc45fa3384d8c28d4b543f8003484084c527c46ccd","observation_id":"a17936e1-9119-4918-ba97-0e95ef17d1d8","resolution":{"observed_at":"2026-05-15T11:19:58.197620Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"cited_work":{"arxiv_id":"2506.23840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23840","snapshot_observed_at":"2026-07-04T10:39:45.836079Z","title":"emnlp-main.232/","venue":null,"work_id":"5c46ef72-c90c-4a57-892b-d0d41c19a029","year":2023},"citing_paper":{"arxiv_id":"2606.23181","last_updated":"2026-06-22T11:24:59Z","snapshot_observed_at":"2026-08-12T17:21:45.250298Z","submitted_at":"2026-06-22T11:24:59Z","title":"DART: Draft-Agreement Routing for Training-Free Adaptive Thinking Budgets in Hybrid Reasoning Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-26T08:35:36.580490Z"},"links":{"cited_paper":"/paper/2506.23840","citing_paper":"/paper/2606.23181"},"observation_digest":"sha256:424d23c4d264e6022c9ba52416ee73e746d28b6bd3dc72f3f2237a5a132e1ccf","observation_id":"03e1983f-45d2-498f-a342-ce74e15f612e","resolution":{"observed_at":"2026-07-04T10:39:45.837701Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23840","snapshot_observed_at":"2026-08-02T07:57:24.437765Z","title":"Do thinking tokens help or trap? Towards more efficient large reasoning models.arXiv preprint arXiv:2506.23840, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20524","last_updated":"2026-07-09T07:04:07Z","snapshot_observed_at":"2026-08-08T20:38:19.527006Z","submitted_at":"2026-07-09T07:04:07Z","title":"Attention Degradation, Function Token Anchoring, and the Limits of Attention-Based Intervention in Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T07:57:24.437765Z"},"links":{"cited_paper":"/paper/2506.23840","citing_paper":"/paper/2607.20524"},"observation_digest":"sha256:b289026b511308d162d8aa85bedb2de5d8b5fd8b58e5ae1fe1985b7f6c8a2b04","observation_id":"67fb104e-45fe-405a-bb69-05330d975857","resolution":{"observed_at":"2026-08-02T07:57:24.437765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.23840/citation-record","integrity":"/paper/2506.23840/integrity","json":"/paper/2506.23840/citation-record.json","paper":"/paper/2506.23840"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:06.743591Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:06.743591Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:9e08ece336607af34c16c3ff8125b1c47315b445925009a793e4d58e76d681d1","observation_id":"68208e15-b1b8-43ee-b6f1-51357d229694","resolution":{"observed_at":"2026-08-06T21:45:06.743591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:06.852222Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:06.852222Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:be649321761648d4ed102418386e323fae1a2b89f425e9d29c14a6169659d331","observation_id":"421e1458-fb18-4d8f-9a94-de25bac0f89f","resolution":{"observed_at":"2026-08-06T21:45:06.852222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-06T08:53:09.095000Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-06T21:45:06.919394Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:06.919394Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:d99b9f331b41855702c4832c9ef2d31e23853b1f972cfbc473eaa39c73a41d0d","observation_id":"2ceec2c4-6c8e-4bd7-9574-2c20eab7f3f3","resolution":{"observed_at":"2026-08-06T21:45:06.919394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:06.994065Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:06.994065Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:47f4ff36f50061ff998a38594902e8ab279a835ff5a79b95c81c5c0e89fd9a05","observation_id":"894e88e7-e63a-4937-b84f-7455b006b3cc","resolution":{"observed_at":"2026-08-06T21:45:06.994065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-06T21:45:07.152919Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:07.152919Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:33d90a0af015085b80c8043a9e0a905c8ee38ce54c743ab1e16f43b5d3440653","observation_id":"2bfbd6ec-86c4-4971-939e-3e10d12b2ef0","resolution":{"observed_at":"2026-08-06T21:45:07.152919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13260","last_updated":"2025-02-18T20:04:51Z","snapshot_observed_at":"2026-08-10T14:15:50.668871Z","submitted_at":"2025-02-18T20:04:51Z","title":"Stepwise Perplexity-Guided Refinement for Efficient Chain-of-Thought Reasoning in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13260","snapshot_observed_at":"2026-08-06T21:45:07.266788Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:07.266788Z"},"links":{"cited_paper":"/paper/2502.13260","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:1a0b36cd796a5f31025e117c5ea61ac3320fc5bc38e0fbc7c07d1f326a2fab40","observation_id":"6a1d8979-ccc5-46a8-9fa4-e5d23aadb2ba","resolution":{"observed_at":"2026-08-06T21:45:07.266788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T21:45:07.340144Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:07.340144Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:fa3715f2201e3dff8939c9b5113fa31af43d1af7a494503c0618a0259d6f9e68","observation_id":"b582f135-88a0-46b0-8295-7d6e1535d5f9","resolution":{"observed_at":"2026-08-06T21:45:07.340144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13379","last_updated":"2025-06-26T14:06:49Z","snapshot_observed_at":"2026-08-08T22:27:57.440955Z","submitted_at":"2025-05-19T17:24:16Z","title":"Thinkless: LLM Learns When to Think","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13379","snapshot_observed_at":"2026-08-06T21:45:07.494215Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:07.494215Z"},"links":{"cited_paper":"/paper/2505.13379","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:d5ffe314e32d6d9b682917bfe0740b952a702fc09d58fd298cfb6bb73ba913d8","observation_id":"65dfbec1-48ed-4253-ab04-18b7438fc778","resolution":{"observed_at":"2026-08-06T21:45:07.494215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:07.590372Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:07.590372Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:9ec594bc179d6f9c63c316ce8735b7409145e002a54b77e676505958e2f5eb57","observation_id":"62378c28-3e4b-4467-afec-69742671cfb7","resolution":{"observed_at":"2026-08-06T21:45:07.590372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20993","last_updated":"2025-05-27T16:41:53Z","snapshot_observed_at":"2026-08-12T17:14:32.746931Z","submitted_at":"2024-12-30T14:57:53Z","title":"Efficiently Scaling LLM Reasoning with Certaindex","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20993","snapshot_observed_at":"2026-08-06T21:45:07.680145Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:07.680145Z"},"links":{"cited_paper":"/paper/2412.20993","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:2e1263556ad3628977f1a3a05bcaf758d936c0aef14cd3f5c41fa1bb5f01c538","observation_id":"36d735ad-bb62-4f98-aa8a-decd1ec86a3c","resolution":{"observed_at":"2026-08-06T21:45:07.680145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14008","last_updated":"2024-06-06T13:19:44Z","snapshot_observed_at":"2026-08-03T03:39:09.398343Z","submitted_at":"2024-02-21T18:49:26Z","title":"OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14008","snapshot_observed_at":"2026-08-06T21:45:07.762813Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:07.762813Z"},"links":{"cited_paper":"/paper/2402.14008","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:74e225a5dd75e0422dc66a58577fb2a6947f434db9ae5a164a3fa8a3adab8f4a","observation_id":"2055cc70-f085-409e-aa56-6873f90f2ede","resolution":{"observed_at":"2026-08-06T21:45:07.762813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01296","last_updated":"2025-04-02T01:59:26Z","snapshot_observed_at":"2026-08-12T17:13:46.909910Z","submitted_at":"2025-04-02T01:59:26Z","title":"ThinkPrune: Pruning Long Chain-of-Thought of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01296","snapshot_observed_at":"2026-08-06T21:45:07.852716Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:07.852716Z"},"links":{"cited_paper":"/paper/2504.01296","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:e023db4fca75053a004fba7ec24f1bf80b73d3e9eaac4e47b83376ed34d902f4","observation_id":"79fd9077-b484-4b1b-be1b-0d43ea2e9216","resolution":{"observed_at":"2026-08-06T21:45:07.852716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:13.542398Z","title":null,"venue":null,"work_id":"30e61d78-a451-4c98-beef-d28bb005397b","year":2024},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:07.938560Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:f760636fd86a8ef4ada83551c6c1581b959fb98303a1fc02848e167c6b3a3eea","observation_id":"0a505b18-50cf-4cfd-9d9f-189b25d2b832","resolution":{"observed_at":"2026-08-06T21:45:13.597244Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:08.047039Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:08.047039Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:1bfd49a2c67040d58bb4a7988be7aa9edb2e3b0ed0c941e794653dfbeb06d347","observation_id":"8c057826-bba7-4086-adb9-9b7aa3aba305","resolution":{"observed_at":"2026-08-06T21:45:08.047039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.14858","last_updated":"2022-07-01T02:15:12Z","snapshot_observed_at":"2026-08-12T17:03:44.244933Z","submitted_at":"2022-06-29T18:54:49Z","title":"Solving Quantitative Reasoning Problems with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.14858","snapshot_observed_at":"2026-08-06T21:45:08.187391Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:08.187391Z"},"links":{"cited_paper":"/paper/2206.14858","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:d2eac973b1b101978dc9c4737d03a6c20ed680dc3933f00d9d321d7cc702ba0a","observation_id":"accf01ce-e8e2-4f4e-9c75-2fc42dac7d20","resolution":{"observed_at":"2026-08-06T21:45:08.187391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:08.291449Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:08.291449Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:cdc6d947b940981b58a9c51a16ee6c4d4392e2add80da4cbed4eace2b84d8ac3","observation_id":"04bdb2ff-b466-4a84-9723-ce3e06415f39","resolution":{"observed_at":"2026-08-06T21:45:08.291449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:13.368683Z","title":null,"venue":null,"work_id":"5ce3f4a4-9574-483d-8987-960288c0cc8f","year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:08.397150Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:5a7a03554d144db6c426167a128a9f2dd9fd1082b44e307f5996165aefc7bb99","observation_id":"82e1ed63-295b-4791-a5f1-075fb30300a1","resolution":{"observed_at":"2026-08-06T21:45:13.446604Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12570","last_updated":"2025-01-29T03:11:03Z","snapshot_observed_at":"2026-08-10T17:00:34.555363Z","submitted_at":"2025-01-22T01:35:11Z","title":"O1-Pruner: Length-Harmonizing Fine-Tuning for O1-Like Reasoning Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12570","snapshot_observed_at":"2026-08-06T21:45:08.644465Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:08.644465Z"},"links":{"cited_paper":"/paper/2501.12570","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:7d41b1190ba3a554af53829181ac2303cded929779a7c53482dcfe7f089db6c9","observation_id":"8aa770e4-3ca1-4026-b226-c9449e09faf9","resolution":{"observed_at":"2026-08-06T21:45:08.644465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09858","last_updated":"2025-04-14T04:08:16Z","snapshot_observed_at":"2026-08-08T01:06:59.135762Z","submitted_at":"2025-04-14T04:08:16Z","title":"Reasoning Models Can Be Effective Without Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09858","snapshot_observed_at":"2026-08-06T21:45:08.793932Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:08.793932Z"},"links":{"cited_paper":"/paper/2504.09858","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:12051a07921f150dc6ac1448114060db870f202f9aa2cd47950edbee1fc7a4e4","observation_id":"69ba4bbf-ba5c-4e8f-8187-0bb675177a5a","resolution":{"observed_at":"2026-08-06T21:45:08.793932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09601","last_updated":"2025-02-13T18:52:36Z","snapshot_observed_at":"2026-08-08T03:37:50.177168Z","submitted_at":"2025-02-13T18:52:36Z","title":"CoT-Valve: Length-Compressible Chain-of-Thought Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09601","snapshot_observed_at":"2026-08-06T21:45:08.905293Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:08.905293Z"},"links":{"cited_paper":"/paper/2502.09601","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:19cbe63778b00c205408624f8091a8ba65b1ebaa7198f5b2d9990a28b85cee24","observation_id":"485c7f5b-b443-4fd7-a2e7-27971216ecb2","resolution":{"observed_at":"2026-08-06T21:45:08.905293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-06T21:45:08.994279Z","title":"Cand \\` e s, and Tatsunori Hashimoto","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:08.994279Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:63a0fac0fde41090ed3cd87f46f6cfddd5252e3d6c767d1a30d397db7f300ab2","observation_id":"d2619f22-8a04-4696-a026-252a28c127be","resolution":{"observed_at":"2026-08-06T21:45:08.994279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-06T21:45:09.112403Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:09.112403Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:00faea13b17abdb4bd7c039257643a76098a9144afe4d45ebcfd4f0d7e876b20","observation_id":"1b8741ca-9107-4949-88fa-2f75d135840c","resolution":{"observed_at":"2026-08-06T21:45:09.112403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20122","last_updated":"2025-06-10T10:54:28Z","snapshot_observed_at":"2026-08-08T01:06:04.764010Z","submitted_at":"2025-02-27T14:14:50Z","title":"Self-Training Elicits Concise Reasoning in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20122","snapshot_observed_at":"2026-08-06T21:45:09.240076Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:09.240076Z"},"links":{"cited_paper":"/paper/2502.20122","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:703704a8657800586b433b7a3c0629ff28e10f4bbbf5451941751e77e98d56ab","observation_id":"7fe5da6d-ddba-4325-8c24-1e8d555b17f9","resolution":{"observed_at":"2026-08-06T21:45:09.240076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:13.206084Z","title":null,"venue":null,"work_id":"4d9f1bf8-27fb-45c4-9122-142be0ca28f4","year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:09.333193Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:57c770dc3db3dcd4284a19017600357fb5d69efbb289a42ba4cf645457a2e03b","observation_id":"a31720ba-98b2-4ee1-9e9f-9f6d7e704508","resolution":{"observed_at":"2026-08-06T21:45:13.275219Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:13.093104Z","title":null,"venue":null,"work_id":"9dcc6ad7-4e9d-42ab-be52-76455e1a4f86","year":2024},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:09.438164Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:a7da24b01d33c73d7fc69338834730e5898ec7dcde75382f6c472dc88cc8de23","observation_id":"40796972-6a4a-4a69-aa88-5373b11cf590","resolution":{"observed_at":"2026-08-06T21:45:13.139907Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02867","last_updated":"2025-06-04T15:00:58Z","snapshot_observed_at":"2026-08-08T18:19:35.851376Z","submitted_at":"2025-06-03T13:31:10Z","title":"Demystifying Reasoning Dynamics with Mutual Information: Thinking Tokens are Information Peaks in LLM Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02867","snapshot_observed_at":"2026-08-06T21:45:09.539739Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:09.539739Z"},"links":{"cited_paper":"/paper/2506.02867","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:4bc93c6616325c6890030bb7dbef406a950ed8d8ed189a7bbef2ee001fdb5354","observation_id":"a16f3062-2f13-4cae-ae75-08ac0a661d49","resolution":{"observed_at":"2026-08-06T21:45:09.539739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07572","last_updated":"2025-03-10T17:40:43Z","snapshot_observed_at":"2026-08-10T14:40:38.654692Z","submitted_at":"2025-03-10T17:40:43Z","title":"Optimizing Test-Time Compute via Meta Reinforcement Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07572","snapshot_observed_at":"2026-08-06T21:45:09.631754Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:09.631754Z"},"links":{"cited_paper":"/paper/2503.07572","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:d8328ce07872744e0fef7f0234a517095a40b895d808aa3bec573f9357ede778","observation_id":"41da26e3-4e5d-4fb3-8c07-362fc3b80f4f","resolution":{"observed_at":"2026-08-06T21:45:09.631754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:12.974566Z","title":null,"venue":null,"work_id":"bb05afea-21e4-4b6c-b827-856446de1af4","year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:09.716572Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:c8491215b22e22e58637838b88512b0e13187b36ce2d665c5af649b6385d9b9c","observation_id":"279663a4-a657-401e-9644-25a925020c9d","resolution":{"observed_at":"2026-08-06T21:45:13.035297Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T21:45:09.855990Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:09.855990Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:a8f60dea5ec61537d08fd09ea800d043791f8bed0245489dbf1b8046d9acc0e3","observation_id":"52a889f5-2ceb-4629-8bc0-34390fc13591","resolution":{"observed_at":"2026-08-06T21:45:09.855990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:09.978063Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:09.978063Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:ffe80fe1298e9d6a68ced6bc7c91ae92f95c2037c788a8777ad76f020fddaf29","observation_id":"755fddc9-6bb6-4304-be57-6143548e60bf","resolution":{"observed_at":"2026-08-06T21:45:09.978063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:10.067387Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.067387Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:566e6bf7a7e8faa628b42fba27cb30ee296ded95c6b6dff5c59232a92416ed5f","observation_id":"33f6c803-671d-4006-90bc-9d4e56765e4b","resolution":{"observed_at":"2026-08-06T21:45:10.067387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-06T21:45:10.173720Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.173720Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:e3cd262daf540b16aa3b043f3a99581e5c0a36afe65d01b347fd05646e0fcbe9","observation_id":"c194aa9c-c8f7-43fa-90f4-6bdb33150fc8","resolution":{"observed_at":"2026-08-06T21:45:10.173720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18298","last_updated":"2025-05-23T18:44:46Z","snapshot_observed_at":"2026-08-12T17:14:31.094371Z","submitted_at":"2025-05-23T18:44:46Z","title":"Thinking Fast and Right: Balancing Accuracy and Reasoning Length with Adaptive Rewards","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18298","snapshot_observed_at":"2026-08-06T21:45:10.270039Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.270039Z"},"links":{"cited_paper":"/paper/2505.18298","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:aa7b8261fe67fa28b37b171ae28687dd722a2ba0c0ded4c54ec5963241c564d8","observation_id":"d52c04d0-32e9-4730-b36a-609bd4a0a2d3","resolution":{"observed_at":"2026-08-06T21:45:10.270039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-11T13:10:23.709172Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-06T21:45:10.340851Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.340851Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:17afcfdee1dffa68eaacaa1fc1d40a8f4ff7b559ea0cd5a12546813b228f852f","observation_id":"5917b21d-e907-4223-9d63-eeaae4b7948c","resolution":{"observed_at":"2026-08-06T21:45:10.340851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-08-11T01:31:26.242281Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-06T21:45:10.436258Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.436258Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:0351917dadb9c0cf46e5f07d0f578279f7aaf3df3338083ef77d5c3973f1f7b8","observation_id":"ec8767f2-68f1-4ff4-a6de-5811ea073ebe","resolution":{"observed_at":"2026-08-06T21:45:10.436258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:10.527430Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.527430Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:5fdfd84f0029475f7e6d10fd8ef41bb53427774c8b49762242b6b1215ad0f32b","observation_id":"79264837-4518-4277-86d1-df1aae92f151","resolution":{"observed_at":"2026-08-06T21:45:10.527430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01939","last_updated":"2025-11-13T10:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-02T17:54:39Z","title":"Beyond the 80/20 Rule: High-Entropy Minority Tokens Drive Effective Reinforcement Learning for LLM Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01939","snapshot_observed_at":"2026-08-06T21:45:10.621366Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.621366Z"},"links":{"cited_paper":"/paper/2506.01939","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:b8ad4279377fc4b521b4fd4030f87243a85ea5579d7a9ea1f2c5ae6fb86c38c2","observation_id":"8d1f91d9-4df9-48bc-8cdc-80821d3e9df4","resolution":{"observed_at":"2026-08-06T21:45:10.621366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18585","last_updated":"2025-02-18T16:51:53Z","snapshot_observed_at":"2026-08-09T22:51:48.255703Z","submitted_at":"2025-01-30T18:58:18Z","title":"Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18585","snapshot_observed_at":"2026-08-06T21:45:10.787149Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.787149Z"},"links":{"cited_paper":"/paper/2501.18585","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:69defe042a689eae34582cb71b3322a6d5ae9dc351239845dadf953180b4ac66","observation_id":"3dfce824-a629-46ca-9da1-2e4a08c2e132","resolution":{"observed_at":"2026-08-06T21:45:10.787149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:10.859421Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.859421Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:0b7fc8d0d59e4b7e24f75972c4f931d0d2f49ccdb0d4a93ba5ccb5513b8516bd","observation_id":"08ce024a-be3d-4c97-b3cd-e3e98a347674","resolution":{"observed_at":"2026-08-06T21:45:10.859421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14945","last_updated":"2025-06-22T00:18:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-21T08:09:13Z","title":"Learning to Reason under Off-Policy Guidance","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14945","snapshot_observed_at":"2026-08-06T21:45:10.938994Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.938994Z"},"links":{"cited_paper":"/paper/2504.14945","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:9c11eb0d32b8b2bfbdbe2fb8872a265bc1e01271ceafd0ee893be0b774a72ee7","observation_id":"92a74131-c57e-44b9-a971-66f19d43b064","resolution":{"observed_at":"2026-08-06T21:45:10.938994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-06T21:45:11.037966Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.037966Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:92a73aa0d39bf033d6f20687a9487a12c7a6400d8d1dd090345797aa028427b2","observation_id":"7f3d562b-0297-4561-bb04-ccc41b59b4ba","resolution":{"observed_at":"2026-08-06T21:45:11.037966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:11.134582Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.134582Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:50a1614627e33ccfca522a1f34b6559915d12535b5a2fae9bc48378c316ad61b","observation_id":"872e2f79-4196-49bd-a6c9-38c28b369cb5","resolution":{"observed_at":"2026-08-06T21:45:11.134582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03234","last_updated":"2025-05-21T15:26:54Z","snapshot_observed_at":"2026-08-10T16:59:30.287515Z","submitted_at":"2025-04-04T07:34:01Z","title":"Think When You Need: Self-Adaptive Chain-of-Thought Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.03234","snapshot_observed_at":"2026-08-06T21:45:11.207138Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.207138Z"},"links":{"cited_paper":"/paper/2504.03234","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:e3afabf0429521373d0307d1475ab1005e32fccfea8698a8c1c43e4e2fb11eb4","observation_id":"db3e6b06-037f-4f10-b78a-d18a448964aa","resolution":{"observed_at":"2026-08-06T21:45:11.207138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02956","last_updated":"2025-04-03T18:22:20Z","snapshot_observed_at":"2026-08-09T23:33:43.014307Z","submitted_at":"2025-04-03T18:22:20Z","title":"Understanding Aha Moments: from External Observations to Internal Mechanisms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02956","snapshot_observed_at":"2026-08-06T21:45:11.280439Z","title":"Wong, and Di Wang","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.280439Z"},"links":{"cited_paper":"/paper/2504.02956","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:74d05c1e2130dbd26ef5b6c64ff7b52edbc745783026cc31fb43c62d833a0eac","observation_id":"05ed302e-0bbe-4534-99f0-626a5f61bc42","resolution":{"observed_at":"2026-08-06T21:45:11.280439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03373","last_updated":"2025-02-05T17:13:32Z","snapshot_observed_at":"2026-07-06T20:31:41.231839Z","submitted_at":"2025-02-05T17:13:32Z","title":"Demystifying Long Chain-of-Thought Reasoning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03373","snapshot_observed_at":"2026-08-06T21:45:11.371418Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.371418Z"},"links":{"cited_paper":"/paper/2502.03373","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:bc95bf1ef39f6618b7a06758d8c2aacfbae3cdf3b1ff6a96e542c76abe93e861","observation_id":"77eaa049-0bb4-4db0-b2fb-b5d018206285","resolution":{"observed_at":"2026-08-06T21:45:11.371418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06023","last_updated":"2024-07-24T18:40:36Z","snapshot_observed_at":"2026-08-10T13:49:27.550922Z","submitted_at":"2024-07-08T15:17:46Z","title":"Distilling System 2 into System 1","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06023","snapshot_observed_at":"2026-08-06T21:45:11.449407Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.449407Z"},"links":{"cited_paper":"/paper/2407.06023","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:e9ff7458beb9182872f31b238309134a3a6703366453aaed8fe40c5c74485a25","observation_id":"e70b2234-1390-42a5-bbde-9a331c05bdb6","resolution":{"observed_at":"2026-08-06T21:45:11.449407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-06T21:45:11.522799Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.522799Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:45c92e6e5ee2824e2f0c699413b4fb84d7a941549c8b1713307f26f3bf46eacb","observation_id":"4fbc789a-827c-4952-84db-831d9f418d9d","resolution":{"observed_at":"2026-08-06T21:45:11.522799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05118","last_updated":"2025-04-11T02:54:58Z","snapshot_observed_at":"2026-08-10T18:23:47.368788Z","submitted_at":"2025-04-07T14:21:11Z","title":"VAPO: Efficient and Reliable Reinforcement Learning for Advanced Reasoning Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05118","snapshot_observed_at":"2026-08-06T21:45:11.615470Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.615470Z"},"links":{"cited_paper":"/paper/2504.05118","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:2a5cc338737195c9daca65034a245bbcc83ff0639dff2e10ef0bb3a1fde63167","observation_id":"70018833-dd4f-4183-901f-6204e44b044d","resolution":{"observed_at":"2026-08-06T21:45:11.615470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18892","last_updated":"2025-08-06T08:42:32Z","snapshot_observed_at":"2026-07-06T20:57:57.039376Z","submitted_at":"2025-03-24T17:06:10Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18892","snapshot_observed_at":"2026-08-06T21:45:11.711313Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.711313Z"},"links":{"cited_paper":"/paper/2503.18892","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:409aee594a9a81951bad0faa1ec1d0cd940971740190bbd90c67cfb30cbf1311","observation_id":"56978212-369e-432f-9e87-27d9e39d2518","resolution":{"observed_at":"2026-08-06T21:45:11.711313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13417","last_updated":"2025-05-19T17:50:52Z","snapshot_observed_at":"2026-08-07T15:42:59.701048Z","submitted_at":"2025-05-19T17:50:52Z","title":"AdaptThink: Reasoning Models Can Learn When to Think","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13417","snapshot_observed_at":"2026-08-06T21:45:11.801215Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.801215Z"},"links":{"cited_paper":"/paper/2505.13417","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:6ee45b6caf281a61e920b6ca8bcd6207840edb72c1ddb85517f8f3b9146ed683","observation_id":"8ae70e2a-a1d2-4824-8f88-39f0a119d810","resolution":{"observed_at":"2026-08-06T21:45:11.801215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05132","last_updated":"2025-03-10T01:52:08Z","snapshot_observed_at":"2026-08-11T02:58:52.773885Z","submitted_at":"2025-03-07T04:21:47Z","title":"R1-Zero's \"Aha Moment\" in Visual Reasoning on a 2B Non-SFT Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05132","snapshot_observed_at":"2026-08-06T21:45:11.904232Z","title":"aha moment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.904232Z"},"links":{"cited_paper":"/paper/2503.05132","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:496cba2200afd3ebfeb9ce300239ddcabcb5c1a9bdef5a2cad8ea08aada32728","observation_id":"8fdd2d37-cf37-4fd9-b1ae-8ceaec1e1fce","resolution":{"observed_at":"2026-08-06T21:45:11.904232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T15:11:41.836176Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 5 inbound Pith citation observations for arXiv:2506.23840."}