{"as_of":"2026-08-13T23:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:65d92a8a79aa424e3b6aaec12806af72c942c300cc9250da2142d3f0f37d3162","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T13:51:53.735735Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T10:21:39.892271Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T10:25:26.719523Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"cited_work":{"arxiv_id":"2509.24560","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.24560","snapshot_observed_at":"2026-08-04T02:23:30.228809Z","title":"AdaThink-Med: Medical Adaptive Thinking with Uncertainty-Guided Length Calibration.arXiv preprint arXiv:2509.24560.2025","venue":null,"work_id":"13e39898-48dd-4b70-88ce-24f85edad137","year":2025},"citing_paper":{"arxiv_id":"2604.08559","last_updated":"2026-03-17T09:03:09Z","snapshot_observed_at":"2026-08-07T20:04:32.737155Z","submitted_at":"2026-03-17T09:03:09Z","title":"Medical Reasoning with Large Language Models: A Survey and MR-Bench","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-15T10:21:39.892271Z"},"links":{"cited_paper":"/paper/2509.24560","citing_paper":"/paper/2604.08559"},"observation_digest":"sha256:c7343fe9d6cca495b69309b34c153eff8883df61bf7252684c67c31207b9cfd9","observation_id":"44a02140-88b8-4300-9753-7e77f7822a19","resolution":{"observed_at":"2026-08-04T02:23:30.228809Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.24560/citation-record","integrity":"/paper/2509.24560/integrity","json":"/paper/2509.24560/citation-record.json","paper":"/paper/2509.24560"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.16827","last_updated":"2024-08-02T17:59:31Z","snapshot_observed_at":"2026-08-13T04:09:47.874806Z","submitted_at":"2024-02-26T18:54:35Z","title":"A Survey on Data Selection for Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16827","snapshot_observed_at":"2026-08-04T13:51:50.059178Z","title":"A survey on data selection for language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.059178Z"},"links":{"cited_paper":"/paper/2402.16827","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:58096df5b9ed9af1a9c467d95fdceed2433257374838c6cde443340e284577d9","observation_id":"922ad072-4c67-42f5-8c4a-1512466e6322","resolution":{"observed_at":"2026-08-04T13:51:50.059178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14779","last_updated":"2024-04-23T06:36:21Z","snapshot_observed_at":"2026-08-13T00:24:05.435627Z","submitted_at":"2024-04-23T06:36:21Z","title":"Med42 -- Evaluating Fine-Tuning Strategies for Medical LLMs: Full-Parameter vs. Parameter-Efficient Approaches","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14779","snapshot_observed_at":"2026-08-04T13:51:50.297036Z","title":"Med42–evaluating fine-tuning strategies for medical llms: Full-parameter vs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.297036Z"},"links":{"cited_paper":"/paper/2404.14779","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:3bc3a2f0ded753602d575d17e017a2cc7e624a28e29e43c16c38ff1029934b18","observation_id":"30d45229-6fff-496e-af92-2b2607f70dcb","resolution":{"observed_at":"2026-08-04T13:51:50.297036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22617","last_updated":"2025-05-28T17:38:45Z","snapshot_observed_at":"2026-08-12T12:02:17.912725Z","submitted_at":"2025-05-28T17:38:45Z","title":"The Entropy Mechanism of Reinforcement Learning for Reasoning Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22617","snapshot_observed_at":"2026-08-04T13:51:50.396802Z","title":"The entropy mechanism of reinforcement learning for reasoning language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.396802Z"},"links":{"cited_paper":"/paper/2505.22617","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:a02807d97af286d8aeb78362c2582499194f29943bfcba8e1bdccb11517c4d74","observation_id":"fd743735-2306-447b-b3c1-165f3c32dc0f","resolution":{"observed_at":"2026-08-04T13:51:50.396802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-04T13:51:50.482050Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.482050Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:17cbe134839eb2430d657257c0e740459ee08404dbe24cf4cfe7a9109a83b0e6","observation_id":"5266221d-fa61-4e21-82f5-9dee55eb3905","resolution":{"observed_at":"2026-08-04T13:51:50.482050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13379","last_updated":"2025-06-26T14:06:49Z","snapshot_observed_at":"2026-08-08T22:27:57.440955Z","submitted_at":"2025-05-19T17:24:16Z","title":"Thinkless: LLM Learns When to Think","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13379","snapshot_observed_at":"2026-08-04T13:51:50.649862Z","title":"Thinkless: Llm learns when to think.arXiv preprint arXiv:2505.13379,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.649862Z"},"links":{"cited_paper":"/paper/2505.13379","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:1dbfcdc2081047e3033a276b4d5ddc0023ea32197e81bf547101e9d90f5aa025","observation_id":"2e8f611a-3ac5-4afd-8c0b-aa806a81f98f","resolution":{"observed_at":"2026-08-04T13:51:50.649862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-04T13:51:50.776381Z","title":"Deepseek-coder: When the large language model meets programming–the rise of code intelligence","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.776381Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:957afd0f96d129ff27165858a81101295eff1af5fdf5e6da75171d445995edd3","observation_id":"fca865c3-3576-46df-9976-e2105df64380","resolution":{"observed_at":"2026-08-04T13:51:50.776381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T15:58:13.809876Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-04T13:51:50.914512Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.914512Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:b1fbb45aff1edbc89414f671cc3f568a658344f5c05e037bdd9b9c133c3dd563","observation_id":"33060816-e11f-426d-9e8f-069aead883ba","resolution":{"observed_at":"2026-08-04T13:51:50.914512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:51.018330Z","title":"m1: Unleash the po- tential of test-time scaling for medical reasoning with large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.018330Z"},"links":{"citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:e3d96c1c1f1014ea6fe17513ef8c049b0f16566f7aa2cb387c5ddb4c158d1ea3","observation_id":"a7d53ba7-2286-4434-ad74-83ce11f94fe8","resolution":{"observed_at":"2026-08-04T13:51:51.018330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14631","last_updated":"2025-05-21T05:17:34Z","snapshot_observed_at":"2026-08-12T04:30:40.905231Z","submitted_at":"2025-05-20T17:23:25Z","title":"Think Only When You Need with Large Hybrid-Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14631","snapshot_observed_at":"2026-08-04T13:51:51.270386Z","title":"Think only when you need with large hybrid-reasoning models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.270386Z"},"links":{"cited_paper":"/paper/2505.14631","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:2bcdd74f3ca1ba563630713412443b02c413373c00e90c6871f90a83148c7829","observation_id":"8c09e99f-430d-41c8-82e7-a477716cc7bd","resolution":{"observed_at":"2026-08-04T13:51:51.270386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09858","last_updated":"2025-04-14T04:08:16Z","snapshot_observed_at":"2026-08-08T01:06:59.135762Z","submitted_at":"2025-04-14T04:08:16Z","title":"Reasoning Models Can Be Effective Without Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09858","snapshot_observed_at":"2026-08-04T13:51:51.648270Z","title":"Reasoning models can be effective without thinking","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.648270Z"},"links":{"cited_paper":"/paper/2504.09858","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:f2f29b93c855b98440afffebae7c529662371f00f5994dca19ce342eeb784a54","observation_id":"a4c2c11c-1d38-4049-bf6f-06ab8a2860cd","resolution":{"observed_at":"2026-08-04T13:51:51.648270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19213","last_updated":"2025-05-25T16:20:55Z","snapshot_observed_at":"2026-08-13T12:46:07.564539Z","submitted_at":"2025-05-25T16:20:55Z","title":"Improving Medical Reasoning with Curriculum-Aware Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19213","snapshot_observed_at":"2026-08-04T13:51:51.711834Z","title":"Improving medical reasoning with curriculum-aware reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.711834Z"},"links":{"cited_paper":"/paper/2505.19213","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:7367e596ef55d0421cfed937906d7ad95d3f2995fd6e729486715b10325aa6c7","observation_id":"0bd09e0e-b0e5-45bf-b46e-894236e74223","resolution":{"observed_at":"2026-08-04T13:51:51.711834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-04T13:51:51.776607Z","title":"Hybridflow: A flexible and efficient rlhf framework","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.776607Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:593101c6ddac03a588e0ae9ba972744bba21641792fc5180ca0e680d1f0ec7d2","observation_id":"bcd48595-4c86-4765-b9f2-3cda53c2f0af","resolution":{"observed_at":"2026-08-04T13:51:51.776607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00127","last_updated":"2025-04-30T18:48:06Z","snapshot_observed_at":"2026-08-07T17:34:13.816265Z","submitted_at":"2025-04-30T18:48:06Z","title":"Between Underthinking and Overthinking: An Empirical Study of Reasoning Length and correctness in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00127","snapshot_observed_at":"2026-08-04T13:51:51.857140Z","title":"Between underthinking and over- thinking: An empirical study of reasoning length and correctness in llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.857140Z"},"links":{"cited_paper":"/paper/2505.00127","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:2504168e651f67ce15e25c2f4c797079cba6b6ee16004178d9993c485320f030","observation_id":"f0f0c9d7-f15a-49cc-9b7f-36650c6952a0","resolution":{"observed_at":"2026-08-04T13:51:51.857140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-11T13:10:23.709172Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-04T13:51:51.922247Z","title":"Stop overthinking: A survey on efficient reasoning for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.922247Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:bfe1c2660a811b66a22faa0bd9738e8c354f09d38e6aa11eeed644577beefffb","observation_id":"783d7d7c-7c2a-461f-8d05-dcfcca2d6359","resolution":{"observed_at":"2026-08-04T13:51:51.922247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-04T13:51:52.010093Z","title":"Challenging big-bench tasks and whether chain-of-thought can solve them","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:52.010093Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:9704db9a369a179dbdd0c5ec6cccdae0871acda39c7ab8ce6197b6869204d715","observation_id":"8cc402e8-7787-4cd6-9349-0bb726f4555f","resolution":{"observed_at":"2026-08-04T13:51:52.010093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-04T13:51:52.318666Z","title":"The Register","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:52.318666Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:9d776758ecf526aec5a3ec99fdf635fb9a2655ef76f1e424c6dc3293ed66c451","observation_id":"2f8823e5-dc40-4a55-a6c0-9dfdba1744d5","resolution":{"observed_at":"2026-08-04T13:51:52.318666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:52.468526Z","title":"Accessed: 2025-08-27","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:52.468526Z"},"links":{"citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:f5fa925ce1733541c86aed8385a29803c1c368a6f968e5b0f98e76016ed4c109","observation_id":"116c1347-5771-4556-b7d3-49133bb87a73","resolution":{"observed_at":"2026-08-04T13:51:52.468526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01939","last_updated":"2025-11-13T10:08:29Z","snapshot_observed_at":"2026-08-13T06:08:42.070209Z","submitted_at":"2025-06-02T17:54:39Z","title":"Beyond the 80/20 Rule: High-Entropy Minority Tokens Drive Effective Reinforcement Learning for LLM Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01939","snapshot_observed_at":"2026-08-04T13:51:52.645620Z","title":"Beyond the 80/20 rule: High-entropy minority tokens drive effective reinforcement learning for llm reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:52.645620Z"},"links":{"cited_paper":"/paper/2506.01939","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:4eb982f30013e66db9e8cb764ff26a62e69be5f86459ce5b6e1f02a46e3d8daa","observation_id":"f41295f0-6db1-4c41-82cb-06a6dea3396e","resolution":{"observed_at":"2026-08-04T13:51:52.645620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:52.821261Z","title":"Fast-slow thinking for large vision-language model reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:52.821261Z"},"links":{"citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:d8d420a8ad2830467a24a77a70d489b6115b0c8dc55a84747eaf18963ab4d34c","observation_id":"27faa2da-ce88-4f1d-a4a1-8709feb360ab","resolution":{"observed_at":"2026-08-04T13:51:52.821261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03373","last_updated":"2025-02-05T17:13:32Z","snapshot_observed_at":"2026-07-06T20:31:41.231839Z","submitted_at":"2025-02-05T17:13:32Z","title":"Demystifying Long Chain-of-Thought Reasoning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03373","snapshot_observed_at":"2026-08-04T13:51:52.967619Z","title":"Demystifying long chain- of-thought reasoning in llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:52.967619Z"},"links":{"cited_paper":"/paper/2502.03373","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:652392c119110c2cdbf591fde06e4dcc0a9cf3bc38753644485c201a454e73f4","observation_id":"75116ecc-157f-444d-b5b5-7e262081b07d","resolution":{"observed_at":"2026-08-04T13:51:52.967619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:53.126651Z","title":"Shorterbetter: Guiding reasoning models to find optimal inference length for efficient reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:53.126651Z"},"links":{"citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:ec78e6f1aa68a311bbe8549949c751fc1486d0300290c045a7f58dc25197290a","observation_id":"5bbc0ded-7347-4b2b-9298-8d347de07266","resolution":{"observed_at":"2026-08-04T13:51:53.126651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-04T13:51:53.189476Z","title":"Dapo: An open-source llm reinforcement learning system at scale","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:53.189476Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:8737d99384b6e7cdd3fe86dd4d57ab38be2ea4f5e4af41d93b176727eee4061b","observation_id":"c2da83b1-c134-43a4-8ab3-d97d194d2423","resolution":{"observed_at":"2026-08-04T13:51:53.189476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02822","last_updated":"2025-07-03T17:33:58Z","snapshot_observed_at":"2026-08-09T13:13:38.991968Z","submitted_at":"2025-07-03T17:33:58Z","title":"SynapseRoute: An Auto-Route Switching Framework on Dual-State Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02822","snapshot_observed_at":"2026-08-04T13:51:53.281207Z","title":"Synapseroute: An auto-route switching framework on dual-state large language model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:53.281207Z"},"links":{"cited_paper":"/paper/2507.02822","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:6055e4f5e085ccf98fea90a0fc2251551eea347cdbb14030f97c11bf42bfcbfe","observation_id":"d2718a06-1da7-4923-98ca-ca53e307e5ba","resolution":{"observed_at":"2026-08-04T13:51:53.281207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10625","last_updated":"2023-04-16T22:08:08Z","snapshot_observed_at":"2026-08-06T09:00:42.886249Z","submitted_at":"2022-05-21T15:34:53Z","title":"Least-to-Most Prompting Enables Complex Reasoning in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10625","snapshot_observed_at":"2026-08-04T13:51:53.388873Z","title":"Least-to-most prompting enables complex reasoning in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:53.388873Z"},"links":{"cited_paper":"/paper/2205.10625","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:d7150e8d2e9d00de9ce1ea3148e8ab33af3a1a7f84693e5faf431180926a7a0d","observation_id":"54401410-eca4-484e-9f6d-0e7565e33f64","resolution":{"observed_at":"2026-08-04T13:51:53.388873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18362","last_updated":"2025-06-06T13:00:07Z","snapshot_observed_at":"2026-08-10T06:07:52.030350Z","submitted_at":"2025-01-30T14:07:56Z","title":"MedXpertQA: Benchmarking Expert-Level Medical Reasoning and Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18362","snapshot_observed_at":"2026-08-04T13:51:53.456752Z","title":"Medxpertqa: Benchmarking expert-level medical reasoning and understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:53.456752Z"},"links":{"cited_paper":"/paper/2501.18362","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:8451fc05a90f93739c6941b7fa738ffe575641b5906264b96ef7116df73045bb","observation_id":"00f9f1d0-c640-4be0-9a55-37921d3b8350","resolution":{"observed_at":"2026-08-04T13:51:53.456752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:53.533804Z","title":"equation 1, both critic-based reinforcement learning methods (e.g., PPO) and critic-free methods (e.g., GRPO (Guo et al., 2024)) can be applied","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:53.533804Z"},"links":{"citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:e861557fc2dcb8587f635999c9f83a5e23e08c49c4f5ea6fcdff579d9c7ed32c","observation_id":"cbfecd7f-ffe6-450f-83cf-ee5b3699b4d2","resolution":{"observed_at":"2026-08-04T13:51:53.533804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:53.643148Z","title":"We adopt the Qwen2.5 (Team, 2024)-7B-Instruct model and LLama3.1-Instruct-8B as the backbone models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:53.643148Z"},"links":{"citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:199f11675427149f1354430b035e98ddf378f08614ce84dc2f41e050dc5bf48f","observation_id":"a3f04f27-be85-4d8c-9fb5-5a78592fc2aa","resolution":{"observed_at":"2026-08-04T13:51:53.643148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:53.735735Z","title":"yes,” “no,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:53.735735Z"},"links":{"citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:4c28e4ae088884e2ae9b9171464a71c58c237a9eaea430de2cc76c7dcf14b095","observation_id":"c073a16e-c6ef-46f2-9ddc-1755248b4ad8","resolution":{"observed_at":"2026-08-04T13:51:53.735735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.06146","last_updated":"2019-09-13T11:18:20Z","snapshot_observed_at":"2026-08-13T18:54:55.815938Z","submitted_at":"2019-09-13T11:18:20Z","title":"PubMedQA: A Dataset for Biomedical Research Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.06146","snapshot_observed_at":"2026-08-04T13:51:51.444910Z","title":"Pubmedqa: A dataset for biomedical research question answering","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.444910Z"},"links":{"cited_paper":"/paper/1909.06146","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:97393a5ba057d18710085ac77415a47bd490c0edd18645691d3633a0f8224575","observation_id":"f40bbd7b-2d7a-4870-af83-93f39ed0cb35","resolution":{"observed_at":"2026-08-04T13:51:51.444910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-08-11T01:31:26.242281Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-04T13:51:52.132024Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:52.132024Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:57e923b69829fb58e627198c6214d3bcebd5e303337a4e7d376367f699af8e69","observation_id":"1edd9de9-3563-4cfd-909c-e5cc69260978","resolution":{"observed_at":"2026-08-04T13:51:52.132024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-13T20:12:43.724375Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17952","snapshot_observed_at":"2026-08-04T13:51:51.561726Z","title":"Beyond distillation: Pushing the limits of medical llm reasoning with minimalist rule-based rl","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.561726Z"},"links":{"cited_paper":"/paper/2505.17952","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:f6c50c699b67a342b6d389ee4e758962c71547887ca8951eb88c9f99eba86308","observation_id":"cb402813-c124-4aaa-ad62-52804fb69d88","resolution":{"observed_at":"2026-08-04T13:51:51.561726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-08-13T03:17:19.241729Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-04T13:51:50.125223Z","title":"Language models are hidden reasoners: Unlock- ing latent reasoning capabilities via self-rewarding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.125223Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:2798fe01215df81669371ed1bfe11bfa692ddaf5a8b076da1d8fa7cc3957531a","observation_id":"d5bd85dc-7ea3-422f-b2ec-095d848a1e5d","resolution":{"observed_at":"2026-08-04T13:51:50.125223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-04T13:51:50.210041Z","title":"Do not think that much for 2+ 3=? on the overthinking of o1-like llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.210041Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:d718ee6fa1e04a2b738059288e17c975f16a9f66dd038649ad5234af264cbb6d","observation_id":"a1d07536-eda7-4e9c-b93f-4a5bbdd0edfc","resolution":{"observed_at":"2026-08-04T13:51:50.210041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T12:25:57.234001Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:2509.24560."}