{"as_of":"2026-08-18T12:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5e54e7eb22de86db6b361131e60ce16ab7d47fee0c4086a3ef7055d361e02cf4","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:57:03.154623Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:54:17.268192Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T05:08:13.018927Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12353","snapshot_observed_at":"2026-08-06T17:54:17.268192Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09662","last_updated":"2025-07-13T14:51:59Z","snapshot_observed_at":"2026-08-15T08:55:38.744613Z","submitted_at":"2025-07-13T14:51:59Z","title":"Towards Concise and Adaptive Thinking in Large Reasoning Models: A Survey","version":1},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-08-06T17:54:17.268192Z"},"links":{"cited_paper":"/paper/2506.12353","citing_paper":"/paper/2507.09662"},"observation_digest":"sha256:5c12a77653273843047d860a463032490bab0e2fdaafda8c365405c06ce1dbff","observation_id":"1f079f2a-4ea7-4138-ba71-ce9121d3e50f","resolution":{"observed_at":"2026-08-06T17:54:17.268192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12353","snapshot_observed_at":"2026-08-06T12:26:11.159006Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21848","last_updated":"2025-07-29T14:23:58Z","snapshot_observed_at":"2026-08-17T10:41:25.212329Z","submitted_at":"2025-07-29T14:23:58Z","title":"EDGE-GRPO: Entropy-Driven GRPO with Guided Error Correction for Advantage Diversity","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:11.159006Z"},"links":{"cited_paper":"/paper/2506.12353","citing_paper":"/paper/2507.21848"},"observation_digest":"sha256:9bf77c1d9c35190050542f159c4a35e4641845d4ab7de468ef13745c54b91090","observation_id":"d77ac373-6e99-49ab-a72e-7a0cf74997cd","resolution":{"observed_at":"2026-08-06T12:26:11.159006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12353","snapshot_observed_at":"2026-08-06T05:14:37.153107Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02178","last_updated":"2026-06-29T02:19:28Z","snapshot_observed_at":"2026-08-14T11:46:27.446308Z","submitted_at":"2025-08-04T08:22:14Z","title":"Reconsidering Overthinking: Penalizing Internal and External Redundancy in CoT Reasoning","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T05:14:37.153107Z"},"links":{"cited_paper":"/paper/2506.12353","citing_paper":"/paper/2508.02178"},"observation_digest":"sha256:485e984331d205b3f62c42910315e531fd6b8e8566f5d0dbb1c72685fd0a7b1d","observation_id":"4541c878-3b5e-4085-b2f0-5ec5b33425ca","resolution":{"observed_at":"2026-08-06T05:14:37.153107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"cited_work":{"arxiv_id":"2506.12353","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12353","snapshot_observed_at":"2026-08-06T05:08:13.018927Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","venue":"cs.CL","work_id":"fabd6448-6a85-4741-9d54-4f5fa5f6c36b","year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-15T07:14:07.547538Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.593722Z"},"links":{"cited_paper":"/paper/2506.12353","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:43bac8d454ac9d4f3ee1e0879948c699ce46064d48349267f8f641c75d9eb6e2","observation_id":"a2230aad-aa95-4a74-98f9-df858b7527ff","resolution":{"observed_at":"2026-08-06T05:08:13.098887Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.12353/citation-record","integrity":"/paper/2506.12353/integrity","json":"/paper/2506.12353/citation-record.json","paper":"/paper/2506.12353"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:04.242300Z","title":"Wait\" in Other Reflections (Histogram)","venue":null,"work_id":"7b807e96-5ec4-4b8b-9036-9c88eee8fa5c","year":2000},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:03.154623Z"},"links":{"citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:c3e0e4306780c9b282a591d89409c628f990a6d31be2d652790b218aa8dd248d","observation_id":"efda38cc-9166-42c5-b52f-0f59396ffd0d","resolution":{"observed_at":"2026-08-07T00:57:04.334734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:00.052406Z","title":"Seal: Steer- able reasoning calibration of large language models for free","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:00.052406Z"},"links":{"citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:bbf93ee5b5c1cfc1d46b6ced6a34fe3b8be868527e9faec57684b9b551c63c37","observation_id":"e6b00f0d-f032-41c0-803b-733c20761a23","resolution":{"observed_at":"2026-08-07T00:57:00.052406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13171","last_updated":"2024-12-17T18:50:33Z","snapshot_observed_at":"2026-08-13T23:47:35.674752Z","submitted_at":"2024-12-17T18:50:33Z","title":"Compressed Chain of Thought: Efficient Reasoning Through Dense Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13171","snapshot_observed_at":"2026-08-07T00:57:00.197987Z","title":"Compressed chain of thought: Efficient reasoning through dense representations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:00.197987Z"},"links":{"cited_paper":"/paper/2412.13171","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:59e1b640da8e310fdfc6363d22624b9dd8d934eef7a2d270d95fc9c007adc024","observation_id":"e36f406b-a0ca-4c4a-b070-6bcdb6009392","resolution":{"observed_at":"2026-08-07T00:57:00.197987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13284","last_updated":"2025-06-19T22:52:45Z","snapshot_observed_at":"2026-08-16T13:08:32.519541Z","submitted_at":"2024-10-17T07:28:18Z","title":"Learning to Route LLMs with Confidence Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13284","snapshot_observed_at":"2026-08-07T00:57:00.438993Z","title":"Learning to route Ilms with confidence tokens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:00.438993Z"},"links":{"cited_paper":"/paper/2410.13284","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:f96c1ae846de381170dae63f3f383d154b9cd4ed1d1a1d9a5bde3efcf27b8a65","observation_id":"397bcf4d-18c5-4835-93d0-9c2adc0f5c23","resolution":{"observed_at":"2026-08-07T00:57:00.438993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T00:57:00.577386Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:00.577386Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:bdbadf6708dc6364d755b6bfebfe2a69981683edc403a977ccc046fbfc4b6502","observation_id":"72a3cc84-c919-4ced-afc7-3208403108cb","resolution":{"observed_at":"2026-08-07T00:57:00.577386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17674","last_updated":"2025-04-24T15:45:05Z","snapshot_observed_at":"2026-08-18T02:14:14.397027Z","submitted_at":"2025-04-24T15:45:05Z","title":"Energy Considerations of Large Language Model Inference and Efficiency Optimizations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17674","snapshot_observed_at":"2026-08-07T00:57:00.675817Z","title":"Energy considerations of large language model inference and efficiency optimizations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:00.675817Z"},"links":{"cited_paper":"/paper/2504.17674","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:4a2a64d5a28fc6edb36b158c4a285f1c48a742ff526ee9e4d517353e3aa926fe","observation_id":"f6ef9b75-2a1c-41b8-abfb-c2d8948ced19","resolution":{"observed_at":"2026-08-07T00:57:00.675817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T00:57:00.793462Z","title":"Deepseek-r1: Incentivizing reasoning capability in Ilms via reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:00.793462Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:d85fc997ca3da6058b9eadc8e2caa21d620b1ae28441d22fe840d1fc0f4fb708","observation_id":"2868b520-08d4-43e3-9859-6a7696800926","resolution":{"observed_at":"2026-08-07T00:57:00.793462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06769","last_updated":"2025-11-03T00:53:34Z","snapshot_observed_at":"2026-08-17T06:12:37.525438Z","submitted_at":"2024-12-09T18:55:56Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06769","snapshot_observed_at":"2026-08-07T00:57:00.888079Z","title":"Training large language models to reason in a continuous latent space","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:00.888079Z"},"links":{"cited_paper":"/paper/2412.06769","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:c3bc8770de30e32789b37a93cf2ed927f4e2ccc7c94ca226d4392ec60e7b3e51","observation_id":"13ac8a10-ecab-42e7-9494-faeda2d61281","resolution":{"observed_at":"2026-08-07T00:57:00.888079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-07T00:57:01.028410Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.028410Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:87845caef6a05eb4f312f6e6943a559ae5297b3c5bef916febd46889cd7400fc","observation_id":"9b2cb594-fddf-47fe-9803-d5488f6b9f34","resolution":{"observed_at":"2026-08-07T00:57:01.028410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:01.196512Z","title":"A sober look at progress in language model reasoning: Pitfalls and paths to reproducibility","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.196512Z"},"links":{"citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:49bb3a7d2174f24978351e1c68e70bdd1384f4381d53f43bdc109ad009103b9a","observation_id":"c7ff2f05-6389-4dbb-b7e1-f44596601200","resolution":{"observed_at":"2026-08-07T00:57:01.196512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T00:57:01.343042Z","title":"Openai ol system card","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.343042Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:37ce38945c6901319296980146024c3ca1a2db13f2d9ecee704bb1f317d8f7e4","observation_id":"204eef23-37b0-44b8-82ac-39413befa5bf","resolution":{"observed_at":"2026-08-07T00:57:01.343042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-17T16:48:59.674177Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-07T00:56:59.729310Z","title":"L1: Controlling how long a reasoning model thinks with reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:59.729310Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:b5f2345cf40b5c134fda510f81c857f623c260e1f481721555208febe8dcc81d","observation_id":"327ab32a-9d85-4380-a2d6-a769e79a3bad","resolution":{"observed_at":"2026-08-07T00:56:59.729310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19324","last_updated":"2025-06-26T03:14:46Z","snapshot_observed_at":"2026-08-18T12:33:04.555555Z","submitted_at":"2025-01-31T17:19:57Z","title":"Reward-Guided Speculative Decoding for Efficient LLM Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19324","snapshot_observed_at":"2026-08-07T00:57:01.524906Z","title":"Reward-guided speculative decoding for efficient Ilm reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.524906Z"},"links":{"cited_paper":"/paper/2501.19324","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:862292bb895827b156ec0607fefd95fb50b8b591e17dcde3cc98294b65a946b3","observation_id":"35cbcd96-7426-4654-aa51-2ea55b5f6645","resolution":{"observed_at":"2026-08-07T00:57:01.524906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-17T09:42:34.746112Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-07T00:57:01.616179Z","title":"Let’s verify step by step","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.616179Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:1e50104e6d2e2aa9b40aaad4c1961acbb605b5c09075b1a358006a278e3f46ba","observation_id":"57cd6c8d-000d-43fb-bb29-094a617b1b8a","resolution":{"observed_at":"2026-08-07T00:57:01.616179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T00:57:01.731517Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.731517Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:2cb87890de1c727b089669124d2a3e004c221b20efe8ce86675c0aa0d616711a","observation_id":"9b97c33a-6f80-4a36-adb1-820a1be15ce0","resolution":{"observed_at":"2026-08-07T00:57:01.731517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12570","last_updated":"2025-01-29T03:11:03Z","snapshot_observed_at":"2026-08-18T10:17:24.497798Z","submitted_at":"2025-01-22T01:35:11Z","title":"O1-Pruner: Length-Harmonizing Fine-Tuning for O1-Like Reasoning Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12570","snapshot_observed_at":"2026-08-07T00:57:01.802457Z","title":"Ol-pruner: Length-harmonizing fine-tuning for ol-like reasoning pruning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.802457Z"},"links":{"cited_paper":"/paper/2501.12570","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:3eed4c03bd6077c0aa17bae8f39c438b56c3d92777e87fc8fc9ca8e0ef1c671a","observation_id":"893a0317-102c-414f-aeef-2b8255072ca4","resolution":{"observed_at":"2026-08-07T00:57:01.802457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09601","last_updated":"2025-02-13T18:52:36Z","snapshot_observed_at":"2026-08-15T01:40:51.444222Z","submitted_at":"2025-02-13T18:52:36Z","title":"CoT-Valve: Length-Compressible Chain-of-Thought Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09601","snapshot_observed_at":"2026-08-07T00:57:01.899387Z","title":"Cot-valve: Length-compressible chain-of-thought tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.899387Z"},"links":{"cited_paper":"/paper/2502.09601","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:94a5b5e4d34359c983a45d33760ade9d1e5d386e4ba64856bf274098c0f0d4ba","observation_id":"459f3269-43bb-4e78-b012-2ff194e9a503","resolution":{"observed_at":"2026-08-07T00:57:01.899387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-08-17T11:00:39.333660Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T00:57:01.996853Z","title":"sl: Simple test-time scaling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.996853Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:e166d02196f1d3011a43a167174fccf6052450ee7db73d7b4286261778f1d07a","observation_id":"298e63dd-70e3-4e09-bf71-442f19579d46","resolution":{"observed_at":"2026-08-07T00:57:01.996853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15758","last_updated":"2024-04-24T09:30:00Z","snapshot_observed_at":"2026-08-18T06:15:55.315332Z","submitted_at":"2024-04-24T09:30:00Z","title":"Let's Think Dot by Dot: Hidden Computation in Transformer Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15758","snapshot_observed_at":"2026-08-07T00:57:02.090047Z","title":"Let’s think dot by dot: Hidden computation in transformer language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.090047Z"},"links":{"cited_paper":"/paper/2404.15758","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:30b2e6bdfcca2c5fc88cc338d01bc109892547ef624675d93976edcb65b23788","observation_id":"20782098-b0fb-492a-abd4-0c5c67f22e62","resolution":{"observed_at":"2026-08-07T00:57:02.090047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:02.179776Z","title":"A survey of efficient reasoning for large reasoning models: Language, multimodality, and beyond","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.179776Z"},"links":{"citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:a0816a3aa62a572efeae341ba23395686520f8963e2e7abad191187731678a6c","observation_id":"4f0526b4-fc90-4f29-93d9-d46961c34168","resolution":{"observed_at":"2026-08-07T00:57:02.179776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04022","last_updated":"2025-04-05T02:24:07Z","snapshot_observed_at":"2026-08-16T12:43:48.435094Z","submitted_at":"2025-04-05T02:24:07Z","title":"Rethinking Reflection in Pre-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04022","snapshot_observed_at":"2026-08-07T00:57:02.241113Z","title":"Rethinking reflection in pre-training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.241113Z"},"links":{"cited_paper":"/paper/2504.04022","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:9b0052ccd883c4ca9796fef3aaadbf9bdc6d035f5800e7c71ce0e3f4baf8c225","observation_id":"6cd2b2a9-b2be-4646-ae18-378ac9697d09","resolution":{"observed_at":"2026-08-07T00:57:02.241113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:02.329733Z","title":"Dast: Difficulty-adaptive slow-thinking for large reasoning models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.329733Z"},"links":{"citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:3adb1c0a63442c2054baff3fd22dc6b903c79ceb9f08246e0094679538578285","observation_id":"a1f409dd-f139-4b48-8b02-dac6572e8131","resolution":{"observed_at":"2026-08-07T00:57:02.329733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.21074","last_updated":"2025-09-23T08:16:08Z","snapshot_observed_at":"2026-08-07T17:46:47.440455Z","submitted_at":"2025-02-28T14:07:48Z","title":"CODI: Compressing Chain-of-Thought into Continuous Space via Self-Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.21074","snapshot_observed_at":"2026-08-07T00:57:02.392493Z","title":"Codi: Compressing chain-of-thought into continuous space via self-distillation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.392493Z"},"links":{"cited_paper":"/paper/2502.21074","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:6fb33d512668f4d84019b42f623e5ad3b2cb09fb70ccf097953b2a97b1bdda0d","observation_id":"d2758987-83ba-44dd-b603-e8d5964e0937","resolution":{"observed_at":"2026-08-07T00:57:02.392493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-07T00:57:02.554880Z","title":"Challenging big-bench tasks and whether chain-of-thought can solve them","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.554880Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:399b4b1d81635ec7d8af1b3e0f19b42ba7b023703eb1b3974d8e184c64b45f31","observation_id":"87300105-0283-41df-9416-eb40690a1c0a","resolution":{"observed_at":"2026-08-07T00:57:02.554880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24377","last_updated":"2025-03-31T17:58:07Z","snapshot_observed_at":"2026-08-18T07:57:10.670926Z","submitted_at":"2025-03-31T17:58:07Z","title":"Harnessing the Reasoning Economy: A Survey of Efficient Reasoning for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24377","snapshot_observed_at":"2026-08-07T00:57:02.706327Z","title":"Harnessing the reasoning economy: A survey of efficient reasoning for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.706327Z"},"links":{"cited_paper":"/paper/2503.24377","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:a954c9854acee95ccc919a929624088cb5a016e1b5a99473c8deaed356c52bac","observation_id":"993f89a0-afcc-49bd-8c27-23bd97b7722b","resolution":{"observed_at":"2026-08-07T00:57:02.706327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18585","last_updated":"2025-02-18T16:51:53Z","snapshot_observed_at":"2026-08-15T06:19:06.009960Z","submitted_at":"2025-01-30T18:58:18Z","title":"Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18585","snapshot_observed_at":"2026-08-07T00:57:02.795577Z","title":"Thoughts are all over the place: On the underthinking of ol-like Ilms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.795577Z"},"links":{"cited_paper":"/paper/2501.18585","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:55b5472cc90d32951e52efe5970bf24f8f05db2fc4d8ad8a909c57a013a63f06","observation_id":"db5ace98-dfbb-46c7-bbb7-d387d65e5643","resolution":{"observed_at":"2026-08-07T00:57:02.795577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T00:57:01.260712Z","title":"Gpt-40 system card","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.260712Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:d46d8e83568f1407c1d5b0ae5e691d586045d6c0adafde2c5ae33199a1650254","observation_id":"aee5a5d4-149f-4feb-a554-b54d6110e04a","resolution":{"observed_at":"2026-08-07T00:57:01.260712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:02.853369Z","title":"Tokenskip: Controllable chain-of-thought compression in Ilms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.853369Z"},"links":{"citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:4742169deb48ca9d344ed2d7dc3e7ceba295c6b5e51d40294ba2c93832b49a0f","observation_id":"d681e2a7-2e87-4ebd-92f2-a1f329307db5","resolution":{"observed_at":"2026-08-07T00:57:02.853369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18600","last_updated":"2025-03-03T17:08:21Z","snapshot_observed_at":"2026-08-17T09:15:07.422894Z","submitted_at":"2025-02-25T19:36:06Z","title":"Chain of Draft: Thinking Faster by Writing Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18600","snapshot_observed_at":"2026-08-07T00:57:02.942395Z","title":"Chain of draft: Thinking faster by writing less","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.942395Z"},"links":{"cited_paper":"/paper/2502.18600","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:bd732ba4a9d56c8b83d1aa3ef9542af4bd1b9268f17c1f77cb0bd0c7097709cd","observation_id":"4018b750-52c3-4204-99fc-b70ad89c8a22","resolution":{"observed_at":"2026-08-07T00:57:02.942395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T00:57:03.016370Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:03.016370Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:3776a372b6e7744968fd1702476b4dd13d2a8c49d56d664ed28022bfa15a2b94","observation_id":"005af0ef-5636-46c8-83f1-231e846aef3f","resolution":{"observed_at":"2026-08-07T00:57:03.016370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03373","last_updated":"2025-02-05T17:13:32Z","snapshot_observed_at":"2026-08-17T16:40:23.847561Z","submitted_at":"2025-02-05T17:13:32Z","title":"Demystifying Long Chain-of-Thought Reasoning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03373","snapshot_observed_at":"2026-08-07T00:57:03.086576Z","title":"Demystifying long chain-of-thought reasoning in Ilms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:03.086576Z"},"links":{"cited_paper":"/paper/2502.03373","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:8ed31636da7dbc8dd67858eb66e6586a705bca87d51b36da1c0ac747c0323cde","observation_id":"4b265649-d87c-49ab-8a54-2c9249ae37d6","resolution":{"observed_at":"2026-08-07T00:57:03.086576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-11T13:10:23.709172Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-07T00:57:02.482809Z","title":"Stop overthinking: A survey on efficient reasoning for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.482809Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:8be4eb67bf42fe8c0d8c9cd4097cb6ca0b8a78a46966e45fa2fb8a3861e8cd3e","observation_id":"48bfcf8c-7c5b-44b0-8460-e640161c230a","resolution":{"observed_at":"2026-08-07T00:57:02.482809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:59.939407Z","title":"Sketch-of-thought: Efficient lm reasoning with adaptive cognitive-inspired sketching","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:59.939407Z"},"links":{"citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:d69ff5cd1499baddb2e0cd61e22772053b895196d9a52fd7f43b7c71ca7f42cd","observation_id":"87337e2b-fa9b-4e9c-9645-782b05063284","resolution":{"observed_at":"2026-08-07T00:56:59.939407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-08-15T22:38:53.825110Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T00:57:02.644849Z","title":"Kimi k1.5: Scaling reinforcement learning with Ilms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.644849Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:627c4ea8b3b755e42f3b1b1e984c052246c23fe1c5dd38b977c77fbb61de382d","observation_id":"00c22b61-848d-4d34-bf5f-7032a4c3f332","resolution":{"observed_at":"2026-08-07T00:57:02.644849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01141","last_updated":"2025-04-01T00:41:36Z","snapshot_observed_at":"2026-08-18T08:05:54.612758Z","submitted_at":"2025-03-03T03:48:20Z","title":"How Well do LLMs Compress Their Own Chain-of-Thought? A Token Complexity Approach","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01141","snapshot_observed_at":"2026-08-07T00:57:01.431811Z","title":"How well do Ilms compress their own chain-of- thought? a token complexity approach","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.431811Z"},"links":{"cited_paper":"/paper/2503.01141","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:7753980fe24ec183b1b77cc02fd7e096a947d47c5c853071ea8e953660b83b27","observation_id":"c508e0f9-1bb8-4906-9b2b-9da57a366953","resolution":{"observed_at":"2026-08-07T00:57:01.431811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04428","last_updated":"2025-02-06T18:59:11Z","snapshot_observed_at":"2026-08-18T08:36:55.882093Z","submitted_at":"2025-02-06T18:59:11Z","title":"Confident or Seek Stronger: Exploring Uncertainty-Based On-device LLM Routing From Benchmarking to Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04428","snapshot_observed_at":"2026-08-07T00:57:00.320706Z","title":"Confident or seek stronger: Exploring uncertainty-based on-device Ilm routing from benchmarking to generalization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:00.320706Z"},"links":{"cited_paper":"/paper/2502.04428","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:cf47e6676b92110e37e3b5209be364476955a4b9b7704de4969e950de881c942","observation_id":"c37b93d1-a14e-4fe0-9281-4a6480356d16","resolution":{"observed_at":"2026-08-07T00:57:00.320706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-07T00:56:59.824558Z","title":"Program synthesis with large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:59.824558Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:3a89aba19d046bcc0a720977e09778dd83938dd74b0b06a6adb269105d3574ce","observation_id":"6513cbd3-fbbc-4499-9166-38d364166eb0","resolution":{"observed_at":"2026-08-07T00:56:59.824558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 4 inbound Pith citation observations for arXiv:2506.12353."}