{"as_of":"2026-08-18T13:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8e63f8483f961d6cf10534b3aa2aa7b5c8bba9faef79b0766dbb5b65c6c1279f","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:13:19.702029Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:54:17.309691Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T01:32:02.805236Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12860","snapshot_observed_at":"2026-08-06T17:54:17.309691Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09662","last_updated":"2025-07-13T14:51:59Z","snapshot_observed_at":"2026-08-15T08:55:38.744613Z","submitted_at":"2025-07-13T14:51:59Z","title":"Towards Concise and Adaptive Thinking in Large Reasoning Models: A Survey","version":1},"reference_index":116,"source":"arxiv_source","source_observed_at":"2026-08-06T17:54:17.309691Z"},"links":{"cited_paper":"/paper/2506.12860","citing_paper":"/paper/2507.09662"},"observation_digest":"sha256:c09976b56caf587e88a289015b5066d807707cc0d2c76b46209b3189e212ed27","observation_id":"57d117e4-8407-4a4e-8afe-e1ef151f08a2","resolution":{"observed_at":"2026-08-06T17:54:17.309691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"cited_work":{"arxiv_id":"2506.12860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12860","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reason- ing.ArXiv, abs/2506.12860","venue":null,"work_id":"1cd792d9-96cb-4775-b892-0b8f310ebc3c","year":2025},"citing_paper":{"arxiv_id":"2605.11625","last_updated":"2026-05-12T06:51:31Z","snapshot_observed_at":"2026-08-15T20:23:49.781529Z","submitted_at":"2026-05-12T06:51:31Z","title":"Nice Fold or Hero Call: Learning Budget-Efficient Thinking for Adaptive Reasoning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-13T01:31:21.377700Z"},"links":{"cited_paper":"/paper/2506.12860","citing_paper":"/paper/2605.11625"},"observation_digest":"sha256:3c7776c56ae500076cdffb6fda19c77471066da23bed1565d3a4a0bbf62d918a","observation_id":"aa2970fe-c146-4d00-8f29-0e27550d27cb","resolution":{"observed_at":"2026-05-13T01:32:02.808216Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.12860/citation-record","integrity":"/paper/2506.12860/integrity","json":"/paper/2506.12860/citation-record.json","paper":"/paper/2506.12860"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-15T20:13:19.444466Z","title":"Openai o1 system card.arXiv preprint arXiv:2412.16720, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.444466Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:69d745f3b3a553a9a6bb386c7c4b5ff8b7e7a184dc3def142a81e26ad2e6d104","observation_id":"6478d1d1-643d-427c-be89-2cbe697394ca","resolution":{"observed_at":"2026-08-15T20:13:19.444466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T20:13:19.451305Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.451305Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:dd25d25b5bba27a2f18c93fedc3f0d436437bde31677572dccb5ddf3af2e1b52","observation_id":"fe82fa2d-2daf-4275-b790-4d4b263eb510","resolution":{"observed_at":"2026-08-15T20:13:19.451305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:19.457178Z","title":"Reasoning with large language models, a survey.arXiv preprint arXiv:2407.11511, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.457178Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:70921ce1f695cff23b3b446c97796e2eec0ce1883367d72c920dd4036573a394","observation_id":"6c24ee52-db13-46e0-b614-52d37ccab6c6","resolution":{"observed_at":"2026-08-15T20:13:19.457178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19411","last_updated":"2025-02-26T18:55:42Z","snapshot_observed_at":"2026-08-16T19:40:59.138150Z","submitted_at":"2025-02-26T18:55:42Z","title":"Code to Think, Think to Code: A Survey on Code-Enhanced Reasoning and Reasoning-Driven Code Intelligence in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19411","snapshot_observed_at":"2026-08-15T20:13:19.462076Z","title":"Code to think, think to code: A survey on code-enhanced reasoning and reasoning-driven code intelligence in llms.arXiv preprint arXiv:2502.19411, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.462076Z"},"links":{"cited_paper":"/paper/2502.19411","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:e26f1d8ea0c2e77db7a554db1513c8e4493b2696c3dcfff4ec01f7295a53e64c","observation_id":"d6e111b5-1ee3-42bb-a74e-f579c0bb7bc2","resolution":{"observed_at":"2026-08-15T20:13:19.462076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06807","last_updated":"2025-02-18T22:21:40Z","snapshot_observed_at":"2026-08-16T21:32:22.938353Z","submitted_at":"2025-02-03T23:00:15Z","title":"Competitive Programming with Large Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06807","snapshot_observed_at":"2026-08-15T20:13:19.467637Z","title":"Competitive programming with large reasoning models.arXiv preprint arXiv:2502.06807, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.467637Z"},"links":{"cited_paper":"/paper/2502.06807","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:ce52ca0754b4de22e93d63b35f78c4ca0ddb21d72907ff298e382179d9b9090a","observation_id":"9022a234-6e97-4e6c-96b6-c67fd3edada0","resolution":{"observed_at":"2026-08-15T20:13:19.467637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07374","last_updated":"2025-02-18T05:20:33Z","snapshot_observed_at":"2026-08-15T09:05:14.806013Z","submitted_at":"2025-02-11T08:48:48Z","title":"LLMs Can Easily Learn to Reason from Demonstrations Structure, not content, is what matters!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07374","snapshot_observed_at":"2026-08-15T20:13:19.473338Z","title":"Llms can easily learn to reason from demonstrations structure, not content, is what matters!arXiv preprint arXiv:2502.07374, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.473338Z"},"links":{"cited_paper":"/paper/2502.07374","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:f0da4acf916296137c67744d2f35a682f437a7a71be24de9eecfe6ac26f27ef4","observation_id":"731500e5-d9e6-4222-b1f7-6c1765cda600","resolution":{"observed_at":"2026-08-15T20:13:19.473338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:19.479355Z","title":"Enhancing customer contact effi- ciency with graph neural networks in credit card fraud detection workflow.arXiv preprint arXiv:2504.02275, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.479355Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:af9226b53dedeb574d46aa8c357a02f9623ec659a2fcda01b68c14c287066c06","observation_id":"d69bcdc8-f6d1-4524-973d-d000efd419b3","resolution":{"observed_at":"2026-08-15T20:13:19.479355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:20.982990Z","title":"Sky-t1: Fully open-source reasoning model with o1-preview performance in 450 budget","venue":null,"work_id":"27e0dc65-db10-48f7-8d8b-2962b8c3f37f","year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.484914Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:57879bf141d87516d781e5aeb2896c370d12448cad8f930c31c39724b2bb213a","observation_id":"cab37711-97dc-4fd5-92ba-d444732352c4","resolution":{"observed_at":"2026-08-15T20:13:20.988249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-08-17T11:00:39.333660Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-15T20:13:19.489730Z","title":"s1: Simple test-time scaling.arXiv preprint arXiv:2501.19393, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.489730Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:89341a3b1204b10f60519348fffc142402da2fb7148143c8683047ccca5d61f6","observation_id":"284c809b-92f2-4ed3-98d1-2af787fcd0c7","resolution":{"observed_at":"2026-08-15T20:13:19.489730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-15T20:13:19.494991Z","title":"Limo: Less is more for reasoning.arXiv preprint arXiv:2502.03387, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.494991Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:62cddc80afba50deed1f43862f0db76208a25b967c3bde0f670b3349fbc28474","observation_id":"e7ca230a-1160-4478-9e47-f279a4a20fef","resolution":{"observed_at":"2026-08-15T20:13:19.494991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-15T20:13:19.500677Z","title":"Do not think that much for 2+ 3=? on the overthinking of o1-like llms.arXiv preprint arXiv:2412.21187, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.500677Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:d5967ba0e4fe6001b33008ece345400f0384c3e71660db5f5e2135e463daafd5","observation_id":"4a6725a9-3105-479f-ae7a-59515fe3a52f","resolution":{"observed_at":"2026-08-15T20:13:19.500677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18585","last_updated":"2025-02-18T16:51:53Z","snapshot_observed_at":"2026-08-15T06:19:06.009960Z","submitted_at":"2025-01-30T18:58:18Z","title":"Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18585","snapshot_observed_at":"2026-08-15T20:13:19.506091Z","title":"Thoughts are all over the place: On the underthinking of o1-like llms.arXiv preprint arXiv:2501.18585, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.506091Z"},"links":{"cited_paper":"/paper/2501.18585","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:f5356df029b485c8e9083e64f612cd79585c81597bcd1d775c4231cc78d5014e","observation_id":"410d4bae-04aa-4806-92f5-e0260bd428de","resolution":{"observed_at":"2026-08-15T20:13:19.506091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-08-15T22:38:53.825110Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-15T20:13:19.510923Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.510923Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:b3792f2c10c53d0b06659d0c9685678e5b3e3fbe5c2323da00f5c99c9fa89e8a","observation_id":"0b9f4a97-9abd-4318-b919-3514f1e14a99","resolution":{"observed_at":"2026-08-15T20:13:19.510923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12570","last_updated":"2025-01-29T03:11:03Z","snapshot_observed_at":"2026-08-18T10:17:24.497798Z","submitted_at":"2025-01-22T01:35:11Z","title":"O1-Pruner: Length-Harmonizing Fine-Tuning for O1-Like Reasoning Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12570","snapshot_observed_at":"2026-08-15T20:13:19.515683Z","title":"O1-pruner: Length-harmonizing fine-tuning for o1-like reasoning pruning.arXiv preprint arXiv:2501.12570, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.515683Z"},"links":{"cited_paper":"/paper/2501.12570","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:16151fee36a45143eb500d72bbc8a693f3b2abae5227445c4aae481374864cf3","observation_id":"d681014e-746e-4422-96d1-24fa5647f349","resolution":{"observed_at":"2026-08-15T20:13:19.515683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-17T16:48:59.674177Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-15T20:13:19.521206Z","title":"L1: Controlling how long a reasoning model thinks with reinforcement learning.arXiv preprint arXiv:2503.04697, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.521206Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:dedc1371713056399660e2c184c78c50e9705469451cae264472bf1a6382bcbd","observation_id":"d8f85ba2-8d9b-4677-9e25-45d9fbc472b2","resolution":{"observed_at":"2026-08-15T20:13:19.521206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09601","last_updated":"2025-02-13T18:52:36Z","snapshot_observed_at":"2026-08-15T01:40:51.444222Z","submitted_at":"2025-02-13T18:52:36Z","title":"CoT-Valve: Length-Compressible Chain-of-Thought Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09601","snapshot_observed_at":"2026-08-15T20:13:19.526332Z","title":"Cot-valve: Length-compressible chain-of-thought tuning.arXiv preprint arXiv:2502.09601, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.526332Z"},"links":{"cited_paper":"/paper/2502.09601","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:446995709bd1804ad58e915a46b42550d280556694035d0723a15552ead78af4","observation_id":"af617170-69e0-441a-bbd2-ea102ac5095e","resolution":{"observed_at":"2026-08-15T20:13:19.526332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:19.531298Z","title":"Tokenskip: Controllable chain-of-thought compression in llms.arXiv preprint arXiv:2502.12067, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.531298Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:a25ae753efc448706d152ace7bf909b786d424339af2fc83bee6ac5d047708cd","observation_id":"4b8a67c8-74a6-42b2-a81e-9ea4a99fe009","resolution":{"observed_at":"2026-08-15T20:13:19.531298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:19.535919Z","title":"Understanding catastrophic forgetting in language models via implicit inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.535919Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:7d20974fd9b0cd7e17ee390517794398c33e25bc436374d9b0f21a11a0f9b6b1","observation_id":"eb9712c2-67a8-4cf7-8572-5d2be9f59159","resolution":{"observed_at":"2026-08-15T20:13:19.535919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09686","last_updated":"2025-01-23T08:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T17:37:58Z","title":"Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09686","snapshot_observed_at":"2026-08-15T20:13:19.542361Z","title":"Towards large reasoning models: A survey of reinforced reasoning with large language models.arXiv preprint arXiv:2501.09686, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.542361Z"},"links":{"cited_paper":"/paper/2501.09686","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:51369bc34a4adec63de277cb2af605f0a45c7bc2a44af2c635146b1d195c8ea4","observation_id":"11e8e042-dd9f-4993-b8a2-6c2c0e7b3944","resolution":{"observed_at":"2026-08-15T20:13:19.542361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01461","last_updated":"2025-05-31T16:16:36Z","snapshot_observed_at":"2026-08-16T12:53:37.635634Z","submitted_at":"2025-03-03T12:17:36Z","title":"Marco-o1 v2: Towards Widening The Distillation Bottleneck for Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01461","snapshot_observed_at":"2026-08-15T20:13:19.547205Z","title":"Towards widening the distillation bottleneck for reasoning models.arXiv preprint arXiv:2503.01461, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.547205Z"},"links":{"cited_paper":"/paper/2503.01461","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:ac0e2bf5e1eb55b914af936324d536b42c35df6aaee1b1c7d8a7410da80d15ec","observation_id":"a4d4df8c-4ebf-47cf-a123-bddba362a9e8","resolution":{"observed_at":"2026-08-15T20:13:19.547205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:20.956002Z","title":"Note on cohen’s kappa.Psychological reports, 65(1):223–226, 1989","venue":null,"work_id":"9ae580c8-88bc-47fc-a4a1-5f8d0f7676cd","year":1989},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.552305Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:788539f13f14c34e4b62278eb2d4feb1cedbdb8f1cd4f81f93975f901ae8274e","observation_id":"9fda95af-33fa-4545-9992-f2bd59798996","resolution":{"observed_at":"2026-08-15T20:13:20.960956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-17T09:42:34.746112Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-15T20:13:19.557196Z","title":"Let’s verify step by step.arXiv preprint arXiv:2305.20050, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.557196Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:bf8cf39d8c95552c366b38f9d628431cdad1bcfb3993d88297e8f504343bc810","observation_id":"77cc036f-07ca-4040-a651-826bbccb146a","resolution":{"observed_at":"2026-08-15T20:13:19.557196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03373","last_updated":"2025-02-05T17:13:32Z","snapshot_observed_at":"2026-08-17T16:40:23.847561Z","submitted_at":"2025-02-05T17:13:32Z","title":"Demystifying Long Chain-of-Thought Reasoning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03373","snapshot_observed_at":"2026-08-15T20:13:19.561839Z","title":"Demystifying long chain-of-thought reasoning in llms.arXiv preprint arXiv:2502.03373, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.561839Z"},"links":{"cited_paper":"/paper/2502.03373","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:907f85cdb3ad056b6e776f89af7b4e351d114e698631e81f6f66cfce35924990","observation_id":"6ab8ea00-f355-4a11-ad97-8056d7fd460d","resolution":{"observed_at":"2026-08-15T20:13:19.561839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:19.566969Z","title":"Data engineering for scaling language models to 128k context, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.566969Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:6c00c0240ae0a4989efa3fbfadbad81cba2fe111bdc9438c19bf578c51b0e693","observation_id":"832a2b08-852e-41c7-8c19-eb99e36a0870","resolution":{"observed_at":"2026-08-15T20:13:19.566969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:19.571639Z","title":"Huang, Jie Fu, Xiang Yue, and Wenhu Chen","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.571639Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:0006b8815f3c62d9ff4c5ffc56bbcb010f2280d2d03248990f3e12d636268f43","observation_id":"0fb71177-5120-4b2f-8915-acf63f0d1539","resolution":{"observed_at":"2026-08-15T20:13:19.571639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:19.577083Z","title":"A survey of transfer learning.Journal of Big data, 3:1–40, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.577083Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:b0b16a7c67dac356d6097eece47bf78589bdc848e24ae658c1df47f96a37f4de","observation_id":"fba6b2e5-4321-4c40-aae9-59d80ccb4f49","resolution":{"observed_at":"2026-08-15T20:13:19.577083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:20.909628Z","title":"A comprehensive survey on transfer learning.Proceedings of the IEEE, 109(1):43–76, 2020","venue":null,"work_id":"32a19599-bfef-43bd-972f-a58ff9e230ec","year":2020},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.582011Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:c4699338b4f7178a945cd892a84f5d0bcb7013ca02076a61ca2dde652ac9bcc0","observation_id":"d821aa8f-7943-4686-87b5-3b53e9a99659","resolution":{"observed_at":"2026-08-15T20:13:20.915080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-15T20:13:19.587765Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.587765Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:0cd19ebed3d0cdf7ebfb2597704b4121af3f7efd1b998760728145dc8165536b","observation_id":"4bbe045c-425f-4cd5-ae92-5cee80c3c80f","resolution":{"observed_at":"2026-08-15T20:13:19.587765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:20.892380Z","title":"Llamafactory: Unified efficient fine-tuning of 100+ language models","venue":null,"work_id":"adc3ff45-ca2a-4d47-8e91-2574fef0a2ea","year":2024},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.593456Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:2a2f30162e89b843feca5b9189d5947317b2dfb3d93207eb9e097df28e8ded43","observation_id":"cecd0ffc-442a-4c58-83a3-b27310fde19b","resolution":{"observed_at":"2026-08-15T20:13:20.897878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T20:13:19.598384Z","title":"Training verifiers to solve math word problems.arXiv preprint arXiv:2110.14168, 2021","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.598384Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:967651a05003c471e1db9729eb477f4c63433d61815d26c3a8dfebfa2f8734df","observation_id":"757e694b-d357-42e1-ad9d-01909fa8fc9c","resolution":{"observed_at":"2026-08-15T20:13:19.598384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:19.604579Z","title":"Solving quantitative reasoning problems with language models.Advances in Neural Information Processing Systems, 35:3843–3857, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.604579Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:cbb8a261fdbfcaff23e7f25a627739e9eff6d629b416d75651af730f771022a3","observation_id":"248f92f3-2cd4-425c-b5fb-57b869915726","resolution":{"observed_at":"2026-08-15T20:13:19.604579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:19.609291Z","title":"Gpqa: A graduate-level google-proof q&a benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.609291Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:7c9f6d054b4b20cf3423c62d5631f517e95265b5383da66df0bbab29636c4f6f","observation_id":"d1337496-15ee-45b9-819e-6e69766ed375","resolution":{"observed_at":"2026-08-15T20:13:19.609291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:19.614233Z","title":"Mmlu-pro: A more robust and challenging multi-task language understanding benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.614233Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:eb80206d08c4049c042faabe3c4ac172c2c8e61d2fb7923c19de94200b70ea84","observation_id":"1fc9a099-61b7-4da5-87e7-922a127fcae9","resolution":{"observed_at":"2026-08-15T20:13:19.614233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01307","last_updated":"2025-08-15T15:21:46Z","snapshot_observed_at":"2026-08-14T13:46:28.086398Z","submitted_at":"2025-03-03T08:46:22Z","title":"Cognitive Behaviors that Enable Self-Improving Reasoners, or, Four Habits of Highly Effective STaRs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01307","snapshot_observed_at":"2026-08-15T20:13:19.618743Z","title":"Cognitive behaviors that enable self-improving reasoners, or, four habits of highly effective stars.arXiv preprint arXiv:2503.01307, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.618743Z"},"links":{"cited_paper":"/paper/2503.01307","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:ee1157fea405f24adc67b0a64085ee62cbc5e59d96205b7a9b0ca3cd2b3d6fac","observation_id":"9080ec50-7e1d-40e6-a940-955d5fd8fb60","resolution":{"observed_at":"2026-08-15T20:13:19.618743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:19.623791Z","title":"Minicheck: Efficient fact-checking of llms on grounding documents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.623791Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:b2b95e199767b1be9402f678f139c3a73bb75d2dc09bb5648a0c20e8075ce80f","observation_id":"7f8fd240-236b-45fd-b009-a50246a9ee96","resolution":{"observed_at":"2026-08-15T20:13:19.623791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:20.833757Z","title":"Why rare diseases are an important medical and social issue.The Lancet, 371(9629):2039–2041, 2008","venue":null,"work_id":"7eb30333-90b5-4a07-9024-780bdcc5c461","year":2008},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.628374Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:9b1409d43166376023055a777b795c789ef2b10623d57e98497fc0f3339ce1b1","observation_id":"d1237f9f-dbee-4c95-9547-6ef319a02bc8","resolution":{"observed_at":"2026-08-15T20:13:20.839142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:20.814849Z","title":"Significance of the rare event in geology.AAPG Bulletin, 51(11):2197–2206, 1967","venue":null,"work_id":"12ca4c84-0bda-4ff3-b063-65c32fc651b2","year":1967},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.632687Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:a4f5657b4a5249d85961d8c2490de4ee5328ac817bedfd921d3ab3a4efa09e72","observation_id":"85bfae40-0013-4f7c-a721-94746c67ab62","resolution":{"observed_at":"2026-08-15T20:13:20.822276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:19.638393Z","title":"Qwq-32b: Embracing the power of reinforcement learning, March 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.638393Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:53c623f02920a00890cf1983d2c2e684ef25da23ee3ade0b3a201920ef45bddc","observation_id":"50ae5d0e-288f-42dc-a48f-a27d6bc31549","resolution":{"observed_at":"2026-08-15T20:13:19.638393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17419","last_updated":"2025-06-25T02:24:46Z","snapshot_observed_at":"2026-08-10T09:42:17.185681Z","submitted_at":"2025-02-24T18:50:52Z","title":"From System 1 to System 2: A Survey of Reasoning Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17419","snapshot_observed_at":"2026-08-15T20:13:19.643131Z","title":"From system 1 to system 2: A survey of reasoning large language models.arXiv preprint arXiv:2502.17419, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.643131Z"},"links":{"cited_paper":"/paper/2502.17419","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:8f9aa824385f7486bc046505f6eac2d8f2faebd7c9a233f3710a6bde9fb0e9c7","observation_id":"ccad7bd4-bf18-4b00-88b4-642f8342f311","resolution":{"observed_at":"2026-08-15T20:13:19.643131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:19.648436Z","title":"Reasoning on a spectrum: Aligning llms to system 1 and system 2 thinking.arXiv preprint arXiv:2502.12470, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.648436Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:7188dc138f3e53f53d9ef3c21d8dc3013256dbf0d6c6bae484b87744888c7af9","observation_id":"91d0c8f7-0616-4232-b332-d8e27cec8ae8","resolution":{"observed_at":"2026-08-15T20:13:19.648436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04682","last_updated":"2025-01-08T18:42:48Z","snapshot_observed_at":"2026-08-17T00:54:00.358623Z","submitted_at":"2025-01-08T18:42:48Z","title":"Towards System 2 Reasoning in LLMs: Learning How to Think With Meta Chain-of-Thought","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04682","snapshot_observed_at":"2026-08-15T20:13:19.653697Z","title":"Towards system 2 reasoning in llms: Learning how to think with meta chain-of-though.arXiv preprint arXiv:2501.04682, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.653697Z"},"links":{"cited_paper":"/paper/2501.04682","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:4bbbfc5d1dee27bbfecb851314f185754aedf00df0a5256c433fe2ee18108d6d","observation_id":"0e2059b1-2d5c-40fa-9711-59a7e9ad626a","resolution":{"observed_at":"2026-08-15T20:13:19.653697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:19.659151Z","title":"Open r1: A fully open reproduction of deepseek-r1, January 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.659151Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:5e04e7f1aea5a7d3bd641bf5ea0e44effccdfbc74ce3bf20d85fe421371ce513","observation_id":"359673b4-0121-41ec-a1f8-eb6ce2f73693","resolution":{"observed_at":"2026-08-15T20:13:19.659151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16891","last_updated":"2025-04-23T17:13:04Z","snapshot_observed_at":"2026-08-17T09:53:24.806684Z","submitted_at":"2025-04-23T17:13:04Z","title":"AIMO-2 Winning Solution: Building State-of-the-Art Mathematical Reasoning Models with OpenMathReasoning dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16891","snapshot_observed_at":"2026-08-15T20:13:19.664070Z","title":"Aimo-2 winning solution: Building state-of-the-art math- ematical reasoning models with openmathreasoning dataset.arXiv preprint arXiv:2504.16891, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.664070Z"},"links":{"cited_paper":"/paper/2504.16891","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:154b5d17e568b40f49f17da6516ec714661222027c590095e984ae03fb54ac05","observation_id":"78baf988-73fd-4ad1-b3ec-1dacafdef125","resolution":{"observed_at":"2026-08-15T20:13:19.664070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20641","last_updated":"2025-05-23T02:41:43Z","snapshot_observed_at":"2026-08-18T04:48:01.868748Z","submitted_at":"2025-03-26T15:34:37Z","title":"Unlocking Efficient Long-to-Short LLM Reasoning with Model Merging","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20641","snapshot_observed_at":"2026-08-15T20:13:19.669504Z","title":"Unlocking efficient long-to-short llm reasoning with model merging.arXiv preprint arXiv:2503.20641, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.669504Z"},"links":{"cited_paper":"/paper/2503.20641","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:88cca5c0668eabb3c9daeffdbc4f6467d2391075719f43076d8d674cf5dbcc61","observation_id":"7123be22-f343-4591-b8fc-350f7f20fd46","resolution":{"observed_at":"2026-08-15T20:13:19.669504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18600","last_updated":"2025-03-03T17:08:21Z","snapshot_observed_at":"2026-08-17T09:15:07.422894Z","submitted_at":"2025-02-25T19:36:06Z","title":"Chain of Draft: Thinking Faster by Writing Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18600","snapshot_observed_at":"2026-08-15T20:13:19.676107Z","title":"Chain of draft: Thinking faster by writing less.arXiv preprint arXiv:2502.18600, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.676107Z"},"links":{"cited_paper":"/paper/2502.18600","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:264f402cf9a7ed0298873b83821c4356914678b8b1743959ddfe5583eb5d921a","observation_id":"3055ca9f-cded-48ba-a6a4-2936abe7b363","resolution":{"observed_at":"2026-08-15T20:13:19.676107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19825","last_updated":"2025-01-23T08:45:52Z","snapshot_observed_at":"2026-08-16T13:30:18.557142Z","submitted_at":"2024-07-29T09:21:52Z","title":"Concise Thoughts: Impact of Output Length on LLM Reasoning and Cost","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19825","snapshot_observed_at":"2026-08-15T20:13:19.682513Z","title":"Concise thoughts: Impact of output length on llm reasoning and cost.arXiv preprint arXiv:2407.19825, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.682513Z"},"links":{"cited_paper":"/paper/2407.19825","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:a67c15c28dabdbe9176393ae5934b6f64f1f7e0a40bfd1776f25fd81c295b174","observation_id":"2b171910-0d1d-472a-a71f-bb2b975994f3","resolution":{"observed_at":"2026-08-15T20:13:19.682513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18547","last_updated":"2025-06-02T00:44:09Z","snapshot_observed_at":"2026-08-16T12:59:58.216334Z","submitted_at":"2024-12-24T16:55:45Z","title":"Token-Budget-Aware LLM Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18547","snapshot_observed_at":"2026-08-15T20:13:19.688333Z","title":"Token-budget-aware llm reasoning.arXiv preprint arXiv:2412.18547, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.688333Z"},"links":{"cited_paper":"/paper/2412.18547","citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:432fd9b07f4bd1c03b68d9387c57e790d4a0c1aa502aff563c6b948c22190010","observation_id":"873ceeaa-86de-45a0-b5d3-2a57b058e0c9","resolution":{"observed_at":"2026-08-15T20:13:19.688333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:20.777637Z","title":"Longrecipe: Recipe for efficient long context generalization in large language models, 2024","venue":null,"work_id":"e1e9b52b-cdb1-44cb-9da9-51de6a6606d4","year":2024},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.696974Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:016d394f051946bb9f9e7fc0a9aa7e0b8754a55f4b319159510c28519b7237ec","observation_id":"69e1daac-97d1-4c5c-836b-6014dffe76e3","resolution":{"observed_at":"2026-08-15T20:13:20.783670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:13:20.759223Z","title":"let me double-check","venue":null,"work_id":"576a0d49-8d29-4095-8176-86b4961e834d","year":2025},"citing_paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:19.702029Z"},"links":{"citing_paper":"/paper/2506.12860"},"observation_digest":"sha256:a68975c21d2bcd60fca5234774a5c8f380af3cffadb5503c308ebb1a6abc0877","observation_id":"5587fdc2-3a62-4e4d-b356-178ac38ba10f","resolution":{"observed_at":"2026-08-15T20:13:20.765088Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.12860","last_updated":"2025-06-15T14:21:28Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T20:27:15.337845Z","submitted_at":"2025-06-15T14:21:28Z","title":"QFFT, Question-Free Fine-Tuning for Adaptive Reasoning"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 2 inbound Pith citation observations for arXiv:2506.12860."}