{"as_of":"2026-08-18T18:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5bfc208fe7a641fa3e7e8ce52a7fbfa550b1f1164d30d60b509a3d2635841035","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:29:18.775808Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:12:44.575215Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T14:12:24.048558Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"cited_work":{"arxiv_id":"2504.18116","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.18116","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Think, prune, train, improve: Scaling reasoning without scaling models.arXiv preprint arXiv:2504.18116","venue":null,"work_id":"0eb3f988-6ae2-4beb-9a72-47b2590d61a1","year":2025},"citing_paper":{"arxiv_id":"2504.19678","last_updated":"2026-03-06T19:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-28T11:08:22Z","title":"From LLM Reasoning to Autonomous AI Agents: A Comprehensive Review","version":2},"reference_index":232,"source":"pdf_text","source_observed_at":"2026-05-15T02:57:37.873567Z"},"links":{"cited_paper":"/paper/2504.18116","citing_paper":"/paper/2504.19678"},"observation_digest":"sha256:4bd932bc2bfde9be85665df464deda62a9df3dc1edb5ee4a4a51c9fcea1218b9","observation_id":"e5bcea23-fdf5-4b43-9c85-2862e200f7d2","resolution":{"observed_at":"2026-05-15T02:57:38.184767Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"cited_work":{"arxiv_id":"2504.18116","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.18116","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Think, prune, train, improve: Scaling reasoning without scaling models.arXiv preprint arXiv:2504.18116","venue":null,"work_id":"0eb3f988-6ae2-4beb-9a72-47b2590d61a1","year":2025},"citing_paper":{"arxiv_id":"2505.24187","last_updated":"2026-05-06T02:36:34Z","snapshot_observed_at":"2026-08-18T09:19:31.743584Z","submitted_at":"2025-05-30T03:57:31Z","title":"Beyond Exponential Decay: Rethinking Error Accumulation in Large Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-19T14:07:42.408261Z"},"links":{"cited_paper":"/paper/2504.18116","citing_paper":"/paper/2505.24187"},"observation_digest":"sha256:58878390e0e3b5e870abcf40e696aff0b6d3f1597db49362c3fb93b052767460","observation_id":"6e1e882d-b04a-44d1-9999-6a823bb9ab66","resolution":{"observed_at":"2026-05-19T14:12:24.068042Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"cited_work":{"arxiv_id":"2504.18116","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.18116","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Think, prune, train, improve: Scaling reasoning without scaling models.arXiv preprint arXiv:2504.18116","venue":null,"work_id":"0eb3f988-6ae2-4beb-9a72-47b2590d61a1","year":2025},"citing_paper":{"arxiv_id":"2506.13351","last_updated":"2026-05-07T20:19:13Z","snapshot_observed_at":"2026-08-17T13:08:52.450705Z","submitted_at":"2025-06-16T10:43:38Z","title":"Direct Reasoning Optimization: Token-Level Reasoning Reflectivity Meets Rubric Gates for Unverifiable Tasks","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-19T09:48:56.990745Z"},"links":{"cited_paper":"/paper/2504.18116","citing_paper":"/paper/2506.13351"},"observation_digest":"sha256:5600bbe17071841d2c2c5702f495a8df9120e70accd317dabc5d5204468b7e38","observation_id":"b71a2602-5e4e-42db-bc26-2cf26d7a6d0f","resolution":{"observed_at":"2026-05-19T09:52:14.119976Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18116","snapshot_observed_at":"2026-08-06T21:12:44.575215Z","title":"Fabio Duarte","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00769","last_updated":"2025-07-01T14:10:36Z","snapshot_observed_at":"2026-08-16T15:41:59.095179Z","submitted_at":"2025-07-01T14:10:36Z","title":"LitBench: A Benchmark and Dataset for Reliable Evaluation of Creative Writing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:12:44.575215Z"},"links":{"cited_paper":"/paper/2504.18116","citing_paper":"/paper/2507.00769"},"observation_digest":"sha256:6f0f43a44134d493a0d6ee66b6f259f25eb71cd3287eb5f0579e3f23c9158386","observation_id":"ef8ed2bf-a7c3-4489-99eb-6f312d11a0c4","resolution":{"observed_at":"2026-08-06T21:12:44.575215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"cited_work":{"arxiv_id":"2504.18116","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.18116","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Think, prune, train, improve: Scaling reasoning without scaling models.arXiv preprint arXiv:2504.18116","venue":null,"work_id":"0eb3f988-6ae2-4beb-9a72-47b2590d61a1","year":2025},"citing_paper":{"arxiv_id":"2507.13334","last_updated":"2025-07-21T17:48:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-17T17:50:36Z","title":"A Survey of Context Engineering for Large Language Models","version":2},"reference_index":191,"source":"pdf_text","source_observed_at":"2026-05-13T20:58:45.060041Z"},"links":{"cited_paper":"/paper/2504.18116","citing_paper":"/paper/2507.13334"},"observation_digest":"sha256:1d83e853bb6426cb725be6f74ae9d9abf07323ac97599f1aa5cecd99df9246ff","observation_id":"581a9e5e-96de-45d7-bb67-4afca74fe4b8","resolution":{"observed_at":"2026-05-13T20:58:45.155651Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18116","snapshot_observed_at":"2026-08-06T15:12:01.777554Z","title":"arXiv preprint arXiv:2504.18116 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16518","last_updated":"2026-06-24T02:00:50Z","snapshot_observed_at":"2026-08-14T10:18:10.416379Z","submitted_at":"2025-07-22T12:27:08Z","title":"SyncLoop: A Multimodal Dual-Loop Framework for Self-Improving Mathematical Reasoning","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:12:01.777554Z"},"links":{"cited_paper":"/paper/2504.18116","citing_paper":"/paper/2507.16518"},"observation_digest":"sha256:194ce10d4eb14bd3338881aee8578763d6e34b93909b1670932d7869a14d1744","observation_id":"62bdf170-c2bf-4f6e-86a1-e1b11953eb15","resolution":{"observed_at":"2026-08-06T15:12:01.777554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18116","snapshot_observed_at":"2026-08-06T04:47:21.021997Z","title":"arXiv preprint arXiv:2504.18116 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05124","last_updated":"2026-08-05T17:50:08Z","snapshot_observed_at":"2026-08-17T20:44:36.239569Z","submitted_at":"2026-08-05T17:50:08Z","title":"Chained Recursive Language Models for Multi-Iteration Reasoning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T04:47:21.021997Z"},"links":{"cited_paper":"/paper/2504.18116","citing_paper":"/paper/2608.05124"},"observation_digest":"sha256:a63a40653120c2c3441a6d8a97ad0ae46e3fb2c4875a5c649cabe51739b3c211","observation_id":"bcdd1b14-b89a-4391-8bf8-d0ac79661f03","resolution":{"observed_at":"2026-08-06T04:47:21.021997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.18116/citation-record","integrity":"/paper/2504.18116/integrity","json":"/paper/2504.18116/citation-record.json","paper":"/paper/2504.18116"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-16T10:29:18.678331Z","title":"Training Verifiers to Solve Math Word Problems , 2021 b","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.678331Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:4bbf77477b0ef1bdb0fb15906957eb562d8c0ad20fad9ae317c1c239c429cbcf","observation_id":"df37955b-165b-43b5-b25f-4ef4cbf9e0e5","resolution":{"observed_at":"2026-08-16T10:29:18.678331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14618","last_updated":"2024-04-22T23:06:42Z","snapshot_observed_at":"2026-08-16T23:10:32.223527Z","submitted_at":"2024-04-22T23:06:42Z","title":"Hybrid LLM: Cost-Efficient and Quality-Aware Query Routing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14618","snapshot_observed_at":"2026-08-16T10:29:18.681178Z","title":"DeepSeek R1: Advancing Open-Source Language Models with Reinforcement Learning and Supervised Fine-Tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.681178Z"},"links":{"cited_paper":"/paper/2404.14618","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:a9724449e362f585b4123ba0b386787ef3fed8b8318c2f50881d45312da19905","observation_id":"6501e6a1-0502-48f4-8399-773f84d5a93e","resolution":{"observed_at":"2026-08-16T10:29:18.681178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-16T10:29:18.684578Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.684578Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:4f8b2856a9fcc5fdb609d522c1985356b76bf3f16d866393cdeabdbd1844c67a","observation_id":"29975e9c-4f04-4867-8756-b3af45f025a8","resolution":{"observed_at":"2026-08-16T10:29:18.684578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01413","last_updated":"2024-04-29T23:13:42Z","snapshot_observed_at":"2026-08-16T14:04:32.950182Z","submitted_at":"2024-04-01T18:31:24Z","title":"Is Model Collapse Inevitable? Breaking the Curse of Recursion by Accumulating Real and Synthetic Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01413","snapshot_observed_at":"2026-08-16T10:29:18.691380Z","title":"Roberts, Diyi Yang, David L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.691380Z"},"links":{"cited_paper":"/paper/2404.01413","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:cc97c6d73e1470054748c21f03384545e0cd8e0e594876183af5cc7f671fafcf","observation_id":"5182a38e-35ae-47c3-bf8f-3834c8c3bbfa","resolution":{"observed_at":"2026-08-16T10:29:18.691380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-16T10:29:18.694087Z","title":"Distilling the Knowledge in a Neural Network , 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.694087Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:eaabfd93dafaca95403549f7bada4e2d938f8f172d55b03fc290d294027bc766","observation_id":"de16bbfe-712e-4a3f-9caa-6a411173fee2","resolution":{"observed_at":"2026-08-16T10:29:18.694087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06585","last_updated":"2024-04-18T03:12:09Z","snapshot_observed_at":"2026-08-16T14:35:47.075840Z","submitted_at":"2023-12-11T18:17:43Z","title":"Beyond Human Data: Scaling Self-Training for Problem-Solving with Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06585","snapshot_observed_at":"2026-08-16T10:29:18.697529Z","title":"Beyond human data: Scaling self-training for problem-solving with language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.697529Z"},"links":{"cited_paper":"/paper/2312.06585","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:9fc2ae9f8935ade59790a5599fe2595ae103f926304d92b9fb464df9d2b980d9","observation_id":"d7a45e69-b45a-45a8-98ac-eb70033b135c","resolution":{"observed_at":"2026-08-16T10:29:18.697529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05612","last_updated":"2024-05-28T23:56:14Z","snapshot_observed_at":"2026-08-16T21:17:58.141312Z","submitted_at":"2024-03-08T18:28:13Z","title":"Unfamiliar Finetuning Examples Control How Language Models Hallucinate","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05612","snapshot_observed_at":"2026-08-16T10:29:18.700736Z","title":"Unfamiliar Finetuning Examples Control How Language Models Hallucinate , 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.700736Z"},"links":{"cited_paper":"/paper/2403.05612","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:099bbd4b73f8fb1ccb362a186c93b2281c942b2da452a19475ec96bb7d2f2dff","observation_id":"8be58e89-cc4a-4a25-8134-1741564a8b89","resolution":{"observed_at":"2026-08-16T10:29:18.700736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:18.703807Z","title":"Rusu, Kieran Milan, John Quan, Tiago Ramalho, Agnieszka Grabska-Barwinska, Demis Hassabis, Claudia Clopath, Dharshan Kumaran, and Raia Hadsell","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.703807Z"},"links":{"citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:bd75333bef482cb7be8bb7dbece725026fa5986d6c6962ff96745c1114df4bf8","observation_id":"d7e197f5-ddb5-4529-ba95-330b3e026e68","resolution":{"observed_at":"2026-08-16T10:29:18.703807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:19.189748Z","title":"Modecollapse in generative adversarial networks: An overview","venue":null,"work_id":"928532ab-ab52-4bbf-882d-589b30f52f2f","year":2022},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.706818Z"},"links":{"citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:4412021a97a74686fbb65ff9bfa636ea5a0ce1f40743d332155b340b9d430bcd","observation_id":"a0896e7a-3417-4472-9fe2-eb6958b413c6","resolution":{"observed_at":"2026-08-16T10:29:19.193290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.14858","last_updated":"2022-07-01T02:15:12Z","snapshot_observed_at":"2026-08-17T10:54:45.389424Z","submitted_at":"2022-06-29T18:54:49Z","title":"Solving Quantitative Reasoning Problems with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.14858","snapshot_observed_at":"2026-08-16T10:29:18.710012Z","title":"Solving Quantitative Reasoning Problems with Language Models , 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.710012Z"},"links":{"cited_paper":"/paper/2206.14858","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:9f4101498923c4af1346e61b23c968e1eb863ecb177b45b9404cd4acf070268d","observation_id":"a782e00d-e4d6-4a23-bb08-1c62c9eeeb19","resolution":{"observed_at":"2026-08-16T10:29:18.710012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:18.713202Z","title":"Mankowitz, Esme Sutherland Robson, Pushmeet Kohli, Nando de Freitas, Koray Kavukcuoglu, and Oriol Vinyals","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.713202Z"},"links":{"citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:f30b98b0336330d1e564000cae235f822f0c677886347686ffe1629dbd0da9ba","observation_id":"54b18922-4c2e-446e-bf76-50657867d9f4","resolution":{"observed_at":"2026-08-16T10:29:18.713202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07301","last_updated":"2024-05-11T12:51:39Z","snapshot_observed_at":"2026-08-16T14:27:38.648962Z","submitted_at":"2024-01-14T14:29:07Z","title":"Small Language Model Can Self-correct","version":2},"cited_work":{"arxiv_id":"2401.07301","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.07301","snapshot_observed_at":"2026-08-16T10:29:19.053796Z","title":"Small Language Model Can Self-correct","venue":"cs.CL","work_id":"d2e88225-807b-4570-93b2-27d334c831f0","year":2024},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.716197Z"},"links":{"cited_paper":"/paper/2401.07301","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:4c9473239a45088a8745f6dd1af3c6a02c4eb733c9b918132f16eaa915ab0336","observation_id":"5f99597a-737d-4f4d-b6ee-8d3f50ba0663","resolution":{"observed_at":"2026-08-16T10:29:19.057681Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-16T10:29:18.719488Z","title":"Decoupled W eight D ecay R egularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.719488Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:7055155efbd77c9ba7de15db701847b527c443248e68b00a92c19dc8aa537681","observation_id":"d9d91eea-71ff-4a7c-a84c-60dd60d3029f","resolution":{"observed_at":"2026-08-16T10:29:18.719488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-08-17T11:00:39.333660Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-16T10:29:18.722453Z","title":"s1: Simple test-time scaling , 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.722453Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:d5a6f30650329a74e60a54c08ed2fd6f0b00e0a5cb3c017942797ba0f233c90f","observation_id":"9d528b8f-051f-479a-8fd7-0d4dfa2e5ca7","resolution":{"observed_at":"2026-08-16T10:29:18.722453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-16T10:29:18.725495Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.725495Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:60da446b9f53ea7a183a35b4915be2c2a56451560eebd7bd207e17f14f7eb26d","observation_id":"081eaf4b-e20b-4895-95ad-5469d2390b93","resolution":{"observed_at":"2026-08-16T10:29:18.725495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-18T14:12:03.598270Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-16T10:29:18.728358Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.728358Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:83c25fdb0c9e9764db9248c3467aa98c4d05e68d5921242727a5843a9ad0def7","observation_id":"bdbd755b-0bbd-48af-b871-e2a4c3417be6","resolution":{"observed_at":"2026-08-16T10:29:18.728358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-16T10:29:18.731564Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.731564Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:431e9f34893add42792e3616194cc11811667c9eb056ace6dfa1be94e4981fad","observation_id":"a8aacbcb-5940-45bb-aea5-318db137dd21","resolution":{"observed_at":"2026-08-16T10:29:18.731564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14532","last_updated":"2024-06-20T17:45:54Z","snapshot_observed_at":"2026-08-18T01:34:43.149879Z","submitted_at":"2024-06-20T17:45:54Z","title":"RL on Incorrect Synthetic Data Scales the Efficiency of LLM Math Reasoning by Eight-Fold","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14532","snapshot_observed_at":"2026-08-16T10:29:18.734408Z","title":"RL on I ncorrect S ynthetic D ata S cales the E fficiency of LLM M ath R easoning by E ight- F old, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.734408Z"},"links":{"cited_paper":"/paper/2406.14532","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:eb26f14c3e76655fb12efc1c0548e95c98a15a9b89ed266e1740e753939429e7","observation_id":"be6fbbd6-16f3-422e-9655-d73eca963c94","resolution":{"observed_at":"2026-08-16T10:29:18.734408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:18.737211Z","title":"Shumailov, Z","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.737211Z"},"links":{"citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:3348e0a35d1a595a3c7422ba26a4d413039959a26ce3f5404ef344cf535333b8","observation_id":"b6ed649a-eebb-4480-b3a0-a349b4c50cfe","resolution":{"observed_at":"2026-08-16T10:29:18.737211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:19.172320Z","title":"Taori, I","venue":null,"work_id":"cfe5ca39-c447-4dea-9af2-ec78d0336c59","year":2023},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.739911Z"},"links":{"citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:fbf1f6e6ac4a284c5b456a7e438b10c81272d85ffb4b40e6b9a8c6c8f7ff1fdd","observation_id":"fe95064a-ddb3-4203-b404-ce569541ce96","resolution":{"observed_at":"2026-08-16T10:29:19.175854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11409","last_updated":"2024-06-19T02:37:50Z","snapshot_observed_at":"2026-08-16T21:13:11.293578Z","submitted_at":"2024-06-17T10:54:35Z","title":"CodeGemma: Open Code Models Based on Gemma","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11409","snapshot_observed_at":"2026-08-16T10:29:18.742586Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.742586Z"},"links":{"cited_paper":"/paper/2406.11409","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:3a378779342b6727aa522a634e3481de64008c1c1af8e2fcf2efa7f006e926b0","observation_id":"b9931bc2-bb6b-4988-ae01-aa3773a14e6b","resolution":{"observed_at":"2026-08-16T10:29:18.742586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-16T10:29:18.745214Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.745214Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:8f54f0291b9e077b092891e28e08d759fef0f6a804ed2832d5aa8f20837d4528","observation_id":"e4f134f3-9b6a-407e-aefe-d12bd6e3f4aa","resolution":{"observed_at":"2026-08-16T10:29:18.745214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09960","last_updated":"2024-11-11T08:33:17Z","snapshot_observed_at":"2026-08-16T14:42:38.809748Z","submitted_at":"2023-11-16T15:30:23Z","title":"Manifestation of edge-bulk incompatibility in fractional quantum Hall platform","version":2},"cited_work":{"arxiv_id":"2311.09960","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.09960","snapshot_observed_at":"2026-08-16T10:29:18.945423Z","title":"Manifestation of edge-bulk incompatibility in fractional quantum Hall platform","venue":"cond-mat.mes-hall","work_id":"a4129bd7-417c-427e-a247-209b78bc9d2c","year":2023},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.748180Z"},"links":{"cited_paper":"/paper/2311.09960","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:85e4ed21838e07969aa14c537990350eee96d5b543f8aaf95f96107cf67cf4dc","observation_id":"d76e3437-6bc1-4576-abf4-cc03a26ab7df","resolution":{"observed_at":"2026-08-16T10:29:18.948846Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06789","last_updated":"2024-02-09T21:22:45Z","snapshot_observed_at":"2026-08-16T14:19:45.460398Z","submitted_at":"2024-02-09T21:22:45Z","title":"ELM-free Enhanced D{\\alpha} H-mode with Near Zero NBI Torque Injection in DIII-D Tokamak","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06789","snapshot_observed_at":"2026-08-16T10:29:18.750834Z","title":"Rest-em: Expectation maximization for reinforced self-training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.750834Z"},"links":{"cited_paper":"/paper/2402.06789","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:cab8048e0bb99c4ecfdc3b2ae5132a606585d1d1b5c578fd1386c8d67e29a33a","observation_id":"a9f4ea08-cf17-4cd7-8bd4-ba8974e4a136","resolution":{"observed_at":"2026-08-16T10:29:18.750834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01299","last_updated":"2024-03-21T08:35:04Z","snapshot_observed_at":"2026-08-16T14:22:11.586254Z","submitted_at":"2024-02-02T10:41:46Z","title":"Almost sure and moment convergence for triangular P\\'olya urns","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01299","snapshot_observed_at":"2026-08-16T10:29:18.753595Z","title":"Vine ppo: Variance-reduced proximal policy optimization for efficient learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.753595Z"},"links":{"cited_paper":"/paper/2402.01299","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:0b52342e9ab7826c777fb622bc27ab1187cfa416484e61fa1eaac8418153e632","observation_id":"2ef5b236-8576-4739-91e3-bf93308f28d7","resolution":{"observed_at":"2026-08-16T10:29:18.753595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10560","last_updated":"2023-05-25T23:50:07Z","snapshot_observed_at":"2026-08-17T06:16:40.579073Z","submitted_at":"2022-12-20T18:59:19Z","title":"Self-Instruct: Aligning Language Models with Self-Generated Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10560","snapshot_observed_at":"2026-08-16T10:29:18.756661Z","title":"Self-instruct: Aligning language models with instruction data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.756661Z"},"links":{"cited_paper":"/paper/2212.10560","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:bbeeb462be3c74d626b7442bbd07b5929b0df3234f6fe093b19347a79b21cdc0","observation_id":"cf9fe5e4-6787-4d08-8521-f84d1f19b17f","resolution":{"observed_at":"2026-08-16T10:29:18.756661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01786","last_updated":"2024-01-03T15:27:10Z","snapshot_observed_at":"2026-08-16T14:30:04.271373Z","submitted_at":"2024-01-03T15:27:10Z","title":"An experimental sorting method for improving metagenomic data encoding","version":1},"cited_work":{"arxiv_id":"2401.01786","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.01786","snapshot_observed_at":"2026-08-16T10:29:18.898052Z","title":"An experimental sorting method for improving metagenomic data encoding","venue":"cs.IT","work_id":"e86b6f91-5c79-424c-ba92-f5d230ebe9da","year":2024},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.759697Z"},"links":{"cited_paper":"/paper/2401.01786","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:756148e37ca5571e3e5b343c6e9c707241ea9ad8c7f172772a0d1ce2f0154244","observation_id":"9cb92f36-840e-457d-a07e-928dd7079e27","resolution":{"observed_at":"2026-08-16T10:29:18.903624Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-16T17:11:25.867747Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-16T10:29:18.763056Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.763056Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:9f852284b9e307bea8503a68951a1a056d6a73c48e7b498e5c64a39bfeabaecd","observation_id":"e8796403-773c-46c3-9b08-f21577d8ddc3","resolution":{"observed_at":"2026-08-16T10:29:18.763056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:18.766197Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.766197Z"},"links":{"citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:2cbc750b7ac06feae4fb913d69b8f32270e53fbdd5c10de768c9bec949656bbe","observation_id":"6785450e-fe14-4fee-bf61-8f66673491bc","resolution":{"observed_at":"2026-08-16T10:29:18.766197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:18.769485Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.769485Z"},"links":{"citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:9493285bcfce22279f60c14cfac6e8301f5f00ae0149c40351637e8554c9ea55","observation_id":"5075d6e8-c6b8-4bbf-bffb-7583df3750d6","resolution":{"observed_at":"2026-08-16T10:29:18.769485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:18.772749Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.772749Z"},"links":{"citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:2c489a6604195dfad19b27373173986556cf21eeac1ac50e836acb129103b885","observation_id":"2ab4f4dd-ce3f-42fd-a3b7-afaa34bda0dc","resolution":{"observed_at":"2026-08-16T10:29:18.772749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:29:18.775808Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T10:29:18.775808Z"},"links":{"citing_paper":"/paper/2504.18116"},"observation_digest":"sha256:c0d30f10b885a85abd04632506f7d5f05a3d2439ea9b451bd41a616518ef3760","observation_id":"fb5e19c7-cbd3-4c50-bec7-08e3991c8ebf","resolution":{"observed_at":"2026-08-16T10:29:18.775808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.18116","last_updated":"2025-04-25T06:48:55Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T21:14:07.071449Z","submitted_at":"2025-04-25T06:48:55Z","title":"Think, Prune, Train, Improve: Scaling Reasoning without Scaling Models"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":27,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 7 inbound Pith citation observations for arXiv:2504.18116."}