{"as_of":"2026-08-14T12:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b4c459ba63c0f6273c26e26dea40608580cda14df3a79323aa5d7b3a31f112b1","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:39:04.514038Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.24181/citation-record","integrity":"/paper/2505.24181/integrity","json":"/paper/2505.24181/citation-record.json","paper":"/paper/2505.24181"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:38:57.588290Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:57.588290Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:4d72ce5cc93d4319afa8dae3b61ac5577c78bbf667507630ab608f5a88ebc444","observation_id":"dde7aa3c-ed48-48dc-9334-dde0d9709418","resolution":{"observed_at":"2026-08-07T12:38:57.588290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03493","last_updated":"2022-10-07T12:28:21Z","snapshot_observed_at":"2026-07-06T14:01:50.333970Z","submitted_at":"2022-10-07T12:28:21Z","title":"Automatic Chain of Thought Prompting in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03493","snapshot_observed_at":"2026-08-07T12:38:57.689702Z","title":"Automatic chain of thought prompting in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:57.689702Z"},"links":{"cited_paper":"/paper/2210.03493","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:004e71fe6f4337798bf19b61500102592451450857c66ef1259f3b757bc01dcc","observation_id":"b5544222-9afa-4a04-8d7a-509298b1f0b5","resolution":{"observed_at":"2026-08-07T12:38:57.689702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12246","last_updated":"2024-07-21T08:01:00Z","snapshot_observed_at":"2026-08-13T12:38:33.484991Z","submitted_at":"2023-02-23T18:58:59Z","title":"Active Prompting with Chain-of-Thought for Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12246","snapshot_observed_at":"2026-08-07T12:38:57.802936Z","title":"Active prompting with chain-of-thought for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:57.802936Z"},"links":{"cited_paper":"/paper/2302.12246","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:981019799d334f410b6f32e591c1cb6a53a04744f7163165ddcc31696f4bfe94","observation_id":"c754ec0a-1e7d-4e88-a383-b57181211238","resolution":{"observed_at":"2026-08-07T12:38:57.802936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05171","last_updated":"2025-02-17T17:14:04Z","snapshot_observed_at":"2026-08-14T12:01:37.068975Z","submitted_at":"2025-02-07T18:55:02Z","title":"Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05171","snapshot_observed_at":"2026-08-07T12:38:57.951899Z","title":"Scaling up test-time compute with latent reasoning: A recurrent depth approach","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:57.951899Z"},"links":{"cited_paper":"/paper/2502.05171","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:d359ecfc178c820758810d81b6f97ca7b7479e9e8c64562f0996c0441c099d4d","observation_id":"cb28468c-7a37-4518-924f-54e70fca265f","resolution":{"observed_at":"2026-08-07T12:38:57.951899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:06.229590Z","title":"On the inductive bias of stacking towards improving reasoning","venue":null,"work_id":"b310846c-7006-45aa-8379-7b57f88a6dbf","year":2024},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:58.094665Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:cc1da60ef8c89e0f007d7a7e840e6d4cd8f0fc7a62e6e34414773183a7963e4f","observation_id":"7d448e25-ed0b-457a-b9fe-a9ade83eb831","resolution":{"observed_at":"2026-08-07T12:39:06.395439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12214","last_updated":"2025-02-17T04:37:22Z","snapshot_observed_at":"2026-08-14T07:32:50.649502Z","submitted_at":"2025-02-17T04:37:22Z","title":"Zero Token-Driven Deep Thinking in LLMs: Unlocking the Full Potential of Existing Parameters via Cyclic Refinement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12214","snapshot_observed_at":"2026-08-07T12:38:58.257097Z","title":"Zero token-driven deep thinking in llms: Unlocking the full potential of existing parameters via cyclic refinement","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:58.257097Z"},"links":{"cited_paper":"/paper/2502.12214","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:ba57e4c4626b87d40f9380848115f9bd9dd8b665f85a34fb5b8b1b9916d676ab","observation_id":"313c5f69-0ace-448c-9ea0-494ca7f5c280","resolution":{"observed_at":"2026-08-07T12:38:58.257097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17416","last_updated":"2025-02-24T18:49:05Z","snapshot_observed_at":"2026-08-12T17:52:51.001662Z","submitted_at":"2025-02-24T18:49:05Z","title":"Reasoning with Latent Thoughts: On the Power of Looped Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17416","snapshot_observed_at":"2026-08-07T12:38:58.395003Z","title":"Reasoning with latent thoughts: On the power of looped transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:58.395003Z"},"links":{"cited_paper":"/paper/2502.17416","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:3c6ff335ce00f9fb32e19c52c7c7d1f031193286584d4191d0b59d571e0f6a62","observation_id":"9f4f3ba8-e72d-40ff-9ee7-72bce75c6385","resolution":{"observed_at":"2026-08-07T12:38:58.395003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20672","last_updated":"2025-02-28T16:44:24Z","snapshot_observed_at":"2026-08-12T22:14:08.632340Z","submitted_at":"2024-10-28T02:15:45Z","title":"Relaxed Recursive Transformers: Effective Parameter Sharing with Layer-wise LoRA","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20672","snapshot_observed_at":"2026-08-07T12:38:58.565382Z","title":"Relaxed recursive transformers: Effective parameter sharing with layer-wise lora.arXiv preprint arXiv:2410.20672, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:58.565382Z"},"links":{"cited_paper":"/paper/2410.20672","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:cc4ffa128a71a3f419e048f1028570b1694326ddd61ebad750ebef1036f2c26d","observation_id":"630c0bab-e66f-40da-9c36-a46d52065b34","resolution":{"observed_at":"2026-08-07T12:38:58.565382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02406","last_updated":"2023-04-11T19:39:17Z","snapshot_observed_at":"2026-08-10T13:37:57.622090Z","submitted_at":"2022-10-05T17:28:20Z","title":"Decomposed Prompting: A Modular Approach for Solving Complex Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02406","snapshot_observed_at":"2026-08-07T12:38:58.706064Z","title":"Decomposed prompting: A modular approach for solving complex tasks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:58.706064Z"},"links":{"cited_paper":"/paper/2210.02406","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:35ab9d4dd201a673123e042ea1075705b13e826416930505f98871ab965fa31e","observation_id":"10cbbbc7-e76b-49f5-ae66-853b43d1d359","resolution":{"observed_at":"2026-08-07T12:38:58.706064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10625","last_updated":"2023-04-16T22:08:08Z","snapshot_observed_at":"2026-08-06T09:00:42.886249Z","submitted_at":"2022-05-21T15:34:53Z","title":"Least-to-Most Prompting Enables Complex Reasoning in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10625","snapshot_observed_at":"2026-08-07T12:38:58.829085Z","title":"Least-to-most prompting enables complex reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:58.829085Z"},"links":{"cited_paper":"/paper/2205.10625","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:a154ea7f9e2f6377cf178731a3633b6c8696d3501907e238e7c1c199c7773029","observation_id":"2adcf3b0-d984-479c-a18c-2544c3837247","resolution":{"observed_at":"2026-08-07T12:38:58.829085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05653","last_updated":"2023-10-03T02:48:42Z","snapshot_observed_at":"2026-08-07T14:43:09.380195Z","submitted_at":"2023-09-11T17:47:22Z","title":"MAmmoTH: Building Math Generalist Models through Hybrid Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05653","snapshot_observed_at":"2026-08-07T12:38:58.990243Z","title":"Mammoth: Building math generalist models through hybrid instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:58.990243Z"},"links":{"cited_paper":"/paper/2309.05653","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:834a67a2f457f59d2f4a9ddb4e5ea3284b552fa3eb722e35f706afe040bc3006","observation_id":"506b41a4-bf4b-49d9-9a15-72af3a406299","resolution":{"observed_at":"2026-08-07T12:38:58.990243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-13T10:57:13.012119Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-07T12:38:59.160941Z","title":"Metamath: Bootstrap your own mathematical questions for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:59.160941Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:1befde3dff50e33a1c048589a8cba7b8b771646abebf283799a3a5415d135316","observation_id":"0d73ee2a-9e30-4d1c-adc5-174283bca839","resolution":{"observed_at":"2026-08-07T12:38:59.160941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08935","last_updated":"2024-02-19T14:07:53Z","snapshot_observed_at":"2026-08-14T10:08:59.886019Z","submitted_at":"2023-12-14T13:41:54Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08935","snapshot_observed_at":"2026-08-07T12:38:59.313349Z","title":"Math-shepherd: Verify and reinforce llms step-by-step without human annotations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:59.313349Z"},"links":{"cited_paper":"/paper/2312.08935","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:42d5ee8358f08c0e364ee3edad7a524753d331081a9eaa342ccd78c1e1ad4424","observation_id":"389e2b64-ab36-4053-a795-36153396c59b","resolution":{"observed_at":"2026-08-07T12:38:59.313349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05673","last_updated":"2025-05-27T03:51:13Z","snapshot_observed_at":"2026-08-12T23:47:07.771336Z","submitted_at":"2024-06-09T07:06:58Z","title":"Flow of Reasoning: Training LLMs for Divergent Reasoning with Minimal Examples","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05673","snapshot_observed_at":"2026-08-07T12:38:59.455169Z","title":"Flow of reasoning: Efficient training of llm policy with divergent thinking","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:59.455169Z"},"links":{"cited_paper":"/paper/2406.05673","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:36e03d24ad679c0b92b18753f1478a74867d98b8d50de3ddf2320bbb2e1a10e4","observation_id":"1ca5d673-53dc-49c1-84be-7ffa980db0f6","resolution":{"observed_at":"2026-08-07T12:38:59.455169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04642","last_updated":"2024-03-07T16:36:29Z","snapshot_observed_at":"2026-08-13T00:59:58.573803Z","submitted_at":"2024-03-07T16:36:29Z","title":"Teaching Large Language Models to Reason with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04642","snapshot_observed_at":"2026-08-07T12:38:59.544322Z","title":"Teaching large language models to reason with reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:59.544322Z"},"links":{"cited_paper":"/paper/2403.04642","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:588e8439e3012af75b18a307c1c9a3198404297050e76027b7b984eca551c66b","observation_id":"7e35f750-3716-42a7-88b1-4dbb4526b9d0","resolution":{"observed_at":"2026-08-07T12:38:59.544322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:38:59.702864Z","title":"Towards revealing the mystery behind chain of thought: a theoretical perspective","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:59.702864Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:830da3c988d916d1e7cd1a4ca3d79f7a5e0eff214ad12aa8fad69551318099b4","observation_id":"442c5e99-b733-4c97-8aa2-459008e02f7f","resolution":{"observed_at":"2026-08-07T12:38:59.702864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07686","last_updated":"2022-10-13T06:24:37Z","snapshot_observed_at":"2026-08-13T14:25:23.754200Z","submitted_at":"2022-09-16T02:54:00Z","title":"Text and Patterns: For Effective Chain of Thought, It Takes Two to Tango","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07686","snapshot_observed_at":"2026-08-07T12:38:59.858611Z","title":"Text and patterns: For effective chain of thought, it takes two to tango","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:59.858611Z"},"links":{"cited_paper":"/paper/2209.07686","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:737194189aef0c7b9444a554a15f6d307e79c2cfa39b8e44466b9242a3b5e1be","observation_id":"d0f4a3e7-eec9-429e-9811-e6e2436cd3dd","resolution":{"observed_at":"2026-08-07T12:38:59.858611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09629","last_updated":"2024-03-18T07:56:48Z","snapshot_observed_at":"2026-08-14T11:24:43.688110Z","submitted_at":"2024-03-14T17:58:16Z","title":"Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09629","snapshot_observed_at":"2026-08-07T12:38:59.965565Z","title":"Quiet-star: Language models can teach themselves to think before speaking","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:59.965565Z"},"links":{"cited_paper":"/paper/2403.09629","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:fdcbb443a7873951ddee2006ff55e02ead84fe0bee641095fc458b645de357c9","observation_id":"412d19c6-9ed3-41f9-994b-9684f7cccb7f","resolution":{"observed_at":"2026-08-07T12:38:59.965565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01460","last_updated":"2023-11-02T17:59:49Z","snapshot_observed_at":"2026-08-13T05:33:56.458507Z","submitted_at":"2023-11-02T17:59:49Z","title":"Implicit Chain of Thought Reasoning via Knowledge Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01460","snapshot_observed_at":"2026-08-07T12:39:00.066896Z","title":"Implicit chain of thought reasoning via knowledge distillation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:00.066896Z"},"links":{"cited_paper":"/paper/2311.01460","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:b9dde5edd46bc3c526818e69e48c21d0e9137d1d5f08e37c167cb7a2f17baa6b","observation_id":"baa17150-f9e6-4f3c-a93c-994f0a5da3ad","resolution":{"observed_at":"2026-08-07T12:39:00.066896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06769","last_updated":"2025-11-03T00:53:34Z","snapshot_observed_at":"2026-08-07T06:05:27.895209Z","submitted_at":"2024-12-09T18:55:56Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06769","snapshot_observed_at":"2026-08-07T12:39:00.128176Z","title":"Training large language models to reason in a continuous latent space","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:00.128176Z"},"links":{"cited_paper":"/paper/2412.06769","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:9567782a20aab9c8160db1df8e8f466f01cda9c499fabed38b0084fa633f7504","observation_id":"8eef7af6-2169-4f1a-9e79-346184e6a43f","resolution":{"observed_at":"2026-08-07T12:39:00.128176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03819","last_updated":"2019-03-05T16:46:19Z","snapshot_observed_at":"2026-08-13T07:34:17.550838Z","submitted_at":"2018-07-10T18:39:15Z","title":"Universal Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03819","snapshot_observed_at":"2026-08-07T12:39:00.231480Z","title":"Uni- versal transformers","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:00.231480Z"},"links":{"cited_paper":"/paper/1807.03819","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:99c70260a30319101ead17f52df3f86448a3b3663d7e705ebd6207a0a0159353","observation_id":"ef4547e2-1f80-4b00-8d1d-3a9278426291","resolution":{"observed_at":"2026-08-07T12:39:00.231480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:00.341507Z","title":"Looped transformers as programmable computers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:00.341507Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:9156177a89354c98f6bac8c2d8862d21799d920b466de6ec96ff0f4a778a7541","observation_id":"f426f003-757e-443c-991e-ed36f67f5254","resolution":{"observed_at":"2026-08-07T12:39:00.341507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15647","last_updated":"2025-05-12T03:51:20Z","snapshot_observed_at":"2026-08-12T22:39:05.389967Z","submitted_at":"2024-09-24T01:21:17Z","title":"Looped Transformers for Length Generalization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15647","snapshot_observed_at":"2026-08-07T12:39:00.469205Z","title":"Looped transformers for length generalization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:00.469205Z"},"links":{"cited_paper":"/paper/2409.15647","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:9917815194d39386ccd8d66deecdf7f63398b3adf26366ff5685e974ab4a64b8","observation_id":"18ca2c93-1902-4af6-bec1-5eca8dbfa16a","resolution":{"observed_at":"2026-08-07T12:39:00.469205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07096","last_updated":"2023-10-11T00:38:57Z","snapshot_observed_at":"2026-08-13T05:52:35.270837Z","submitted_at":"2023-10-11T00:38:57Z","title":"Sparse Universal Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07096","snapshot_observed_at":"2026-08-07T12:39:00.595174Z","title":"Sparse universal transformer","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:00.595174Z"},"links":{"cited_paper":"/paper/2310.07096","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:1da1869c13cc7bc63de165292e9c159cc474b6f306ff21cda3d91153119ec86b","observation_id":"0be0c23a-6cb7-4995-b056-ce92355cf768","resolution":{"observed_at":"2026-08-07T12:39:00.595174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15166","last_updated":"2024-04-04T01:53:38Z","snapshot_observed_at":"2026-08-13T04:54:52.394295Z","submitted_at":"2023-12-23T05:11:37Z","title":"SOLAR 10.7B: Scaling Large Language Models with Simple yet Effective Depth Up-Scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15166","snapshot_observed_at":"2026-08-07T12:39:00.710124Z","title":"Solar 10.7 b: Scaling large language models with simple yet effective depth up-scaling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:00.710124Z"},"links":{"cited_paper":"/paper/2312.15166","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:c78fc6874a36aadafea7c1fd319644938f0263cd0b72aec26ffc36c7fba9df5d","observation_id":"42830951-779f-4436-8dae-cfbc2b4694e2","resolution":{"observed_at":"2026-08-07T12:39:00.710124Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-07T12:39:00.869712Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:00.869712Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:457953d8570dcd20a6162d4458c5dbcfc8f3a0dad2431e5e400b2390dc4e5e5c","observation_id":"d2c56fc4-33c1-4159-a480-c4f16df5e15c","resolution":{"observed_at":"2026-08-07T12:39:00.869712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:01.014315Z","title":"Knowledge distillation: A survey","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:01.014315Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:9f80bd1a33694d1327e751392d7668078f269f6628b78f7ea53d0943d7da9431","observation_id":"6fbc69df-34b4-4764-a4b6-4a45d8a3c26c","resolution":{"observed_at":"2026-08-07T12:39:01.014315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:05.949084Z","title":"Distilling knowledge via knowledge review","venue":null,"work_id":"cc1b4f3a-2358-4fac-b6c7-906c197e7f70","year":2021},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:01.182373Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:31598d7ae7c2adcb184f75e0f36fe08642cafda6ff7c259a421fbee619e83902","observation_id":"82929eb2-9a40-46bd-ba10-b015aa6cc8d7","resolution":{"observed_at":"2026-08-07T12:39:06.085085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:01.309476Z","title":"Sequence-level knowledge distillation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:01.309476Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:0ffa8cb62121ae3cc6f761ba3889e96ff8785db3e6c2f1b332f7cd9529bc8b07","observation_id":"3bf4fef3-6d33-425d-b912-c3026e9b5dc7","resolution":{"observed_at":"2026-08-07T12:39:01.309476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-07T12:39:01.463910Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:01.463910Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:3d53ecf147c4cb6a048ef5666c8524a5786ace0277ac38f33dac70b3f743871d","observation_id":"d38df3ce-806f-439c-af65-295494651df8","resolution":{"observed_at":"2026-08-07T12:39:01.463910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07013","last_updated":"2024-11-09T01:35:32Z","snapshot_observed_at":"2026-08-14T08:36:11.123918Z","submitted_at":"2024-01-13T08:43:32Z","title":"Knowledge Distillation of Black-Box Large Language Models","version":2},"cited_work":{"arxiv_id":"2401.07013","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.07013","snapshot_observed_at":"2026-08-07T12:39:04.696308Z","title":"Knowledge Distillation of Black-Box Large Language Models","venue":"cs.CL","work_id":"7aee2a80-d906-44d3-90c8-a77d8f7e3f34","year":2024},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:01.590937Z"},"links":{"cited_paper":"/paper/2401.07013","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:d051712b8d73f9051afd611d2509c140309cebb0f4200706247e8c0dfacf7022","observation_id":"14285c21-d0ad-49fb-946a-5807509d2a78","resolution":{"observed_at":"2026-08-07T12:39:04.865329Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02019","last_updated":"2023-10-24T17:58:42Z","snapshot_observed_at":"2026-08-13T10:40:59.072764Z","submitted_at":"2023-08-03T20:20:01Z","title":"Baby Llama: knowledge distillation from an ensemble of teachers trained on a small dataset with no performance penalty","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02019","snapshot_observed_at":"2026-08-07T12:39:01.792404Z","title":"Baby llama: knowledge distillation from an en- semble of teachers trained on a small dataset with no performance penalty","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:01.792404Z"},"links":{"cited_paper":"/paper/2308.02019","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:866e178d8f03ffd831ac44c89dde98f9138fe233394ac3a159949c8f8ef7f74d","observation_id":"7ef4a804-9d0b-4784-8126-ff010bf97736","resolution":{"observed_at":"2026-08-07T12:39:01.792404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:05.681716Z","title":"Less is more: Task-aware layer-wise distillation for language model compression","venue":null,"work_id":"126fed50-e54a-4fc5-b34c-e872fe488b34","year":2023},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:01.947628Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:03efb74751773d90a903dd9a4a86f6eec51794f57eaa2e44a800f989ee253244","observation_id":"1bb69e46-97fc-4539-be92-676476e448e2","resolution":{"observed_at":"2026-08-07T12:39:05.794012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:02.060479Z","title":"On the efficacy of knowledge distillation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:02.060479Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:a39e0f56f642bbdb3df6e377e37ded9352c620e8a196ff7503f6cc0598cd72b4","observation_id":"e476cb93-e62d-4242-a20d-9fa7adadab03","resolution":{"observed_at":"2026-08-07T12:39:02.060479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:02.170928Z","title":"Improved knowledge distillation via teacher assistant","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:02.170928Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:9662a43b5ca404ae9b7dc4f22714df0898ac67322da2c945b300796751973487","observation_id":"04849e67-5717-454d-8d36-ebca2d9c7489","resolution":{"observed_at":"2026-08-07T12:39:02.170928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08606","last_updated":"2025-07-25T16:55:43Z","snapshot_observed_at":"2026-08-13T20:59:35.843786Z","submitted_at":"2025-02-12T17:52:47Z","title":"Distillation Scaling Laws","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08606","snapshot_observed_at":"2026-08-07T12:39:02.284171Z","title":"Distillation scaling laws","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:02.284171Z"},"links":{"cited_paper":"/paper/2502.08606","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:5dd335bc49c872de44a9260ede8a1f7811806b412711d1d825c1eec7e236de0f","observation_id":"7e70aa5e-28f4-4b46-9fbd-1b76d123f189","resolution":{"observed_at":"2026-08-07T12:39:02.284171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:02.394080Z","title":"Qwen2.5: A party of foundation models, September 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:02.394080Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:faa3f6aa8c382188c2ac2de6bff228117a57d39071f81174b7b873f1c36d917b","observation_id":"9b232ca3-5d9f-449f-b267-2cc340b1e6ea","resolution":{"observed_at":"2026-08-07T12:39:02.394080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:02.468310Z","title":"Free dolly: Introducing the world’s first truly open instruction-tuned llm, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:02.468310Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:2bf2e21a2aceda227eee06d6c7d1d62f2d53d86f9b1ec20f1610f594534417e6","observation_id":"42f26d79-e360-44cc-87fa-62f8e73b84a0","resolution":{"observed_at":"2026-08-07T12:39:02.468310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T12:39:02.566365Z","title":"Qwen2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:02.566365Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:84b2d34e75dd7e13dd7350de19ce9acec53f94a312563054aa058725baab5120","observation_id":"11039d38-8b1c-4a15-ac1d-1bd663373f48","resolution":{"observed_at":"2026-08-07T12:39:02.566365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:02.715723Z","title":"Llamafactory: Unified efficient fine-tuning of 100+ language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:02.715723Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:686ee2110c3218de2e52a0504d4692aa646960219d54dffa9a927f6f0072a314","observation_id":"01ee158a-021f-472b-a3c8-aa00a2f29eb7","resolution":{"observed_at":"2026-08-07T12:39:02.715723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03277","last_updated":"2023-04-06T17:58:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-06T17:58:09Z","title":"Instruction Tuning with GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03277","snapshot_observed_at":"2026-08-07T12:39:02.839854Z","title":"Instruction tuning with gpt-4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:02.839854Z"},"links":{"cited_paper":"/paper/2304.03277","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:6a0083ffaad12d4e60865573fa2cc01ed12d160019159509d4d68ba4b08bd0b5","observation_id":"35f82636-5f70-4a7b-8e4a-17c1677b1682","resolution":{"observed_at":"2026-08-07T12:39:02.839854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:05.439815Z","title":"Alpaca-cot: An instruction fine-tuning platform with instruction data collection and unified large language models interface","venue":null,"work_id":"d698ed09-9c50-4b25-a789-e8e6acd8aeed","year":2023},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:02.907156Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:cfcd19c18e02881c56f32c0c4ffe6cc9915da312446f746b7870400d339e6667","observation_id":"42b94e28-e775-47d2-bc4c-569bda335970","resolution":{"observed_at":"2026-08-07T12:39:05.548689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:05.255834Z","title":"WikiQA: A challenge dataset for open-domain question answering","venue":null,"work_id":"b5e4c956-412b-45a3-a9d7-ad36d0b6c1ef","year":2015},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:03.014947Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:67c9d25943b7a190eee40e6525c20083a141545956a9d144f276b1dbf7df4c07","observation_id":"5ae7f865-bba1-42c4-a332-6745888e0355","resolution":{"observed_at":"2026-08-07T12:39:05.326404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:03.123651Z","title":"Code alpaca: An instruction-following llama model for code generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:03.123651Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:18b76a5a44e03c559cf6d3d5ac42b1a31c7c94da694567d53c204aad479fc5e1","observation_id":"16eb53f3-4dc6-4d3c-a7e2-5ea84c40a0b6","resolution":{"observed_at":"2026-08-07T12:39:03.123651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02657","last_updated":"2024-12-08T13:03:38Z","snapshot_observed_at":"2026-08-13T00:38:33.059372Z","submitted_at":"2024-04-03T11:40:17Z","title":"Rethinking Kullback-Leibler Divergence in Knowledge Distillation for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02657","snapshot_observed_at":"2026-08-07T12:39:03.256973Z","title":"Rethinking kullback-leibler divergence in knowledge distillation for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:03.256973Z"},"links":{"cited_paper":"/paper/2404.02657","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:c4f37bc7b9950b87c2e78c4bb1d42eae381c2dc7d3b69f84b0cfcf206e512969","observation_id":"1a2e754c-441d-433e-82b2-00cc8baccd60","resolution":{"observed_at":"2026-08-07T12:39:03.256973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:03.371133Z","title":"The language model evaluation harness, 07 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:03.371133Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:cd6423fe44bfa4556fe1001ba96d8730ce84ce2b04084dd0e50521eb8050ad2c","observation_id":"e1f90421-514d-4098-80ee-5681845a4196","resolution":{"observed_at":"2026-08-07T12:39:03.371133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T12:39:03.496024Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:03.496024Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:d74a9e1aaa19e8bd0a60b8fb1872a40e50cc66c923de25cd542889ffbde7e949","observation_id":"5c14a53f-ea7c-4ca0-9937-38af2789aca1","resolution":{"observed_at":"2026-08-07T12:39:03.496024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:03.649952Z","title":"Can a suit of armor conduct electricity? a new dataset for open book question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:03.649952Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:9fc11a086402588fd35c64dcb96b7d031e4c68105cb747591e2767ba9f655693","observation_id":"cff1fc21-6759-4fdf-8161-a842998c528e","resolution":{"observed_at":"2026-08-07T12:39:03.649952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:03.809506Z","title":"TruthfulQA: Measuring how models mimic human falsehoods","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:03.809506Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:9619c1240954d4f22906d2fb2f990b48df987d7aa7ef69b24e93e688a334153e","observation_id":"dcb00a52-b591-4748-8654-26589f9663cd","resolution":{"observed_at":"2026-08-07T12:39:03.809506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:03.933993Z","title":"Training verifiers to solve math word problems, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:03.933993Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:ff34ae362c010ee7117719bd139498b8ee347e4fc5f875db66b644071b777f2c","observation_id":"2459a287-42da-4e4c-9a83-08be351e21e0","resolution":{"observed_at":"2026-08-07T12:39:03.933993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:04.032383Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:04.032383Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:4c7352a57e52013f23b6dc6dee196a92ecbe933279cc1a9790073085ba04117d","observation_id":"6adf213a-003e-43a6-82a2-a4031cb5b3e1","resolution":{"observed_at":"2026-08-07T12:39:04.032383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:39:04.212066Z","title":"Coqa: A conversational question answering challenge","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:04.212066Z"},"links":{"citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:6bbca38b8084cb71a3143e0299deb19973c4573eeb7cb2cb1b1cfe6a74a822ab","observation_id":"869e1db9-55b1-4c01-a24d-4c0d66542232","resolution":{"observed_at":"2026-08-07T12:39:04.212066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-07T12:39:04.370193Z","title":"Glue: A multi-task benchmark and analysis platform for natural language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:04.370193Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:68aee9bfd9b2043ca2cd4b44af464ceafbb67621cbe5d23c4b58c99bec7a79f5","observation_id":"53ebe8ae-81dc-4217-aae2-0f77c72c3473","resolution":{"observed_at":"2026-08-07T12:39:04.370193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-07T12:39:04.514038Z","title":"half–half–0","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:04.514038Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2505.24181"},"observation_digest":"sha256:7419faf334b736353f48db5db730c0aed22755b4b7a3f89f981657a24b7f0c00","observation_id":"96f43904-4d0e-4ab3-a015-075e711a745f","resolution":{"observed_at":"2026-08-07T12:39:04.514038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.24181","last_updated":"2025-05-30T03:43:24Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-13T00:40:42.514633Z","submitted_at":"2025-05-30T03:43:24Z","title":"SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2505.24181."}