{"as_of":"2026-08-15T21:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:25d6da86ec4b865a147a4c58208af2daab100049bf676784cbc6c529ed170d40","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T05:56:32.749769Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.29494/citation-record","integrity":"/paper/2607.29494/integrity","json":"/paper/2607.29494/citation-record.json","paper":"/paper/2607.29494"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:28.512194Z","title":"Proceedings of the 29th symposium on operating systems principles , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:28.512194Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:d3705e7d723a9e10285563bc75e5b14197bfabde2e52f6aca982793b55faee7b","observation_id":"6430851a-6f63-4200-afd8-8cc17543fcc8","resolution":{"observed_at":"2026-08-03T05:56:28.512194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:28.918937Z","title":"Beat the long tail: Distribution-Aware Speculative Decoding for RL Training","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:28.918937Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:2e093fda416b0a1082c4c203941551434b1bf44a545d052fbb473f81a8d83109","observation_id":"444bd4e5-721a-4d9d-a4b3-c0ce97ef8882","resolution":{"observed_at":"2026-08-03T05:56:28.918937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:28.977805Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:28.977805Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:4d25d675cd1c7930634a33777b7f9c216a80e0f9eacb875a450b2a174ef63a00","observation_id":"b7b2d43f-0994-4674-919c-a9e1b125e309","resolution":{"observed_at":"2026-08-03T05:56:28.977805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:29.036762Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:29.036762Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:4c75a95ef51a15bf729248a728c8948c1c12a9136f95578866a905b51c50b5a2","observation_id":"4d3e2851-790d-415d-a8e6-36ed1bc608d7","resolution":{"observed_at":"2026-08-03T05:56:29.036762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-03T05:56:29.124014Z","title":"arXiv preprint arXiv:2402.03300 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:29.124014Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:16d17a2e658b81817d1b46a7196fea2c8f386980f1d6224c418f9d040f2bf243","observation_id":"96e29151-fb93-4016-86cc-5cff692b0314","resolution":{"observed_at":"2026-08-03T05:56:29.124014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:29.187128Z","title":"arXiv preprint arXiv:2602.15260 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:29.187128Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:5780810986ad55d8eac4f2818d2ac154c16a4f949ce4f642ed724abb520246e1","observation_id":"c5d8891a-34ec-471e-bc3b-6f5b8d4ff115","resolution":{"observed_at":"2026-08-03T05:56:29.187128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:29.257040Z","title":"Findings of the Association for Computational Linguistics: ACL 2026 , pages=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:29.257040Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:6ca9f2c8d4068f7d544a5872c846bb8e8f3d99b7832720d6f70fcd5e64af5a69","observation_id":"5fffdbce-f12e-4176-a32a-df6f07defcd7","resolution":{"observed_at":"2026-08-03T05:56:29.257040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:29.404980Z","title":"ICML 2026 Workshop on Foundations of Deep Generative Models: Understanding Memorization, Generalization, and Reasoning , year=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:29.404980Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:9ecb605a04433f29357633d0b0acf1ae4514fab606ca7bfced161a7444a2283e","observation_id":"640bd8be-c5b3-4828-a58f-24c10e8919d6","resolution":{"observed_at":"2026-08-03T05:56:29.404980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:29.450024Z","title":"16th USENIX symposium on operating systems design and implementation (OSDI 22) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:29.450024Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:cf42612e2075873e4a218e00dcff3b425138a0ace89a07c7609e93731b6c4c65","observation_id":"c496e390-d01b-4911-80ce-8f802f129719","resolution":{"observed_at":"2026-08-03T05:56:29.450024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:29.521621Z","title":"and Zhang, Hao and Stoica, Ion , booktitle=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:29.521621Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:2f902fad19103cda3e71169c6ac1b0377497533f11a63862513983747ef44801","observation_id":"487ff2a4-6530-4ac6-a80c-de6ac67f82dc","resolution":{"observed_at":"2026-08-03T05:56:29.521621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:29.591187Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:29.591187Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:d94188b535a8df8311869973bcdf8518ff1632b66b0d57a275d9bd8c92b8a64c","observation_id":"d8750c36-a91d-4513-b46f-c10405726896","resolution":{"observed_at":"2026-08-03T05:56:29.591187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:29.649462Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:29.649462Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:507e32020eddac2e06d18bcf3aefa2bff64f4303e23032700578fbc98b72cfe4","observation_id":"8ad534e6-df70-481f-9b49-7ddcebe5bc17","resolution":{"observed_at":"2026-08-03T05:56:29.649462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-03T05:56:29.720031Z","title":"arXiv preprint arXiv:2501.12948 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:29.720031Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:35f1790cc341e003e96b16b8ffc60ec75db688a397baadc05891a3fb4a03168c","observation_id":"82c9342c-f40d-4c45-ba9a-f85197da6542","resolution":{"observed_at":"2026-08-03T05:56:29.720031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:29.796818Z","title":"Nature , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:29.796818Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:4d6d14ed498f3b9d35d709011e1c06ce0a161e901e305941fdc0f3b370903649","observation_id":"09acaff6-63af-4bb7-83ac-17b5bd973de2","resolution":{"observed_at":"2026-08-03T05:56:29.796818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-03T05:56:29.962609Z","title":"arXiv preprint arXiv:2503.14476 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:29.962609Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:b22c9cf3f58d36cc8b1bfd1d94b494d954fe685c8c882db89072b493be2e0718","observation_id":"8d7dd388-d532-43b4-b03f-8af1e7454d21","resolution":{"observed_at":"2026-08-03T05:56:29.962609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:30.022807Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:30.022807Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:7930267941d6a7c13f3ab1bebd9133ef70398f38ea38a238e90128995660face","observation_id":"21f87b59-e3f1-43df-a389-7c031d2f6021","resolution":{"observed_at":"2026-08-03T05:56:30.022807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:30.078185Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:30.078185Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:9e6eab6f713bfa072ddee81c0da8ce4c2c682186c773ba2d9260d8154b59fa48","observation_id":"1d51a8ba-9921-4042-9155-e8e331e526e6","resolution":{"observed_at":"2026-08-03T05:56:30.078185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:30.139337Z","title":"Advances in Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:30.139337Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:3c5fdb426fa5a230444fe85abbf6dc11171a2ecfcd4197886fa43935f768f8f6","observation_id":"71151e39-12c5-456a-adea-25d36c47d1bc","resolution":{"observed_at":"2026-08-03T05:56:30.139337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:30.225715Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:30.225715Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:b56835f9db3811b0c923c275d23151fb708e9b2899471d110a0045a45a52f58d","observation_id":"7dcaaa47-7f91-4e53-af4a-2e73c918629b","resolution":{"observed_at":"2026-08-03T05:56:30.225715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:30.322542Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:30.322542Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:02eaa282882cc191723d31de7db897d0aea125a69bf531ef475a243376c161be","observation_id":"0e0ae913-7a8e-489e-b511-e47bd3f7d423","resolution":{"observed_at":"2026-08-03T05:56:30.322542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:30.386180Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:30.386180Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:33e4a0bac0c9f4f96cf6912e8ea450f58f6569e3d27819de01422b1216300cb9","observation_id":"8fb1f895-9256-4f0f-ac6e-18116af1ec0f","resolution":{"observed_at":"2026-08-03T05:56:30.386180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23281","last_updated":"2026-01-14T21:39:58Z","snapshot_observed_at":"2026-08-02T10:05:44.330694Z","submitted_at":"2025-05-29T09:28:06Z","title":"MathArena: Evaluating LLMs on Uncontaminated Math Competitions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23281","snapshot_observed_at":"2026-08-03T05:56:30.543810Z","title":"arXiv preprint arXiv:2505.23281 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:30.543810Z"},"links":{"cited_paper":"/paper/2505.23281","citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:9367b115b2c86a08013b13bc26f3c5b38141499afb65875f10f82c67632348ec","observation_id":"28d4acf4-e2dd-48f9-8f93-b93ecaa25146","resolution":{"observed_at":"2026-08-03T05:56:30.543810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:30.600744Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:30.600744Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:6a9a7a5089ed89fd46183b371b0a6fe891adf6625d551ad23484f309bbceb49b","observation_id":"e70e04b6-4be7-4fe5-b49f-b42c144a2ac8","resolution":{"observed_at":"2026-08-03T05:56:30.600744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.13643","last_updated":"2026-05-25T08:05:47Z","snapshot_observed_at":"2026-08-12T04:38:42.406552Z","submitted_at":"2026-05-13T15:05:30Z","title":"Prefix Teach, Suffix Fade: Local Teachability Collapse in Strong-to-Weak On-Policy Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.13643","snapshot_observed_at":"2026-08-03T05:56:30.720852Z","title":"arXiv preprint arXiv:2605.13643 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:30.720852Z"},"links":{"cited_paper":"/paper/2605.13643","citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:7f1c46e37f32d12a15e8c3c08ca40ee5d33405c6678446b71a24f77c8198c76e","observation_id":"86acf07e-4db9-4664-986a-b6f47be60083","resolution":{"observed_at":"2026-08-03T05:56:30.720852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:30.899328Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:30.899328Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:7986d30f6bcae973b2d41c74351fcef1d3e61ce99f2b2b87b4787c587b709d27","observation_id":"f215c663-e342-4046-9d00-030d40254f8c","resolution":{"observed_at":"2026-08-03T05:56:30.899328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:31.098186Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:31.098186Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:d3f23f0bd61e029939bee3844c84b7289bb07e148b0f2489c41b059991d6c197","observation_id":"d7e862cc-3cdc-4f0c-978a-68bb870b0d28","resolution":{"observed_at":"2026-08-03T05:56:31.098186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:31.176842Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:31.176842Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:5200b94bd688c7e4d566f292087560e2a1956fd848b55ea3dcead46a44b26146","observation_id":"c5070825-ab7a-4013-97a6-18475be4794e","resolution":{"observed_at":"2026-08-03T05:56:31.176842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:31.250243Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:31.250243Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:11f840f488315adf4d64342c6d36f7a476762566ca306b2a380a649b5910c402","observation_id":"ff712646-56f6-45e3-8bf4-1c7ba207866b","resolution":{"observed_at":"2026-08-03T05:56:31.250243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:31.329296Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:31.329296Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:2d9844d2cb5d6adf6829a821eaaeaf5e9d0f76789de2168f74d099be8c1cafa9","observation_id":"6b8465dc-8c0e-4bd8-953e-982766ff2c39","resolution":{"observed_at":"2026-08-03T05:56:31.329296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:31.406258Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:31.406258Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:2208b2c0984fd339f50bf44a91f5fd33e212dcc63a3e4937dad164e2a75fc8d5","observation_id":"31599f95-8d8a-4f56-b3b3-69b30d604b1a","resolution":{"observed_at":"2026-08-03T05:56:31.406258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:31.467925Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:31.467925Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:af8b65bb6a77577663434647583516e98c282d39d7562c2fe25483f54a8fb7fc","observation_id":"85742307-6319-4597-a9c6-0cabb40896e6","resolution":{"observed_at":"2026-08-03T05:56:31.467925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:31.530786Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:31.530786Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:27b417ad2d9847554244047385aadff182329e1dcf87c856b4d17680a0629ae0","observation_id":"37d0c04a-7900-486e-b6fa-af6e2f6380d2","resolution":{"observed_at":"2026-08-03T05:56:31.530786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.02218","last_updated":"2026-06-01T13:20:00Z","snapshot_observed_at":"2026-08-09T09:45:26.382031Z","submitted_at":"2026-06-01T13:20:00Z","title":"Faster Synchronous On-Policy RL via Straggler-Aware Group Sizing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.02218","snapshot_observed_at":"2026-08-03T05:56:31.607504Z","title":"A.; Ahmed, A.; Fayyaz, Z.; Di, S.; Hong, M.; and Anwar, A","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:31.607504Z"},"links":{"cited_paper":"/paper/2606.02218","citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:0bc486b615e3fbbd5f99fb9ec111ab95074eb45bf50e6a4279e2240a6ea9feaf","observation_id":"f437d506-4178-461c-810d-5b43cf65cf15","resolution":{"observed_at":"2026-08-03T05:56:31.607504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:31.652104Z","title":"H.; Gonzalez, J.; Zhang, H.; and Stoica, I","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:31.652104Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:e44d1a1cca835dfbbbfbe89c3abd73820854f2652c4c7c8639665997c1ba7f97","observation_id":"f9a63126-4804-4b40-9204-95cb84f11e8e","resolution":{"observed_at":"2026-08-03T05:56:31.652104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:31.721076Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:31.721076Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:f88311e6050484fc3da616ed6dca6a6b1eb99e1d923ff81a963c372f73979c36","observation_id":"6a2b69b4-df68-40d5-a920-6249f6d500b2","resolution":{"observed_at":"2026-08-03T05:56:31.721076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:31.768536Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:31.768536Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:53880d2fea9bc9d987188de18d6d0e2991d27222f10f8a121fac0e63681e84ab","observation_id":"e4f08725-d42a-494b-8d6f-0e99266a1d85","resolution":{"observed_at":"2026-08-03T05:56:31.768536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.28396","last_updated":"2026-05-27T12:33:44Z","snapshot_observed_at":"2026-08-07T04:25:48.948742Z","submitted_at":"2026-05-27T12:33:44Z","title":"ADWIN: Adaptive Windows for Horizon-Aware On-Policy Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.28396","snapshot_observed_at":"2026-08-03T05:56:31.836858Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:31.836858Z"},"links":{"cited_paper":"/paper/2605.28396","citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:c1f8b427b09ac37b4c57eed9675114673baaa54b8c5dabb8ab4b18abc2c262f1","observation_id":"4ed8ccd7-7ca5-42e0-85de-c538d908faca","resolution":{"observed_at":"2026-08-03T05:56:31.836858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08527","last_updated":"2026-04-09T17:58:02Z","snapshot_observed_at":"2026-08-11T17:07:33.755866Z","submitted_at":"2026-04-09T17:58:02Z","title":"Demystifying OPD: Length Inflation and Stabilization Strategies for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.08527","snapshot_observed_at":"2026-08-03T05:56:31.897364Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:31.897364Z"},"links":{"cited_paper":"/paper/2604.08527","citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:6cd4838f6d7101f26a864628ef60fa53576c0d4836e8b3ecdd6373f385951499","observation_id":"1e6c84be-257b-4ce1-ab32-a9cb12612eb1","resolution":{"observed_at":"2026-08-03T05:56:31.897364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:31.971145Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:31.971145Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:09883f55923e1823bc55f4c4ea9bb6ae7eb250fc09b49b2d4e7f12f33d3c8354","observation_id":"104e9828-e013-48dd-a4be-435f9284bd27","resolution":{"observed_at":"2026-08-03T05:56:31.971145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:32.034663Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:32.034663Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:71b26717b9d0a2a60a1c7d99014b09ce61c4c3defededf8945dc9eabbfb46954","observation_id":"091548b7-861f-443e-a474-eb970627b9fe","resolution":{"observed_at":"2026-08-03T05:56:32.034663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13010","last_updated":"2026-05-08T06:38:25Z","snapshot_observed_at":"2026-08-07T20:56:10.226252Z","submitted_at":"2026-04-14T17:44:50Z","title":"Lightning OPD: Efficient Post-Training for Large Reasoning Models with Offline On-Policy Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.13010","snapshot_observed_at":"2026-08-03T05:56:32.103834Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:32.103834Z"},"links":{"cited_paper":"/paper/2604.13010","citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:d86134a69b9e8db3fccca05ceeaa7ea0850cc1ab6f7dc5d3c5f44316ca58705f","observation_id":"85d558ac-1a4c-4cce-8274-3fd45ea0c727","resolution":{"observed_at":"2026-08-03T05:56:32.103834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-03T05:56:32.149083Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:32.149083Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:099f0540f021de032c97f216b304e1ff5046105a5e5f845a3c17ea279589ee42","observation_id":"a3710f0c-fb3a-474b-a7a9-c278f1af8ad9","resolution":{"observed_at":"2026-08-03T05:56:32.149083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-08-14T16:00:41.902820Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-03T05:56:32.210625Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:32.210625Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:a64bb2a93b0b14c8f88ba2ae35ddfa6dd923316e8e57e4a354fa93da57575e1a","observation_id":"4b89bf21-e99a-47ff-be2f-8b645a3d4240","resolution":{"observed_at":"2026-08-03T05:56:32.210625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.07804","last_updated":"2026-06-01T07:36:57Z","snapshot_observed_at":"2026-08-15T03:10:22.466759Z","submitted_at":"2026-05-08T14:38:53Z","title":"Prune-OPD: Efficient and Reliable On-Policy Distillation for Long-Horizon Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.07804","snapshot_observed_at":"2026-08-03T05:56:32.272206Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:32.272206Z"},"links":{"cited_paper":"/paper/2605.07804","citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:8ffe8bfb1ae51b2944a3b4ba70caf65a68c057f12c0128d1ebe0c77bf122883a","observation_id":"777a0986-9422-4eee-8b36-3b7d40807d33","resolution":{"observed_at":"2026-08-03T05:56:32.272206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:32.330711Z","title":"S.; Kim, G.-W.; Kim, S.; and Chun, B.-G","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:32.330711Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:639efe06a122c4341b80d2bde982ca3ee1ea339bc770ae63dda16df4643ef7ac","observation_id":"ffa120c1-3e74-4e19-a2e2-8145c47e9eec","resolution":{"observed_at":"2026-08-03T05:56:32.330711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:32.393851Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:32.393851Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:6aed2a6989ba1c4571fa19c00b8d88e8ad5f5660134c3d050f22ba4e56bdb307","observation_id":"bbfcf377-eb7f-49a0-8fd3-61080fa4bd53","resolution":{"observed_at":"2026-08-03T05:56:32.393851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:56:32.474750Z","title":"D.; Batra, S","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:32.474750Z"},"links":{"citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:b176d322723d15ad1a243ee05c88771a48f50244d2b391cd80df40439db118a2","observation_id":"aa0ad21f-0ece-4881-9d5b-d19114095807","resolution":{"observed_at":"2026-08-03T05:56:32.474750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.13124","last_updated":"2026-07-14T17:50:50Z","snapshot_observed_at":"2026-08-15T16:02:21.514118Z","submitted_at":"2026-07-14T17:50:50Z","title":"ShortOPD: Recovering Pruned LLMs with Short-to-Long On-Policy Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.13124","snapshot_observed_at":"2026-08-03T05:56:32.554568Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:32.554568Z"},"links":{"cited_paper":"/paper/2607.13124","citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:004e688e1175c3e6c173067075a5ae2a135e47c2e4a36ce95fcd2068480b5497","observation_id":"f7a55579-28d9-413b-b505-3b28b724d7f8","resolution":{"observed_at":"2026-08-03T05:56:32.554568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.31490","last_updated":"2026-05-29T16:12:54Z","snapshot_observed_at":"2026-08-13T02:30:39.456000Z","submitted_at":"2026-05-29T16:12:54Z","title":"Are Full Rollouts Necessary for On-Policy Distillation?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.31490","snapshot_observed_at":"2026-08-03T05:56:32.620116Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:32.620116Z"},"links":{"cited_paper":"/paper/2605.31490","citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:503fde8dc02877c053c8e4ad04f65a65ce3dfc311c33f8f90ff0e2b786d45fda","observation_id":"901754e9-8a30-4bfd-8f62-ebe5ab6598c7","resolution":{"observed_at":"2026-08-03T05:56:32.620116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.21994","last_updated":"2026-08-03T09:13:52Z","snapshot_observed_at":"2026-08-15T03:30:22.565994Z","submitted_at":"2026-06-20T11:18:34Z","title":"Prefix-Guided On-Policy Distillation: Mining Golden Trajectories from Rollouts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.21994","snapshot_observed_at":"2026-08-03T05:56:32.685615Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:32.685615Z"},"links":{"cited_paper":"/paper/2606.21994","citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:b56d0b7d24ab93d6c2c081412e3286126d3f6cf4e1f83aad45b9828a00eed0a2","observation_id":"1248cd8d-9272-46b7-b138-dc888ad28d70","resolution":{"observed_at":"2026-08-03T05:56:32.685615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.27028","last_updated":"2026-05-26T13:49:37Z","snapshot_observed_at":"2026-08-14T11:18:55.996756Z","submitted_at":"2026-05-26T13:49:37Z","title":"Less is More: Early Stopping Rollout for On-Policy Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.27028","snapshot_observed_at":"2026-08-03T05:56:32.749769Z","title":"N.; and Terzopoulos, D","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-03T05:56:32.749769Z"},"links":{"cited_paper":"/paper/2605.27028","citing_paper":"/paper/2607.29494"},"observation_digest":"sha256:4a615480c16651b5f7e990dc57adc3aca16c2f4b05f6c9ed7a65060e61e188b2","observation_id":"ca16eed3-9899-47fb-883b-2b73007c9c30","resolution":{"observed_at":"2026-08-03T05:56:32.749769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.29494","last_updated":"2026-07-31T15:02:53Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T01:54:24.399316Z","submitted_at":"2026-07-31T15:02:53Z","title":"Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2607.29494."}