{"as_of":"2026-08-19T17:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f03af8f528e1b958691776cbb926b225db1f8a79593e8ce7103c3f06f0f7da2a","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T05:13:50.303760Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.11152/citation-record","integrity":"/paper/2608.11152/integrity","json":"/paper/2608.11152/citation-record.json","paper":"/paper/2608.11152"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.26256","last_updated":"2026-04-29T03:25:36Z","snapshot_observed_at":"2026-07-06T23:11:57.238808Z","submitted_at":"2026-04-29T03:25:36Z","title":"DORA: A Scalable Asynchronous Reinforcement Learning System for Language Model Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.26256","snapshot_observed_at":"2026-08-12T05:13:50.241693Z","title":"DORA: A scalable asynchronous reinforcement learning system for language model training.arXiv preprint arXiv:2604.26256,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-19T02:53:12.179344Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.241693Z"},"links":{"cited_paper":"/paper/2604.26256","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:23c00b07166e309ab4f84b462dc7c5d48008b6c05b338561fe235f957293cc9d","observation_id":"9bd5af01-ac29-4835-b3fa-681efceaaf43","resolution":{"observed_at":"2026-08-12T05:13:50.241693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24871","last_updated":"2025-06-05T05:13:46Z","snapshot_observed_at":"2026-08-18T17:13:47.373678Z","submitted_at":"2025-05-30T17:59:38Z","title":"MoDoMoDo: Multi-Domain Data Mixtures for Multimodal LLM Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24871","snapshot_observed_at":"2026-08-12T05:13:50.256666Z","title":"MoDoMoDo: Multi-domain data mixtures for multimodal LLM reinforcement learning.arXiv preprint arXiv:2505.24871,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-19T02:53:12.179344Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.256666Z"},"links":{"cited_paper":"/paper/2505.24871","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:b6393ae1fb7261b88cea339dee9c22d6793e98b2bc8ac1c7b2c1c1a0fe1b4c9d","observation_id":"26aa98ce-529c-419a-afc7-dfc748f6ad00","resolution":{"observed_at":"2026-08-12T05:13:50.256666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.30406","last_updated":"2026-06-29T14:51:28Z","snapshot_observed_at":"2026-08-10T09:37:40.339025Z","submitted_at":"2026-06-29T14:51:28Z","title":"MOPD: Multi-Teacher On-Policy Distillation for Capability Integration in LLM Post-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.30406","snapshot_observed_at":"2026-08-12T05:13:50.261766Z","title":"MOPD: Multi-Teacher On-Policy Distillation for Capability Integration in LLM Post-Training.arXiv preprint arXiv:2606.30406,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-19T02:53:12.179344Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.261766Z"},"links":{"cited_paper":"/paper/2606.30406","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:171502168b4b5223ab236b6d712b9095bf851af22dc4585e46d033e1d643c204","observation_id":"059665f4-b5f4-4339-9757-61b67fe9640e","resolution":{"observed_at":"2026-08-12T05:13:50.261766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12125","last_updated":"2026-02-26T13:26:22Z","snapshot_observed_at":"2026-08-16T08:35:41.330991Z","submitted_at":"2026-02-12T16:14:29Z","title":"Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.12125","snapshot_observed_at":"2026-08-12T05:13:50.266654Z","title":"Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation.arXiv preprint arXiv:2602.12125,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-19T02:53:12.179344Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.266654Z"},"links":{"cited_paper":"/paper/2602.12125","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:59a0072bd7c11e3e0979f55372941d709b640cfbb0c3a44ec3d72252a3c15e70","observation_id":"d2ad585f-1a64-4d26-8784-8d10fe6b558d","resolution":{"observed_at":"2026-08-12T05:13:50.266654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.27703","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.718591Z","title":"KAT-Coder-V2 Technical Report.arXiv preprint arXiv:2603.27703,","venue":null,"work_id":"4ac0a085-bf93-43f6-914d-370fb16d30a7","year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-19T02:53:12.179344Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.270847Z"},"links":{"citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:22300366e519d60e8302b8cff387477c33943523f1e4620d07ca4cd8b961987c","observation_id":"5b25d3c0-a868-407b-bc6e-78e5ccbf48d8","resolution":{"observed_at":"2026-08-12T05:13:50.726406Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.02780","last_updated":"2026-01-08T05:52:17Z","snapshot_observed_at":"2026-08-14T07:48:23.313445Z","submitted_at":"2026-01-06T07:31:47Z","title":"MiMo-V2-Flash Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.02780","snapshot_observed_at":"2026-08-12T05:13:50.275166Z","title":"MiMo-V2-Flash Technical Report.arXiv preprint arXiv:2601.02780,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-19T02:53:12.179344Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.275166Z"},"links":{"cited_paper":"/paper/2601.02780","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:fcbed8f415a886f61bd8963ee05e85ece0a85de18e60e7b4daf494e24195a2c8","observation_id":"21c695b2-5360-4c6f-81f0-dfc84e924d5a","resolution":{"observed_at":"2026-08-12T05:13:50.275166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.280102Z","title":"Kimi K3: Open Frontier Intelligence.arXiv preprint arXiv:2607.24653,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-19T02:53:12.179344Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.280102Z"},"links":{"citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:3f658afa1f452892f51b4b2cbd8c8a2c57e9a63761f7bab2a3c38040d6174684","observation_id":"57559907-9567-4754-ab35-da735ff18afd","resolution":{"observed_at":"2026-08-12T05:13:50.280102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-12T05:13:50.284601Z","title":"Qwen3 Technical Report.arXiv preprint arXiv:2505.09388,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-19T02:53:12.179344Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.284601Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:da33342fc048f669d4adb86bf2d0e55f54c48304d1d63232aba21bff79347e1a","observation_id":"1f060fe1-b9e9-4c7a-abb0-6c41d4761e2a","resolution":{"observed_at":"2026-08-12T05:13:50.284601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.289735Z","title":"Nemotron 3 Ultra: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning.arXiv preprint arXiv:2606.15007,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-19T02:53:12.179344Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.289735Z"},"links":{"citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:3b0f925d1e0de5b5b0775f71e12c7003d44da3f333cc3bba7cfe488bd88f985a","observation_id":"3b75c79e-3b91-476a-a9a5-1304988c7509","resolution":{"observed_at":"2026-08-12T05:13:50.289735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.294197Z","title":"Nemotron-Cascade 2: Post-training LLMs with cascade RL and multi-domain on-policy distillation.arXiv preprint arXiv:2603.19220,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-19T02:53:12.179344Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.294197Z"},"links":{"citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:e70990fbd433d433e70bf88c99c3687e7ab86aaf8bd196a91963ac064d4c89ea","observation_id":"5bce5595-a8de-4c77-a26f-28112221dc9c","resolution":{"observed_at":"2026-08-12T05:13:50.294197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.12652","last_updated":"2026-06-01T07:33:52Z","snapshot_observed_at":"2026-08-11T13:23:10.571972Z","submitted_at":"2026-05-12T18:57:44Z","title":"Multi-Rollout On-Policy Distillation via Peer Successes and Failures","version":2},"cited_work":{"arxiv_id":"2605.12652","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.12652","snapshot_observed_at":"2026-08-12T05:13:50.355792Z","title":"Multi-Rollout On-Policy Distillation via Peer Successes and Failures","venue":"cs.LG","work_id":"9055c5ce-14d2-40f2-b703-cad985daea81","year":2026},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-19T02:53:12.179344Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.298520Z"},"links":{"cited_paper":"/paper/2605.12652","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:d2f6c23b91f6c8b9e261fdc931c1bd0b485837e97f0fb685a7d81e1d47027ea0","observation_id":"fa0a4b2a-818b-48e8-8461-e9da2bad22d0","resolution":{"observed_at":"2026-08-12T05:13:50.363281Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14312","last_updated":"2025-01-24T08:12:47Z","snapshot_observed_at":"2026-08-19T01:08:36.561666Z","submitted_at":"2025-01-24T08:12:47Z","title":"Locality-aware Fair Scheduling in LLM Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14312","snapshot_observed_at":"2026-08-12T05:13:50.303760Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-19T02:53:12.179344Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.303760Z"},"links":{"cited_paper":"/paper/2501.14312","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:f87a49904acc638fe92f2e40a2f5fe8d9f15d5f979686037d4684bdb07cc0998","observation_id":"33e088e5-c92f-4645-b6e3-a4810de06ce4","resolution":{"observed_at":"2026-08-12T05:13:50.303760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.30560","last_updated":"2026-06-30T15:39:15Z","snapshot_observed_at":"2026-08-17T20:04:17.182319Z","submitted_at":"2026-06-29T16:59:05Z","title":"TraceLab: Characterizing Coding Agent Workloads for LLM Serving","version":2},"cited_work":{"arxiv_id":"2606.30560","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.30560","snapshot_observed_at":"2026-08-12T05:13:50.789488Z","title":"TraceLab: Characterizing Coding Agent Workloads for LLM Serving","venue":"cs.LG","work_id":"67006132-bb05-4dae-bfd4-21cd42dd9bd4","year":2026},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-19T02:53:12.179344Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.251655Z"},"links":{"cited_paper":"/paper/2606.30560","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:0550a38f4b350b94bca689c1eb842a4a8800ed80b15842ef3ea81e6690706072","observation_id":"261e113b-7e5c-4f2c-96ae-14495d02965e","resolution":{"observed_at":"2026-08-12T05:13:50.795099Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.235549Z","title":"AReaL-Hex: Accommodating asynchronous RL training over heteroge- neous GPUs.arXiv preprint arXiv:2511.00796,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-19T02:53:12.179344Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.235549Z"},"links":{"citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:dec543caec5fd0ca0fe3456c0e2454b31510ee1551a01326432f64aa520a02b4","observation_id":"f607c615-1000-45f0-883b-64f85de4b384","resolution":{"observed_at":"2026-08-12T05:13:50.235549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19766","last_updated":"2025-07-26T03:42:33Z","snapshot_observed_at":"2026-08-15T23:25:22.033274Z","submitted_at":"2025-07-26T03:42:33Z","title":"UloRL:An Ultra-Long Output Reinforcement Learning Approach for Advancing Large Language Models' Reasoning Abilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.19766","snapshot_observed_at":"2026-08-12T05:13:50.246705Z","title":"UloRL: An ultra-long output reinforcement learning approach for advancing large language models’ reasoning abilities.arXiv preprint arXiv:2507.19766,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","snapshot_observed_at":"2026-08-19T02:53:12.179344Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.246705Z"},"links":{"cited_paper":"/paper/2507.19766","citing_paper":"/paper/2608.11152"},"observation_digest":"sha256:a2fea1de289f3ce2e108afef58aece95698353f1383113fbcb3ca123f320383f","observation_id":"785f8f85-1cd2-46a6-b982-d95e14da7afa","resolution":{"observed_at":"2026-08-12T05:13:50.246705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.11152","last_updated":"2026-08-11T17:10:50Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-19T02:53:12.179344Z","submitted_at":"2026-08-11T17:10:50Z","title":"Scheduling Mixed RL Rollouts Beyond Prefix Locality"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2608.11152."}