{"as_of":"2026-08-13T11:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:414b5721f1b1fb7ab7872eeed010d201b293d951b6e0bdf0d077d5ffec3fb92b","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T11:52:35.159984Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T09:49:28.700382Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.26997","snapshot_observed_at":"2026-08-01T09:49:28.700382Z","title":"RolloutPipe : Overlapping pipelined rollout and training in disaggregated on-policy LLM reinforcement learning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21653","last_updated":"2026-07-22T18:06:15Z","snapshot_observed_at":"2026-08-12T22:20:44.276246Z","submitted_at":"2026-07-22T18:06:15Z","title":"Molt: A Scalable PyTorch-Native Training Framework for Agentic Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T09:49:28.700382Z"},"links":{"cited_paper":"/paper/2606.26997","citing_paper":"/paper/2607.21653"},"observation_digest":"sha256:17bc9a842f2b4b8763305f54a1fd7b01186d0117bceb03999edf781b7507fcde","observation_id":"7164737e-8b03-4d42-8053-986528121718","resolution":{"observed_at":"2026-08-01T09:49:28.700382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2606.26997/citation-record","integrity":"/paper/2606.26997/integrity","json":"/paper/2606.26997/citation-record.json","paper":"/paper/2606.26997"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.24298","last_updated":"2026-03-02T03:07:29Z","snapshot_observed_at":"2026-08-02T16:10:09.199211Z","submitted_at":"2025-05-30T07:18:25Z","title":"AReaL: A Large-Scale Asynchronous Reinforcement Learning System for Language Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24298","snapshot_observed_at":"2026-07-12T11:52:35.159984Z","title":"arXiv preprint arXiv:2505.24298 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T11:52:35.159984Z"},"links":{"cited_paper":"/paper/2505.24298","citing_paper":"/paper/2606.26997"},"observation_digest":"sha256:0491c236ef70724d26d0f75761ce06b291db67bdc66c26b55111133447a48306","observation_id":"5149cbf7-dd78-4fc9-8aef-3cc9b5dbac56","resolution":{"observed_at":"2026-07-12T11:52:35.159984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T11:52:35.159984Z","title":"Nature645(8081), 633–638 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-12T11:52:35.159984Z"},"links":{"citing_paper":"/paper/2606.26997"},"observation_digest":"sha256:65e64043fa6c82d839375730597be1b8c451df853367676a0bb54470a1421bef","observation_id":"f20a299c-9529-4315-8846-7552fe3b3b62","resolution":{"observed_at":"2026-07-12T11:52:35.159984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01663","last_updated":"2025-07-02T12:45:34Z","snapshot_observed_at":"2026-08-13T08:22:12.599337Z","submitted_at":"2025-07-02T12:45:34Z","title":"AsyncFlow: An Asynchronous Streaming RL Framework for Efficient LLM Post-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01663","snapshot_observed_at":"2026-07-12T11:52:35.159984Z","title":"arXiv preprint arXiv:2507.01663 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T11:52:35.159984Z"},"links":{"cited_paper":"/paper/2507.01663","citing_paper":"/paper/2606.26997"},"observation_digest":"sha256:df21bb96daca1927615d73a4fde8163a8d95acd6ab629bfd6f24fcdaab67a1db","observation_id":"c8d59ed5-d847-4c63-880f-f18e47cd6fab","resolution":{"observed_at":"2026-07-12T11:52:35.159984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T11:52:35.159984Z","title":"In: Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-12T11:52:35.159984Z"},"links":{"citing_paper":"/paper/2606.26997"},"observation_digest":"sha256:cf4e65ed3e2d31299504a2b17d2437790ff657092ebdc0cbb2b57516e7ab6721","observation_id":"d879b52d-318b-498c-9431-b6378b52b818","resolution":{"observed_at":"2026-07-12T11:52:35.159984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T11:52:35.159984Z","title":"In: Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing: System Demonstrations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T11:52:35.159984Z"},"links":{"citing_paper":"/paper/2606.26997"},"observation_digest":"sha256:2a04b208f8996753d878989060a2c5776ebe1d8ced8c6f41c61c9b0af9bfca81","observation_id":"2a10505b-911d-43f2-ae2d-a140b072a76f","resolution":{"observed_at":"2026-07-12T11:52:35.159984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T11:52:35.159984Z","title":"In: Proceedings of the 8th International Conference on Cognitive Computing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T11:52:35.159984Z"},"links":{"citing_paper":"/paper/2606.26997"},"observation_digest":"sha256:c4e14dd9e1b4b38f70d3db48c5208f409eb90006f78843a2b17b21956df37810","observation_id":"dbd7f5f7-7f30-4f50-8c94-4c8f84da2733","resolution":{"observed_at":"2026-07-12T11:52:35.159984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T11:52:35.159984Z","title":"In: Proceedings of the 9th International Conference on Cognitive Computing","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-12T11:52:35.159984Z"},"links":{"citing_paper":"/paper/2606.26997"},"observation_digest":"sha256:fd9e78078326b8c6574172687056f55c76bb344cc5344d1c57c052f9e995e445","observation_id":"317c6543-8b85-46ce-9683-45a91e1b69a2","resolution":{"observed_at":"2026-07-12T11:52:35.159984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T11:52:35.159984Z","title":"In: Proceedings of the 13th USENIX Symposium on Operating Systems Design and Implementation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-12T11:52:35.159984Z"},"links":{"citing_paper":"/paper/2606.26997"},"observation_digest":"sha256:c88158e79bbcc6e08c9f1200aeb776b8c505c54bb10d624b78fa451151ec8f0d","observation_id":"a9c49bd3-2cb0-47ed-8709-5475382f5952","resolution":{"observed_at":"2026-07-12T11:52:35.159984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T11:52:35.159984Z","title":"In: Proceedings of the InternationalConferenceforHighPerformanceComputing,Networking,StorageandAnalysis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-12T11:52:35.159984Z"},"links":{"citing_paper":"/paper/2606.26997"},"observation_digest":"sha256:e6628b8b08b7ca0f4bcbb78653009f9fd5099d01d81352518601f586fe93d4ba","observation_id":"e7d5bbb7-071f-406f-8633-205d7cb1bea8","resolution":{"observed_at":"2026-07-12T11:52:35.159984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T11:52:35.159984Z","title":"In: Advances in Neural Information Processing Systems","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-12T11:52:35.159984Z"},"links":{"citing_paper":"/paper/2606.26997"},"observation_digest":"sha256:879f19d18dc766d260fda7a9b3b1b302d340754fb0e5df43daec95d6e16f2452","observation_id":"8210c385-9885-4d74-aa7c-a64ad2c01ab8","resolution":{"observed_at":"2026-07-12T11:52:35.159984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T11:52:35.159984Z","title":"In: Proceedings of the Twentieth European Conference on Computer Systems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-12T11:52:35.159984Z"},"links":{"citing_paper":"/paper/2606.26997"},"observation_digest":"sha256:d3e5f4cac78baf04da4af4b1183f1a4fa523874fbba1caccc13aa4c69b6a9df7","observation_id":"becf97e3-52ba-42c8-a7f2-475418e78904","resolution":{"observed_at":"2026-07-12T11:52:35.159984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T11:52:35.159984Z","title":"In: Proceedings of the 41st International Conference on Machine Learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-12T11:52:35.159984Z"},"links":{"citing_paper":"/paper/2606.26997"},"observation_digest":"sha256:e467a8b14ebee72f65d2d24cc8b5de6c72317fe23c6889f1d324b23fe69f880a","observation_id":"a02d4598-cc45-4561-856a-0f3c056ffb25","resolution":{"observed_at":"2026-07-12T11:52:35.159984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T11:52:35.159984Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-12T11:52:35.159984Z"},"links":{"citing_paper":"/paper/2606.26997"},"observation_digest":"sha256:9b71ecf4d0a245d46fa1aac6f41a2c85ecb77e1a7af6cb74280b07426dbf43fa","observation_id":"a0521a09-d440-426d-a722-4022c2cebdb6","resolution":{"observed_at":"2026-07-12T11:52:35.159984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T11:52:35.159984Z","title":"In: Proceedings of the 9th International Conference on Cognitive Computing","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-12T11:52:35.159984Z"},"links":{"citing_paper":"/paper/2606.26997"},"observation_digest":"sha256:a849b14006c484499cbffa627e2cf90fe6b88e5b595284f3d22c8edda320eee3","observation_id":"fd864d3e-a2e7-4090-9387-a2ef3c8a4995","resolution":{"observed_at":"2026-07-12T11:52:35.159984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T11:52:35.159984Z","title":"In: Advances in Neural Information Processing Systems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-12T11:52:35.159984Z"},"links":{"citing_paper":"/paper/2606.26997"},"observation_digest":"sha256:7fdca5d4f4f15e441b135ad28d7b8bfa33dff563b6cc0c4a34cbca45d894f3c2","observation_id":"95b975a3-86b4-443c-a811-9a560b0a5a5c","resolution":{"observed_at":"2026-07-12T11:52:35.159984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T11:52:35.159984Z","title":"In: Findings of the Association for Computational Linguistics: North American Chapter of the Association for Computational Linguistics 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T11:52:35.159984Z"},"links":{"citing_paper":"/paper/2606.26997"},"observation_digest":"sha256:fbfdf1bec5a900a50693fa6674ad0fa4a9f5fced6f4da92f448899a306e3e797","observation_id":"1443aa22-f744-4d4d-ad1a-0b7b948733cb","resolution":{"observed_at":"2026-07-12T11:52:35.159984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T11:52:35.159984Z","title":"In: Proceedings 16 R","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-12T11:52:35.159984Z"},"links":{"citing_paper":"/paper/2606.26997"},"observation_digest":"sha256:b830522cb065b3528afff6f4c387528f9f16cab05f3ffeb718d88f38f3d1fac6","observation_id":"f2ab2b5b-2519-4fdc-8a89-130a64005db0","resolution":{"observed_at":"2026-07-12T11:52:35.159984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T11:52:35.159984Z","title":"GitHub repository (2025),","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T11:52:35.159984Z"},"links":{"citing_paper":"/paper/2606.26997"},"observation_digest":"sha256:f33ca1285ad046937be1ccc26d98af66aaa2bd31d17f57811d1b7b82041c3b94","observation_id":"acca909e-eb1f-41d0-b378-9dc8aa59e860","resolution":{"observed_at":"2026-07-12T11:52:35.159984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.26997","last_updated":"2026-07-05T07:05:22Z","latest_version":2,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-13T05:19:40.001059Z","submitted_at":"2026-06-25T13:14:14Z","title":"RolloutPipe: Overlapping Pipelined Rollout and Training in Disaggregated On-Policy LLM Reinforcement Learning"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 1 inbound Pith citation observation for arXiv:2606.26997."}