{"as_of":"2026-08-09T22:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9bed0ba3f020a3435ec6135947d16ad3cf0e7f5161648733d7a827c39597d99d","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T05:32:43.300084Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T11:14:02.042304Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T14:20:29.515746Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2602.02192","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.02192","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Echo-2: A large scale distributed rollout framework for cost-efficient reinforcement learning","venue":null,"work_id":"cdba8fbd-d320-4a1d-82d6-ee8489858cb5","year":2026},"citing_paper":{"arxiv_id":"2604.13453","last_updated":"2026-04-15T04:05:10Z","snapshot_observed_at":"2026-08-03T17:25:06.954677Z","submitted_at":"2026-04-15T04:05:10Z","title":"FAST: A Synergistic Framework of Attention and State-space Models for Spatiotemporal Traffic Prediction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-10T14:20:21.472989Z"},"links":{"cited_paper":"/paper/2602.02192","citing_paper":"/paper/2604.13453"},"observation_digest":"sha256:dd6a084d58ca367be046442fc45dcb8cf79349c5a74feb917e91ad803acfc4cb","observation_id":"f336f62a-0335-4939-a84d-3dd93dec191b","resolution":{"observed_at":"2026-05-27T02:04:33.896984Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.02192","snapshot_observed_at":"2026-08-02T11:14:02.042304Z","title":"2026.ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22614","last_updated":"2026-06-15T09:41:09Z","snapshot_observed_at":"2026-08-07T04:23:01.926858Z","submitted_at":"2026-06-15T09:41:09Z","title":"DynaResize: Runtime GPU Reallocation for Disaggregated LLM Post-Training","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T11:14:02.042304Z"},"links":{"cited_paper":"/paper/2602.02192","citing_paper":"/paper/2607.22614"},"observation_digest":"sha256:ecbf8619a8d4db231455dd4c4e324fefec1c7e205baeb31b8600cda0e1e6c2ef","observation_id":"73182606-3436-4471-b46d-db063113c303","resolution":{"observed_at":"2026-08-02T11:14:02.042304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2602.02192/citation-record","integrity":"/paper/2602.02192/integrity","json":"/paper/2602.02192/citation-record.json","paper":"/paper/2602.02192"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-03T05:32:40.373432Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:40.373432Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:754a0da3f7d86d9d9df9e9f7d183fe3add9f33183cbab687e1eb7e80744a3d40","observation_id":"fd332074-d05c-4168-a0d0-555cfd9ae0fc","resolution":{"observed_at":"2026-08-03T05:32:40.373432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-03T05:32:40.415345Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:40.415345Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:1f5b621dbb95b186b5b44d29a425f18ba8ecebd45301fb0f3850264fd4aae60b","observation_id":"b736313e-0f23-4fbc-a511-49330b90fc59","resolution":{"observed_at":"2026-08-03T05:32:40.415345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-03T05:32:40.495376Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:40.495376Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:1c20af8547d10b8dc55f759e1cd9f567eee3b5a362aa5b0a406909831d6a9134","observation_id":"aaf7e38d-3e5e-4cb7-8a64-a84d9bd2f09f","resolution":{"observed_at":"2026-08-03T05:32:40.495376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:40.591203Z","title":"Proximal policy optimization algorithms, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:40.591203Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:bc718faab65b4b511c4868d861688a129f1830ae34662ecf5cccd89a4c37139e","observation_id":"5769c27c-b16c-4a2a-8016-ed45413e7fe7","resolution":{"observed_at":"2026-08-03T05:32:40.591203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:40.701006Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:40.701006Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:d6a01763c62b5610edd0ba76bd239a5fa7ed387043cb5b8b07efbe855416a732","observation_id":"94293c0e-e9fd-4b58-9554-6c3bb9a181ae","resolution":{"observed_at":"2026-08-03T05:32:40.701006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:40.776914Z","title":"Hybridflow: A flexible and efficient rlhf framework","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:40.776914Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:9c1c553ff823edd1656386ed87fa017dbc572b3b65f68eb5a8af6f4ea2663cf0","observation_id":"0108285f-5b65-4507-b5eb-b96e32f72cf8","resolution":{"observed_at":"2026-08-03T05:32:40.776914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24298","last_updated":"2026-03-02T03:07:29Z","snapshot_observed_at":"2026-08-02T16:10:09.199211Z","submitted_at":"2025-05-30T07:18:25Z","title":"AReaL: A Large-Scale Asynchronous Reinforcement Learning System for Language Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24298","snapshot_observed_at":"2026-08-03T05:32:40.837833Z","title":"Areal: A large-scale asynchronous reinforcement learning system for language reasoning.arXiv preprint arXiv:2505.24298, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:40.837833Z"},"links":{"cited_paper":"/paper/2505.24298","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:e4bde97e2fa9334908652e98fb20682f0b550b3cbc51ff83e764f3eee72813e3","observation_id":"af19c22a-1aa9-4c5b-87fb-42df5799b123","resolution":{"observed_at":"2026-08-03T05:32:40.837833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18588","last_updated":"2025-08-26T01:42:46Z","snapshot_observed_at":"2026-08-09T13:14:09.156140Z","submitted_at":"2025-08-26T01:42:46Z","title":"History Rhymes: Accelerating LLM Reinforcement Learning with RhymeRL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18588","snapshot_observed_at":"2026-08-03T05:32:40.894045Z","title":"History rhymes: Accelerating llm reinforcement learning with rhymerl.arXiv preprint arXiv:2508.18588, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:40.894045Z"},"links":{"cited_paper":"/paper/2508.18588","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:21a333e557474504df912456262c6dd5ca46bdf6b74c5cf7393c7f9f45d2f0d8","observation_id":"96d1c965-bc1d-46f9-bcf6-a69040c52b5e","resolution":{"observed_at":"2026-08-03T05:32:40.894045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18252","last_updated":"2025-04-26T08:33:32Z","snapshot_observed_at":"2026-08-07T20:55:15.330079Z","submitted_at":"2024-10-23T19:59:50Z","title":"Asynchronous RLHF: Faster and More Efficient Off-Policy RL for Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18252","snapshot_observed_at":"2026-08-03T05:32:40.971370Z","title":"Asynchronous rlhf: Faster and more efficient off-policy rl for language models.arXiv preprint arXiv:2410.18252, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:40.971370Z"},"links":{"cited_paper":"/paper/2410.18252","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:8dd815a40d89c4a3ad475218b05d0cb3ee15f9da290bdf2be2c779069909dc5f","observation_id":"eb6b8965-7c31-4ef1-a1bd-ef3c6fc643e8","resolution":{"observed_at":"2026-08-03T05:32:40.971370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15930","last_updated":"2025-04-22T14:19:06Z","snapshot_observed_at":"2026-08-09T10:41:00.576345Z","submitted_at":"2025-04-22T14:19:06Z","title":"StreamRL: Scalable, Heterogeneous, and Elastic RL for LLMs with Disaggregated Stream Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15930","snapshot_observed_at":"2026-08-03T05:32:41.063975Z","title":"Streamrl: Scalable, heterogeneous, and elastic rl for llms with disaggregated stream generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.063975Z"},"links":{"cited_paper":"/paper/2504.15930","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:a4518403a002eccfcf19ac699b47f1a41d68d094279b162d4f0ba3117a777bfb","observation_id":"850b703d-a73a-4f39-aed9-60976c229ce6","resolution":{"observed_at":"2026-08-03T05:32:41.063975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.05387","last_updated":"2025-08-12T15:23:04Z","snapshot_observed_at":"2026-08-07T12:10:11.549864Z","submitted_at":"2025-08-07T13:37:04Z","title":"Echo: Decoupling Inference and Training for Large-Scale RL Alignment on Heterogeneous Swarms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.05387","snapshot_observed_at":"2026-08-03T05:32:41.151927Z","title":"Echo: Decoupling inference and training for large-scale rl alignment on heterogeneous swarms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.151927Z"},"links":{"cited_paper":"/paper/2508.05387","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:dc45c8e43936c8c489f842c217325c3d58e6d87ef0da7fc5c7c30e82f2725492","observation_id":"fae02c87-3c7d-444a-9f1d-ee03fb58aea1","resolution":{"observed_at":"2026-08-03T05:32:41.151927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:41.253596Z","title":"Petals: Collaborative inference and fine-tuning of large models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.253596Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:c7654d2731d54f81a275a9fa86f24332f2cf08ebc0b7652de8b6ade80326fcdd","observation_id":"4df1d50b-d04f-4206-b4a9-fc9988bf9375","resolution":{"observed_at":"2026-08-03T05:32:41.253596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:41.401706Z","title":"Swarm parallelism: Training large models can be surprisingly communication-efficient","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.401706Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:447ceff60428a79b1db7bdad62dc9a63497f4a4322819e3ec3d25828c42a12a4","observation_id":"d687caa2-4372-4667-9d84-e19ce5eb68f9","resolution":{"observed_at":"2026-08-03T05:32:41.401706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:41.464947Z","title":"Parallax: Efficient llm inference service over decentralized environment.arXiv preprint arXiv:2509.26182, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.464947Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:0381608aecfdd1a48254d014f0a57f27834e0296cf8a936b6e20cc8b4c97a801","observation_id":"2ecfd94a-47e0-4d25-9fa2-aba0a051f621","resolution":{"observed_at":"2026-08-03T05:32:41.464947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:41.584396Z","title":"Rlax: Large-scale, distributed reinforcement learning for large language models on tpus.arXiv preprint arXiv:2512.06392, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.584396Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:9fe8b38ec54b9b37f73ff9059e6cfd5c14b0d209bac98067e04a18164e967d38","observation_id":"455bd1ca-a0a2-495c-afcd-1c5a8499f237","resolution":{"observed_at":"2026-08-03T05:32:41.584396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:41.689686Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.689686Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:429a92efdf588f2b38777178304a9b8b1d61e3210e1be737e9f9a6011b59f4dd","observation_id":"1f870cc5-b633-4e0b-94a4-aec29766f9b4","resolution":{"observed_at":"2026-08-03T05:32:41.689686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:41.805004Z","title":"A survey of reinforcement learning from human feedback, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.805004Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:7c7e57c3924ff519047bdffcde5b4ca2c6335145fce95416e4409f96d9f0e623","observation_id":"72d94e30-d90c-45a2-8518-98893edff2fe","resolution":{"observed_at":"2026-08-03T05:32:41.805004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:41.886782Z","title":"Areal-hex: Accommodating asynchronous rl training over heterogeneous gpus.arXiv preprint arXiv:2511.00796, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.886782Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:5bd28d81123a0840ee8303f3d425f47ccc0b5564e98537f5af16146c05575393","observation_id":"2836fbd5-05ce-498c-a907-273c8b6042fd","resolution":{"observed_at":"2026-08-03T05:32:41.886782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07291","last_updated":"2025-05-12T07:24:33Z","snapshot_observed_at":"2026-08-07T15:47:58.734802Z","submitted_at":"2025-05-12T07:24:33Z","title":"INTELLECT-2: A Reasoning Model Trained Through Globally Decentralized Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07291","snapshot_observed_at":"2026-08-03T05:32:41.992143Z","title":"Intellect-2: A reasoning model trained through globally decentralized reinforcement learning.arXiv preprint arXiv:2505.07291, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:41.992143Z"},"links":{"cited_paper":"/paper/2505.07291","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:dd36d10e7f550c585f3a4bc597e3f0d8a32cf2d06155d261e7e43bc1397507b3","observation_id":"8421379f-61e6-4d87-86cd-a33c9be4cd00","resolution":{"observed_at":"2026-08-03T05:32:41.992143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:42.231201Z","title":"Qiu, and Yuqing Yang","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.231201Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:9e023ae0ef1a5f2b3593c29ec3ab900850eb54592862edf97ad97149fa022074","observation_id":"f317fd13-8f3d-41f4-9670-5dc1e9ab3e3e","resolution":{"observed_at":"2026-08-03T05:32:42.231201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:42.345375Z","title":"Prosperity before collapse: How far can off-policy rl reach with stale data on llms?arXiv preprint arXiv:2510.01161, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.345375Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:e6aeff92c9cd7fa6ace3acf08ce002f7d8f5c6adea07388f97cd3e9e9e2059a8","observation_id":"ac433fdb-c1fc-421c-bb75-796b546a0a9c","resolution":{"observed_at":"2026-08-03T05:32:42.345375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-03T05:32:42.396096Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.396096Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:b1dd437734c1720136105b78cbfc83127b39b4cd0500943414a7729b1caf361a","observation_id":"b6b64a8b-f840-41b8-b7ae-3142e11314c9","resolution":{"observed_at":"2026-08-03T05:32:42.396096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:42.483348Z","title":"American invitational mathematics examination (AIME), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.483348Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:21c5be8cb948b7fd018912a2baf0bdceb271951a774f120cc2085ecde50a5d3b","observation_id":"d228c218-06aa-42f9-949b-aaa8edfe2962","resolution":{"observed_at":"2026-08-03T05:32:42.483348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07985","last_updated":"2024-12-24T04:04:30Z","snapshot_observed_at":"2026-08-05T09:35:42.754650Z","submitted_at":"2024-10-10T14:39:33Z","title":"Omni-MATH: A Universal Olympiad Level Mathematic Benchmark For Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07985","snapshot_observed_at":"2026-08-03T05:32:42.552709Z","title":"Omni-math: A universal olympiad level mathematic benchmark for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.552709Z"},"links":{"cited_paper":"/paper/2410.07985","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:1677539e74fd80b4090a5219655540604be990b476e1f1c9b1d695b69b4788c6","observation_id":"e0d579c9-2615-42c2-8439-a081d552c22b","resolution":{"observed_at":"2026-08-03T05:32:42.552709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:42.620970Z","title":"Have llms advanced enough? a challenging problem solving benchmark for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.620970Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:7fb19e21a158390f36701ea114a00bc1474c87b18c8b074a618ef80f09688fc9","observation_id":"116157ac-edb2-424b-8894-81aeb5d6d64d","resolution":{"observed_at":"2026-08-03T05:32:42.620970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09988","last_updated":"2024-12-13T22:03:43Z","snapshot_observed_at":"2026-07-06T19:32:42.378146Z","submitted_at":"2024-10-13T20:09:41Z","title":"HARDMath: A Benchmark Dataset for Challenging Problems in Applied Mathematics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09988","snapshot_observed_at":"2026-08-03T05:32:42.714144Z","title":"Hardmath: A benchmark dataset for challenging problems in applied mathematics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.714144Z"},"links":{"cited_paper":"/paper/2410.09988","citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:5edfa05bb3c547cf1b81459c3ba4be1891edaa96a9991d4f2dba81a030f00f6e","observation_id":"4dd2a08d-e0c7-4bf7-b6cd-a2ab1774ba98","resolution":{"observed_at":"2026-08-03T05:32:42.714144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:42.814718Z","title":"Towards robust mathematical reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.814718Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:bb9a639d21729c70e8dd9f105c2e8682539441d910cd18cca5bb0304f0ecbeb4","observation_id":"d7034725-cdcd-4ec5-b007-245f53c7c885","resolution":{"observed_at":"2026-08-03T05:32:42.814718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:42.880251Z","title":"Qwen3 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.880251Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:ea24b25bc4aea781cff75070b3e44527ca020c2fa530041edaf47ef0648c4c09","observation_id":"1f678e05-4b38-44b7-89b7-87586fe4b4fc","resolution":{"observed_at":"2026-08-03T05:32:42.880251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:42.969166Z","title":"Openai gpt-5 system card, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:42.969166Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:f87ecdae2d3b034f35b153d5c80fc573b904ef00188870a5a2b06c21ec7f438c","observation_id":"4cb84c57-40e0-4467-abfb-42345349719a","resolution":{"observed_at":"2026-08-03T05:32:42.969166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:43.038027Z","title":"Grok 4 model card","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:43.038027Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:f2748f5bf829895a9b4c73a6e4e22c825793c6f12bba3819b51029250554bba5","observation_id":"d7554fe2-e003-4df1-851b-73403727d48c","resolution":{"observed_at":"2026-08-03T05:32:43.038027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:43.169909Z","title":"Claude sonnet 4.5 system card","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:43.169909Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:d996762e607e9e0aeef9ef9a1c8b97c85a54e8fe1b95019cf14de5d14af9e486","observation_id":"623f8f9c-b9da-4be0-95a2-5d9ac5067be4","resolution":{"observed_at":"2026-08-03T05:32:43.169909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:32:43.300084Z","title":"moba://hok_v2","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning","version":5},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T05:32:43.300084Z"},"links":{"citing_paper":"/paper/2602.02192"},"observation_digest":"sha256:7c4e76d12ee1e8e6d79930289fae87b71582e24f2239531db41b450b617e72f9","observation_id":"93bdf701-1019-4e37-b5f2-86740f778b31","resolution":{"observed_at":"2026-08-03T05:32:43.300084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.02192","last_updated":"2026-05-26T02:43:34Z","latest_version":5,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T04:10:49.998392Z","submitted_at":"2026-02-02T14:57:53Z","title":"ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 2 inbound Pith citation observations for arXiv:2602.02192."}