{"as_of":"2026-08-10T09:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:999e5a966544d67135cb92185c77d8acf7b6ec875e565305ce62458ca8dbc8ff","coverage":[{"denominator":169,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T00:47:51.407786Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.25123/citation-record","integrity":"/paper/2607.25123/integrity","json":"/paper/2607.25123/citation-record.json","paper":"/paper/2607.25123"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.111968Z","title":"Neural computation , volume=","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.111968Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:e944db34eb4415680159ff9a59768fe82c59a081b6ecd4697972f6a6e944b082","observation_id":"45234cf9-4400-42a6-8821-8512608626ea","resolution":{"observed_at":"2026-07-31T00:47:51.111968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.115173Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.115173Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:331b64d097325dc8cc0a9204f526f76e1ac8a99c84c933090b3467b145ecc7dc","observation_id":"1fd74ced-a3ac-4b3b-a147-d65ebda6e86c","resolution":{"observed_at":"2026-07-31T00:47:51.115173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.121976Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.121976Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:4efd548855910dbc506baddddb80178a800f3654204fc428ad3ecd9b77b27151","observation_id":"93ef2e0c-f033-4b11-b653-6cbe8bb1d275","resolution":{"observed_at":"2026-07-31T00:47:51.121976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.125411Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.125411Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:6c4ed21128e318e65efb3eb03c8b75c5a0d9c7c70139af002a4c7e6dae0bd7f2","observation_id":"68ac1859-130b-4acb-a992-8bcd2a9d1b8a","resolution":{"observed_at":"2026-07-31T00:47:51.125411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.128562Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.128562Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:fd2cad00a24bbe95cd270bf3ba3035cf581535532dee38218d53d859a4d1fc08","observation_id":"a6f473d3-ebb1-4bfe-bad6-7e719396f40d","resolution":{"observed_at":"2026-07-31T00:47:51.128562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.131816Z","title":"arXiv preprint arXiv:2507.09087 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.131816Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:dddfa51a51491b951396873a34cbf27291b43f798cb938eba4d90da2e2ff55d6","observation_id":"a877f7e8-0ca0-4faa-b352-c7079cfabfe4","resolution":{"observed_at":"2026-07-31T00:47:51.131816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.134917Z","title":"Proceedings of the AAAI conference on artificial intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.134917Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:79f9c48f4dbcd2100b8c1f39c94de11fb04f5ffcf06d81998cf090eb3a38b423","observation_id":"a5a32b0a-1693-4b19-bebe-c27e87f25728","resolution":{"observed_at":"2026-07-31T00:47:51.134917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.137774Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.137774Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:aa97a5975366430a4ce3177abf5e0716d107ba2fec9b1cff671fe5250ca26101","observation_id":"30da7685-0c0d-4ba9-a491-4990b6241dac","resolution":{"observed_at":"2026-07-31T00:47:51.137774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.140868Z","title":"International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.140868Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:baac3e382e723aa18666131e6ed35922d65f1d5ae68024eee3c42d000f9ce7eb","observation_id":"b9154672-8d24-4cae-aaf3-4e9672dbd946","resolution":{"observed_at":"2026-07-31T00:47:51.140868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.143802Z","title":"IEEE Transactions on Signal Processing , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.143802Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:4c5e90993361e0e1b54eb45adff33a2d517ce71bebe846f80dd2cfcc233d2697","observation_id":"052e6342-faed-4a20-8882-f179c54a7352","resolution":{"observed_at":"2026-07-31T00:47:51.143802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.146740Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.146740Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:c4f0c5ff0d9b1d28aeff18b8702e74637ade9f3bf8ebe3185e6fd94eb4344c96","observation_id":"de9b2c58-6796-459f-b9b9-48c941f43d6f","resolution":{"observed_at":"2026-07-31T00:47:51.146740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.149479Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.149479Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:3109cae1bb32ab66309d695b02a5b3f2f8e3203bc2a01285e40c81e4dd62c0f6","observation_id":"06a82a7a-6023-4766-b772-daddea8070b3","resolution":{"observed_at":"2026-07-31T00:47:51.149479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.152247Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.152247Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:01419e5e625625645d398f608cabb9eec7e7785c53bb049fcdb4126eb7044e3a","observation_id":"6d1826ba-e9a2-4216-b9b0-f58483869b36","resolution":{"observed_at":"2026-07-31T00:47:51.152247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.155360Z","title":"Proceedings of the Thirty-Fourth International Joint Conference on Artificial Intelligence , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.155360Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:ed49d4a137300bb7a1418c68f78eab4b2df4d9e0ad188df61385dd95bc8821fa","observation_id":"364f8049-682c-46b1-b13f-deb716d0b695","resolution":{"observed_at":"2026-07-31T00:47:51.155360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.158258Z","title":"IEEE Transactions on Signal Processing , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.158258Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:4922ce6291558eec53ae45e1de65141d5ac70dcb58fb87165060f9985cc984c7","observation_id":"c57c539b-75cc-4319-8775-d90ddce8ccab","resolution":{"observed_at":"2026-07-31T00:47:51.158258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.160903Z","title":"AAAI Conference on Artificial Intelligence , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.160903Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:4504e0a03548d470cf6df39a02b2fdd145d801ef31d87b92986574844d506844","observation_id":"1c6db84b-f4e8-4f8a-a943-dff6ca0e9ce5","resolution":{"observed_at":"2026-07-31T00:47:51.160903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.163545Z","title":"2022 , journaltitle =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.163545Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:2f5c063ab54c0214be56e31d39cd5a02742ef0a6dafedb638a5fdbc1db3bb6ad","observation_id":"6d6c9627-02e8-4f84-8ef8-ce4b0ef15126","resolution":{"observed_at":"2026-07-31T00:47:51.163545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.166711Z","title":"nature , volume=","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.166711Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:93e4fee68dc9186e0fcd716c87e018270475d2d85dc4bd8f29ca2fc33447f81a","observation_id":"94ba4c67-951f-434d-99db-bc5024a64d97","resolution":{"observed_at":"2026-07-31T00:47:51.166711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.169499Z","title":"Proceedings of the Ninth National Conference on Artificial Intelligence - Volume 2 , pages =","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.169499Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:71fd3650860eb166021753cf266867042046454340739fda5f869351339a9c03","observation_id":"ee8f269d-7982-4879-9c83-bcb337cf3a44","resolution":{"observed_at":"2026-07-31T00:47:51.169499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.175567Z","title":"and Barto, Andrew G","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.175567Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:1679d7289cf02a4378b7a5718322f926af3877322ffecbd3a6e98f9845eb857d","observation_id":"8ed5cba1-d7d0-4092-880f-7b3b055961dd","resolution":{"observed_at":"2026-07-31T00:47:51.175567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.178600Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.178600Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:53a09d85beefe1e32a2739cd1e483fabadc52a2562672d5f98af6dd9843e13d1","observation_id":"8991ba46-585d-4be0-8792-51ccae132442","resolution":{"observed_at":"2026-07-31T00:47:51.178600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.181641Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.181641Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:6012fdb36fce5cb92711524eac0cdfe722339a5c330680a0b89f60fb9482e74d","observation_id":"4290ba54-16a3-4e8a-b74e-1f022e2284a0","resolution":{"observed_at":"2026-07-31T00:47:51.181641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.184892Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.184892Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:93d45d7eb514c3aae02f04a74459d0fcde65d046fa4606cee41a70d0df1b8bb3","observation_id":"3035b10c-15d1-4142-b1dc-e24e58407a20","resolution":{"observed_at":"2026-07-31T00:47:51.184892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.187604Z","title":", title =","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.187604Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:27a4978f58ad4b444365abdcbcccbe7119e5cfda4c9a5a8e72771886fbb01199","observation_id":"cf9b20f5-f067-4f4d-9f4a-4119f4a4e0b9","resolution":{"observed_at":"2026-07-31T00:47:51.187604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.190230Z","title":"Journal of Machine Learning Research (JMLR) , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.190230Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:2d223acd4674c86c4128eba29b76c6adaf26835c53ae05599985dc107d29dcf1","observation_id":"b5f9b704-8fc0-4f05-b8df-8f4fb63d2ae9","resolution":{"observed_at":"2026-07-31T00:47:51.190230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.193039Z","title":"International Conference on Machine Learning (ICML) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.193039Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:60262d8ee80191b689c95d6ef315afaf002c33344263729718c0617d052119ef","observation_id":"0996666c-7731-4ced-bdab-f238178969dc","resolution":{"observed_at":"2026-07-31T00:47:51.193039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.195874Z","title":"International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.195874Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:e42aa8e02564e4de76a7c1053bafa61c71977a2620af38b44ede96b41ae215f4","observation_id":"de98b11a-8451-4c7e-a19f-147e9bd8aadf","resolution":{"observed_at":"2026-07-31T00:47:51.195874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.198629Z","title":"3rd International Conference on Learning Representations (ICLR) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.198629Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:8868bde3d255334396a40bc756380f8df75c2fe273bed2e3e95c76c823e25d0f","observation_id":"c6ee6037-4406-4abc-aaa1-d6607998309b","resolution":{"observed_at":"2026-07-31T00:47:51.198629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.201269Z","title":"Sutton , title =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.201269Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:14c79a2aa730e94ece8b3e851c9317e7feb8a99816d3c86c78be6957a61263b8","observation_id":"0e8a92a9-3db2-41a6-8cc9-887e1dc50353","resolution":{"observed_at":"2026-07-31T00:47:51.201269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.205222Z","title":"The Reinforcement Learning Journal , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.205222Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:ca72af20a65d9b77369a4d6be5e23ec36541d5ff3b686437274bf9993c435602","observation_id":"9d1a75ae-2d2e-420e-89ef-78f727f8cfd2","resolution":{"observed_at":"2026-07-31T00:47:51.205222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.208047Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.208047Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:ad29e270df5f667fbaf6b1fb551e6a0474fb7445d234c38d628d68c750563f5d","observation_id":"dd2c011d-125a-426f-add8-325669ecc021","resolution":{"observed_at":"2026-07-31T00:47:51.208047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.210879Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.210879Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:fb49739b37a54600c561064a986ced51e5720e46650c69f4e1e461e5686f42b2","observation_id":"6610599a-54fe-4e5c-b1e2-67b362e369b6","resolution":{"observed_at":"2026-07-31T00:47:51.210879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.213739Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.213739Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:8fe2b4ad400f8691c7c6a79036092b97024b6d71202263b82e92ef4b2986bff0","observation_id":"27bc263d-1542-408c-b535-9bc22a559e6d","resolution":{"observed_at":"2026-07-31T00:47:51.213739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.216559Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.216559Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:38ca5099572744aae9962b4bd3415009251a13342bd374f3aab67503aca4cd41","observation_id":"22239a38-d20f-482b-adc0-0c46d0f5a30f","resolution":{"observed_at":"2026-07-31T00:47:51.216559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-09T02:21:17.479736Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01603","snapshot_observed_at":"2026-07-31T00:47:51.219491Z","title":"arXiv preprint arXiv:1912.01603 , year=","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.219491Z"},"links":{"cited_paper":"/paper/1912.01603","citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:056babc13fc8435ed40786e1fc8e498069fef681576400ef2df40cac4bb776fb","observation_id":"3a53ca67-1c1e-4a00-a8c6-74945484f6ac","resolution":{"observed_at":"2026-07-31T00:47:51.219491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.00374","last_updated":"2024-04-03T14:26:32Z","snapshot_observed_at":"2026-08-07T15:39:37.899352Z","submitted_at":"2019-03-01T15:40:19Z","title":"Model-Based Reinforcement Learning for Atari","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.00374","snapshot_observed_at":"2026-07-31T00:47:51.222914Z","title":"arXiv preprint arXiv:1903.00374 , year=","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.222914Z"},"links":{"cited_paper":"/paper/1903.00374","citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:3e1e713f418c212b3b9b24ff85420d3ea58382ab6958d6521d99082e0f91cedb","observation_id":"b2c4c851-7f80-4d88-9d86-5eb636633f27","resolution":{"observed_at":"2026-07-31T00:47:51.222914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.226248Z","title":"Medical Imaging with Deep Learning , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.226248Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:efe46babf5acc1f6af22957c70fc2699fdccd82ef9d3d77e4c7ab9ecef5953d1","observation_id":"5a1426ba-c0e4-45b2-a565-c8159b12a24e","resolution":{"observed_at":"2026-07-31T00:47:51.226248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.229350Z","title":"Proceedings of the 40th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.229350Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:ec8c0a0311dc3aca03160b50ffde5462b1a2d9851c2cba621e015bda9fec831d","observation_id":"4fc92b92-5381-4178-8e59-a4bb4730aaf0","resolution":{"observed_at":"2026-07-31T00:47:51.229350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.232277Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.232277Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:7c29158a1fc634dcce63b7d2640fbb0d7fa5aa66f5ea2c1a5816542fbfa5bc02","observation_id":"ef3d9843-8ed9-41c3-9910-6dc5903fba91","resolution":{"observed_at":"2026-07-31T00:47:51.232277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.235131Z","title":"Artificial intelligence , volume=","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.235131Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:b77f2dacd5caab0898171736ba34ebce8b026fc9bdab257d250d8662da652132","observation_id":"657360cc-ff7e-491f-915a-d8775078402f","resolution":{"observed_at":"2026-07-31T00:47:51.235131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.238145Z","title":"Artificial Intelligence , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.238145Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:b6fda652b48b7cf88c72008b2fcd052552852058fc627181bf19c6fb1f0805c6","observation_id":"1f587b7b-3c35-4bea-945a-89fe0c854464","resolution":{"observed_at":"2026-07-31T00:47:51.238145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.241263Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.241263Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:f58fafb8b888f552c10521a328a0d0ea591ed59d76f62aa135cff23cfa0674e6","observation_id":"6de3314b-0a8f-4bce-ac2d-7fe4b9e83672","resolution":{"observed_at":"2026-07-31T00:47:51.241263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.244001Z","title":"Journal of Artificial Intelligence Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.244001Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:3f300529c36606d905b4298e5884fa2551af90bc910c2e6940049207dc2d219d","observation_id":"3102fc96-cbfc-4e9f-b593-9004e8608ea0","resolution":{"observed_at":"2026-07-31T00:47:51.244001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.246884Z","title":"Proceedings of the AAAI conference on artificial intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.246884Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:56a0596520b73c6cc0a48e583653520322d4f995e9d6f314789e0053df7db7bf","observation_id":"019fca96-1ba5-4cfd-8084-20817e61d0c3","resolution":{"observed_at":"2026-07-31T00:47:51.246884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.249797Z","title":"Machine learning , volume=","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.249797Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:2ad3de242c1e53bb108f5f3440ca67501e295828c5efd2b7418fd4e62a7efdac","observation_id":"f6750aa9-b94c-46c9-b1e1-e511b49b6fce","resolution":{"observed_at":"2026-07-31T00:47:51.249797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.253109Z","title":"and Naddaf, Yavar and Veness, Joel and Bowling, Michael , journal =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.253109Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:d7fa5aa3b3a1d075012d7368c94f99d245a52c3b8ae5a9614655c6b6225ebdb0","observation_id":"9ade702c-f0ea-4369-a303-8682bc4d447a","resolution":{"observed_at":"2026-07-31T00:47:51.253109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.256027Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.256027Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:4d99bd149f766f2dee27f1df6c0bc119e90279c1a58ab09a619b86d39c10945c","observation_id":"524fdad9-ecdf-49ff-a4ad-f611752f920d","resolution":{"observed_at":"2026-07-31T00:47:51.256027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.258986Z","title":"Proceedings of the AAAI conference on artificial intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.258986Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:7c66e6af44678dd66b8e4ad04bfa7d1a292a6d5ef00b9fbc5944ac7f127873a3","observation_id":"0f7c7488-6157-44ed-ae85-ec0899b82ca3","resolution":{"observed_at":"2026-07-31T00:47:51.258986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.261685Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.261685Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:124abfdf3eb5091c8d69ee940cc9b3dcb60f8db4855b41fed62ad8033f1eb333","observation_id":"4dbe46aa-cb07-4e65-8aaf-982d79dc582b","resolution":{"observed_at":"2026-07-31T00:47:51.261685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.264576Z","title":"Proceedings of the 27th International Joint Conference on Artificial Intelligence , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.264576Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:de1954363e624bfafc9ed7ac71b24433fe11bca05083d44e0d3970462a70f580","observation_id":"3ef28edf-4514-40b1-a3f1-8375add670d8","resolution":{"observed_at":"2026-07-31T00:47:51.264576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.267536Z","title":"Proceedings of the 37th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.267536Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:7eac4b36a879e47481c6da1fb8289c304e9d6f9daf6e8844e491d80d376fa6f0","observation_id":"de1e8f5a-3b0a-456a-a002-75b51345f4bf","resolution":{"observed_at":"2026-07-31T00:47:51.267536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.270401Z","title":"Experience Selection in Deep Reinforcement Learning for Control , journal =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.270401Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:c7a6c37feded16d6dbdffeef8f8d2d8fdbafa169c19b68d53d8cad524407c621","observation_id":"b64dd735-12b1-484b-a0be-9fb0f8902b18","resolution":{"observed_at":"2026-07-31T00:47:51.270401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.273121Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.273121Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:fb8f7389d82161558bbc8871f603d7c92925c90e77588905a70e2dc015a39a4e","observation_id":"cc5ee217-eb50-419e-88d4-9e84a64239a6","resolution":{"observed_at":"2026-07-31T00:47:51.273121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.276164Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.276164Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:52fda11d3dde9745ea16d074e0b0df55dbc70fe5d7eb91755b767664e5cb94b5","observation_id":"ef3f48f9-fc69-4e5a-9369-155390bc2a1d","resolution":{"observed_at":"2026-07-31T00:47:51.276164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.278888Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.278888Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:97e1356986228d26cdb5937ebd12919ada803e59bd6d183f57628db9039b945d","observation_id":"b2f01ea4-e143-4332-8afc-2266d79db41d","resolution":{"observed_at":"2026-07-31T00:47:51.278888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.281512Z","title":"Proceedings of the 40th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.281512Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:a3f47f0ef88a845002a658d34da258ba7e7f9772fa395536fabe23b267b3a6c8","observation_id":"92163691-dd61-4f87-ad44-c8674771b19c","resolution":{"observed_at":"2026-07-31T00:47:51.281512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.284198Z","title":"Proceedings of the Twenty-Seventh International Joint Conference on Artificial Intelligence,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.284198Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:5c75f2f986e15e9b6fe3d8541412dd3fdeec4da053da426db7d6cd3668a04971","observation_id":"aa3bd543-ceff-4859-ab3c-4dca1ca96051","resolution":{"observed_at":"2026-07-31T00:47:51.284198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.287072Z","title":"No More Pesky Hyperparameters: Offline Hyperparameter Tuning for","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.287072Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:cf2902dbe5436375d450c663c6a5dbc5582b7c5d74f2d122e5e7c0e2d4fd2107","observation_id":"aab31cad-ddde-4d0c-8a3d-c50a62bc7f9c","resolution":{"observed_at":"2026-07-31T00:47:51.287072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.289768Z","title":"2013 , journal=","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.289768Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:9fb1a4596a4e96c7af6eedc4b429c864f1f0648a39fab9a34041c6ddf2f149bb","observation_id":"0fdaedc8-5b1c-4a17-bc99-cf280463634a","resolution":{"observed_at":"2026-07-31T00:47:51.289768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.292570Z","title":"International Conference on Learning Representations (ICLR) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.292570Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:76baf2600cb4a66dbad08405032a0021f32ac8ba4fff82da1d2f890254a01b53","observation_id":"4a179583-7bca-4919-b4f7-e9f76f28ee6c","resolution":{"observed_at":"2026-07-31T00:47:51.292570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.295192Z","title":"Reinforcement Learning Conference , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.295192Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:4cc35fd543696684954003f97526bac784b0a0461878ac76bce099fc5a835834","observation_id":"472f768a-6a7d-46db-b550-52c84a8cef89","resolution":{"observed_at":"2026-07-31T00:47:51.295192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.298022Z","title":"Reachability-Aware","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.298022Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:9627cbf52ec8b193c65a9fc2285ce14f9f7d78bb52f4f0fce27b75178ed975e9","observation_id":"a4a7b849-4ea0-489a-9464-01d7f2c23a90","resolution":{"observed_at":"2026-07-31T00:47:51.298022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.300664Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.300664Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:b45dd7605833d1465bee8018299ff225e1c7df0dbe6886000bb9b6c4b3a30e53","observation_id":"2726796e-27b9-4575-be55-851f0bd5ffa6","resolution":{"observed_at":"2026-07-31T00:47:51.300664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.303398Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.303398Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:035cf53f55c1a358889ff8827dd55ebb319136dc1307dc60f79ea84553fde181","observation_id":"d5a84089-6fd9-47f9-9bfa-d70c82916903","resolution":{"observed_at":"2026-07-31T00:47:51.303398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.309217Z","title":"Medical Imaging with Deep Learning , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.309217Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:d71d0fcb9ff9f96dc09238154cc80ea25c6a67bf0258cfcf3d6747b9e160ba34","observation_id":"8482040a-f0ff-4aaf-8260-a51378459d47","resolution":{"observed_at":"2026-07-31T00:47:51.309217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.311905Z","title":"SIAM Journal on Computing , volume=","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.311905Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:c6748ba8f9f2f2790c1c478de903e1d614322585629ff2c0089c222bc16bec1d","observation_id":"c604cdb3-0947-4294-a8c8-22a5e0e13178","resolution":{"observed_at":"2026-07-31T00:47:51.311905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.314567Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.314567Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:4d4886a691eb39bd8289eebdf2e289abb8c2addea9a99b1cfb5e59e75b605338","observation_id":"a545f962-8ae8-4130-945b-efb23160e31e","resolution":{"observed_at":"2026-07-31T00:47:51.314567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.317250Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.317250Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:c439e40e074b2e3c44dda75b31eb4fdbb1002e5f041ac1f58d4c5f024782ddd5","observation_id":"4946b300-bf26-4f3d-8f74-4d57b945c354","resolution":{"observed_at":"2026-07-31T00:47:51.317250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.320066Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.320066Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:df7ed9ca8bb0e54955e52ed28577ed2bd36cd603a7d71bb80e993d364ca663a2","observation_id":"bbb72193-0d8e-4b17-ad4e-8de4f08a0db7","resolution":{"observed_at":"2026-07-31T00:47:51.320066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.322729Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.322729Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:4125938e49cb6092f40ac012080e3cc5846cc211dadec8ad50da07862f6acacf","observation_id":"f0e3eae7-ca3b-40f0-9aa5-620b17a19120","resolution":{"observed_at":"2026-07-31T00:47:51.322729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.325559Z","title":"Machine learning , volume=","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.325559Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:3c2ca2f1adc35d81a9d86c03e2a2b557b2623bac24419d330197fab632843ec3","observation_id":"244772cd-4ba7-445a-8421-b06d152ca903","resolution":{"observed_at":"2026-07-31T00:47:51.325559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.328272Z","title":"arXiv preprint arXiv:2509.15032 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.328272Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:26bc61c7bb4652865323b21108b728886b1755022ec9a9e0c55b1dd6a9af8eff","observation_id":"7fa5ac10-b90e-4571-a35b-0560ef8296e0","resolution":{"observed_at":"2026-07-31T00:47:51.328272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.330972Z","title":"Transactions on Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.330972Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:70683f109b2fdae692ad2ba6c3bb1d7bf65017aa0293f4dbd49ef8840f372dfe","observation_id":"eec46e78-c114-454d-b710-c99d8307723e","resolution":{"observed_at":"2026-07-31T00:47:51.330972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.333596Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.333596Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:00b660fa13c51e0ea5f39864e73843f7e103f5c06986e4aa1bd40d82d532d956","observation_id":"9e476605-e3a3-4e92-bc3e-ba4eba5d651a","resolution":{"observed_at":"2026-07-31T00:47:51.333596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.342233Z","title":"Proceedings of the AAAI conference on artificial intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.342233Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:17be49704e3644df11ca38b1485b0ee63777fb32e680ce95ccc58fff7897c766","observation_id":"8af38a6f-ab00-4a50-af06-e623c110c2db","resolution":{"observed_at":"2026-07-31T00:47:51.342233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.344831Z","title":"2023 IEEE/CVF International Conference on Computer Vision (ICCV) , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.344831Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:0e46e14e64bdc8a0c762f45163c62e29e7b53759afa698d782daaff28dd55bd2","observation_id":"2b487743-2185-4893-942b-0ad214f17e23","resolution":{"observed_at":"2026-07-31T00:47:51.344831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.347580Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.347580Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:edbaddfc42cac3bddfe39c15d055d8734bc1dfb04eda72abc5795e81450b0782","observation_id":"dd04982c-3034-4831-8c51-ca9cb281a5ce","resolution":{"observed_at":"2026-07-31T00:47:51.347580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.350201Z","title":"Proceedings of the 28th International Joint Conference on Artificial Intelligence , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.350201Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:ef55b3d17d754fe4adbf6fa09d9bc259bc123e0bdb7b841e87c70d9152863e9e","observation_id":"daa60760-9818-4002-9edd-5692ec8c5564","resolution":{"observed_at":"2026-07-31T00:47:51.350201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.352696Z","title":"Frontiers in neurorobotics , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.352696Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:614367d08720456de4d94cac9113447ab70f450109fb100dc789d41d76ebbc71","observation_id":"efec67d3-ec0a-4038-8ecf-d06171a1503f","resolution":{"observed_at":"2026-07-31T00:47:51.352696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.355082Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.355082Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:53beee975a1aa960a541dbffeb437e0ce1b516997fa27b59d018f94ed1ee513f","observation_id":"b11b6407-79e6-483a-b699-65b223780e4d","resolution":{"observed_at":"2026-07-31T00:47:51.355082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.357604Z","title":"Proceedings of the National Academy of Sciences of the United States of America , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.357604Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:18a3ff0b4f17ad68c9c2bf2bc1389c816d66e9995c76c615da0c5aa39433b1de","observation_id":"15573386-0f9b-4571-a83b-74c0b0859388","resolution":{"observed_at":"2026-07-31T00:47:51.357604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.360203Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.360203Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:fcf81285012be86bb828d82ff6c07d2fe99c5265310886da500117440ba093e7","observation_id":"00871f67-1c0f-458a-a823-68718eff5e04","resolution":{"observed_at":"2026-07-31T00:47:51.360203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.362948Z","title":"Transactions on Machine Learning Research , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.362948Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:d1810b1ba969b8442e296f76ac4967224e0075da7a59bd20be29bf12b3ac768a","observation_id":"39757fc9-691e-45c1-a3fe-1855e039e383","resolution":{"observed_at":"2026-07-31T00:47:51.362948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.365558Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.365558Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:41bde0aac4256c3855633c3f331fe00859dcb6913d492ce9873edf362adfbde8","observation_id":"dcd26718-28dc-436d-b57c-3c2b61721b6b","resolution":{"observed_at":"2026-07-31T00:47:51.365558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.368111Z","title":"Applied Intelligence , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.368111Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:1abaa3cb000cb4f2e3d55b26f845bd75de6f460b76d0204866ca8632ce4a403e","observation_id":"330cf8da-5b93-4cf3-915d-7586212b4abd","resolution":{"observed_at":"2026-07-31T00:47:51.368111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.03261","last_updated":"2021-02-05T16:09:07Z","snapshot_observed_at":"2026-07-06T10:38:52.497164Z","submitted_at":"2021-02-05T16:09:07Z","title":"Revisiting Prioritized Experience Replay: A Value Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.03261","snapshot_observed_at":"2026-07-31T00:47:51.370566Z","title":"arXiv preprint arXiv:2102.03261 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.370566Z"},"links":{"cited_paper":"/paper/2102.03261","citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:40ba31dc9a4adbdec4b03771ee161e96f9ab2d0cb89d41516786c14be3c6e5a1","observation_id":"856b57c7-831e-4f62-9276-f22232da9ded","resolution":{"observed_at":"2026-07-31T00:47:51.370566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.373254Z","title":"The Eleventh International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.373254Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:493265a1d18ee5c166cf2ae6e523dc741291af3ed25433ce80b7093829f9b7ef","observation_id":"915533a3-bcc4-4e8c-abbd-daaf99b7c917","resolution":{"observed_at":"2026-07-31T00:47:51.373254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.375829Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.375829Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:271ef2a33b880de767450873f5933356bf34602b4e2f1d68ead2960d58801774","observation_id":"4e18accf-f607-4f74-a613-1aea240238e9","resolution":{"observed_at":"2026-07-31T00:47:51.375829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.378509Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.378509Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:265c8b7e83f995752b420e266efc67df1c9e519b9548d238f5e19fcf7d8fc2af","observation_id":"dc451ad3-3562-4bfc-b6bc-562f96f248ea","resolution":{"observed_at":"2026-07-31T00:47:51.378509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.381407Z","title":"arXiv preprint arXiv:2512.01034 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.381407Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:23242862298fe70a8b7f369601c15466eafd02a27e206a7fc04b31f11d392dc3","observation_id":"bbc4f46d-6b72-4304-9e8c-f2f9587423a0","resolution":{"observed_at":"2026-07-31T00:47:51.381407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.384157Z","title":"Transactions on Machine Learning Research , issn=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.384157Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:f883bd04bf863f8508eb9012126fd9a14d6e969b893cd305bdef201eb19c05b9","observation_id":"f70dd361-dff2-4e6c-809d-1e17df3933c4","resolution":{"observed_at":"2026-07-31T00:47:51.384157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.386754Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.386754Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:ac47872ea2b2ad73badbf65607c596ec7c51cd2481301299ceb5574fb7ca4cdc","observation_id":"626b81c8-0970-4776-bb6a-0fe1d17cb799","resolution":{"observed_at":"2026-07-31T00:47:51.386754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.389250Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.389250Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:68071696cb9e83e54ca4d3c3ae6f489d3b15ade78545494468eda596935b61b0","observation_id":"d5d41d7e-04b5-43e3-b086-55826a945dc5","resolution":{"observed_at":"2026-07-31T00:47:51.389250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.391764Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.391764Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:ec58b05c248a9be7705343a650b9b268173f90f2a222781f9d3575d7593800db","observation_id":"8cf99441-2b28-4475-a473-429642c36da7","resolution":{"observed_at":"2026-07-31T00:47:51.391764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.394303Z","title":", booktitle=","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.394303Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:b43c64c403983bfaeb7652f3942344ec0f10033e88da8e921bff957a1ca156c8","observation_id":"6bf92801-822b-4fd9-8752-ff5bf75fdbf7","resolution":{"observed_at":"2026-07-31T00:47:51.394303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.397231Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.397231Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:b48646e9ebecf68e74343a5b2303b59a559566a23e9516dc1f80f22dc7741d05","observation_id":"63350b18-2b1a-4012-87a0-42a88e1d2368","resolution":{"observed_at":"2026-07-31T00:47:51.397231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.399786Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.399786Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:7341a46d83acb6c304b3bd390f0f1301c75127addbc3bd37180886b9243a4836","observation_id":"4c7b00cf-41f7-4e6c-af00-b945dc0df27d","resolution":{"observed_at":"2026-07-31T00:47:51.399786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.402403Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.402403Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:3e6345c5c4afc74da5f7286315bd98a2d8dd64343ce1d9b920cdf345fa845ab2","observation_id":"18a175fa-d86f-4fa3-aca7-51dccbcf15b5","resolution":{"observed_at":"2026-07-31T00:47:51.402403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.405209Z","title":"Learning for Dynamics and Control Conference , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.405209Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:8017941716acf047d15b08d3ae909c322fbf4fdc85d9c53e7554487aaf4df9ef","observation_id":"6b3ceb3d-0553-4e19-a783-c58c5069abdf","resolution":{"observed_at":"2026-07-31T00:47:51.405209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.407786Z","title":"Nature , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":106,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.407786Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:8440a94d842ab49ad40accc8a3ab1d38741630104a440ca9d155489c2dbb3140","observation_id":"3f4a6595-fa27-4cfa-812d-ca052af6dd47","resolution":{"observed_at":"2026-07-31T00:47:51.407786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T03:27:36.963796Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":169},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 169 outbound references and 0 inbound Pith citation observations for arXiv:2607.25123."}