{"as_of":"2026-08-24T03:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2989c5d7e896263308de78886e57ce97179b08021b5ff01f415eeea9ec590ede","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T23:17:52.997124Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.06714/citation-record","integrity":"/paper/2509.06714/integrity","json":"/paper/2509.06714/citation-record.json","paper":"/paper/2509.06714"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2111.00210","last_updated":"2021-12-12T04:24:08Z","snapshot_observed_at":"2026-08-16T17:45:15.672999Z","submitted_at":"2021-10-30T09:13:39Z","title":"Mastering Atari Games with Limited Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00210","snapshot_observed_at":"2026-08-04T23:17:52.930033Z","title":"Mastering atari games with limited data,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.930033Z"},"links":{"cited_paper":"/paper/2111.00210","citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:44e2404b19ae1c68dda0666e5d768ea4faab9a9df54d16953e7f91c7bd56001c","observation_id":"4c6c90fd-7ab9-4913-afb6-a314dfb57db7","resolution":{"observed_at":"2026-08-04T23:17:52.930033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.434064Z","title":"Benchmarking deep reinforcement learning for continuous control,","venue":null,"work_id":"09468fbc-17fc-4691-b7a6-381dfd59bc56","year":2016},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.933714Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:27249c57ad0901da9325540efde08588c53733e20b4ca64f70abe3a336a13392","observation_id":"9c0ed7d4-ee9a-45aa-a5db-40db248b73c6","resolution":{"observed_at":"2026-08-04T23:17:53.437423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.12901","last_updated":"2019-04-29T18:40:15Z","snapshot_observed_at":"2026-08-14T16:39:48.171461Z","submitted_at":"2019-04-29T18:40:15Z","title":"Challenges of Real-World Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.12901","snapshot_observed_at":"2026-08-04T23:17:52.936919Z","title":"Challenges of real-world reinforcement learning,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.936919Z"},"links":{"cited_paper":"/paper/1904.12901","citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:086e34aea2487334b6c3a9a8d320d540c025048c92f5c231f729b773f5ce32e4","observation_id":"18cb8405-05ea-4bf5-808b-2629b29ce7b5","resolution":{"observed_at":"2026-08-04T23:17:52.936919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:52.940309Z","title":"Deep rein- forcement learning in a handful of trials using probabilistic dynamics models,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.940309Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:44e675f128d33c6184ee9c23aacfe6376b3754230d06f68db09464a209e8070e","observation_id":"1d1b1fb9-2eff-4342-af17-76a135ed5001","resolution":{"observed_at":"2026-08-04T23:17:52.940309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.419277Z","title":"pytorch implementation of PETS,","venue":null,"work_id":"c4b43138-9f48-4424-a24d-ff9d2dfd4783","year":2019},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.944216Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:4f70e6a9be7056d3c0edd85e3b805cc4dba711642fbe0716eb107fab8e0d4796","observation_id":"79dc81a1-e6d5-48e5-87c3-59d3c67a005f","resolution":{"observed_at":"2026-08-04T23:17:53.422452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.409908Z","title":"Temporal difference learning for model predictive control,","venue":null,"work_id":"178506e6-5361-45f0-88f8-a3914ce8e20e","year":2022},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.947299Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:32f0a4db932ecac242d5d44478d86776a78690bd0770a1e8254e644f97b3793e","observation_id":"91d08693-7794-4eb0-a448-98289fa54a57","resolution":{"observed_at":"2026-08-04T23:17:53.413253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.401337Z","title":"A tutorial on the cross-entropy method,","venue":null,"work_id":"056250e7-234d-4220-85bb-eeaab1a32618","year":2005},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.950294Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:6e8fa4903360a1c4119cb75200ddd6406dca9f9f8e686bd0bd8093c99166f629","observation_id":"548e413c-2f3b-4059-bf33-79a1ffd82d68","resolution":{"observed_at":"2026-08-04T23:17:53.404379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.391607Z","title":"Physics-informed model and hybrid planning for efficient dyna-style reinforcement learning,","venue":null,"work_id":"8c42c20a-f39f-4ca3-86fc-b2bb9622d694","year":2024},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.953607Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:800f31b4dc6a8359028922579c850668d38a7102561eadff724426d6e3d145b6","observation_id":"d912b7dc-cd61-4b6d-ac16-2ac9599f30c3","resolution":{"observed_at":"2026-08-04T23:17:53.395132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.381304Z","title":"Swing-up control of inverted pendulum using pseudo-state feedback,","venue":null,"work_id":"344e0778-bc60-490c-bf70-81a580c22137","year":1992},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.956330Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:856a946e643b21a3333de938014dd63abab66ea3beed3d4e2e4c035841a12d84","observation_id":"1f429d61-5cef-4fc6-a29e-139f40dba3a5","resolution":{"observed_at":"2026-08-04T23:17:53.384561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08649","last_updated":"2019-06-20T14:13:12Z","snapshot_observed_at":"2026-08-14T16:05:26.608538Z","submitted_at":"2019-06-20T14:13:12Z","title":"Exploring Model-based Planning with Policy Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08649","snapshot_observed_at":"2026-08-04T23:17:52.960328Z","title":"Exploring model-based planning with policy networks,","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.960328Z"},"links":{"cited_paper":"/paper/1906.08649","citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:472b76dcd06d99eada68cf85617dbb6dac6a9e676891a35f4b57d35262eff735","observation_id":"0771da8d-6426-4dda-987e-382c391ab11e","resolution":{"observed_at":"2026-08-04T23:17:52.960328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.05909","last_updated":"2021-04-13T18:07:49Z","snapshot_observed_at":"2026-08-19T00:08:56.683077Z","submitted_at":"2020-12-10T11:32:01Z","title":"Blending MPC & Value Function Approximation for Efficient Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.05909","snapshot_observed_at":"2026-08-04T23:17:52.963414Z","title":"Blending mpc & value function approximation for efficient reinforcement learning,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.963414Z"},"links":{"cited_paper":"/paper/2012.05909","citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:e893c26c5e8812c8c155529600f43c9142c600649ab1d8f465ca267ddb719f13","observation_id":"c06e1088-12c5-45ca-98b4-f21f0ac7a269","resolution":{"observed_at":"2026-08-04T23:17:52.963414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.371808Z","title":"Markov decision processes with delays and asynchronous cost collection,","venue":null,"work_id":"2be0c3e7-5518-420d-ad0d-6446eeded974","year":2003},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.968180Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:31b1859044fb371cc1e58ac9ebc279fb602753fb590407ffc39b39a125ce85dc","observation_id":"b4c7ba73-8e9e-4eec-9d31-3881148487f2","resolution":{"observed_at":"2026-08-04T23:17:53.375094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.361969Z","title":"Delay-aware model-based reinforcement learning for continuous control,","venue":null,"work_id":"5987891c-376d-4b02-af19-cf1bea8129e1","year":2020},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.971895Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:045410b1663ed02e4f5fddd89c05a52dd77dfc55bc1b73e380489a97b480049b","observation_id":"55e75dce-bca5-4cea-a543-0a9077aa5a68","resolution":{"observed_at":"2026-08-04T23:17:53.365601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02966","last_updated":"2021-05-04T20:27:33Z","snapshot_observed_at":"2026-08-16T19:15:25.225760Z","submitted_at":"2020-10-06T18:39:23Z","title":"Reinforcement Learning with Random Delays","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02966","snapshot_observed_at":"2026-08-04T23:17:52.975477Z","title":"Rein- forcement learning with random delays,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.975477Z"},"links":{"cited_paper":"/paper/2010.02966","citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:ce2e4c38902207abab2f4ea576dde979c3ca6176e0ac2ae6daaed8ebcf5e2f1e","observation_id":"737389b3-d76b-49b6-bdfd-91c40f7c0d0d","resolution":{"observed_at":"2026-08-04T23:17:52.975477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.237555Z","title":"Real-time reinforcement learning,","venue":null,"work_id":"2436a7f0-b91c-425f-b709-03bdd8bccd76","year":2019},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.981423Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:29798aae95b51ad178468c59e3683400d520b97cea84c7d9fee02a714796e215","observation_id":"a6f0662c-5921-48e1-939e-f5f0d224bcf5","resolution":{"observed_at":"2026-08-04T23:17:53.347779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.06089","last_updated":"2020-04-25T21:19:45Z","snapshot_observed_at":"2026-08-18T14:21:55.167854Z","submitted_at":"2020-04-13T17:49:29Z","title":"Thinking While Moving: Deep Reinforcement Learning with Concurrent Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.06089","snapshot_observed_at":"2026-08-04T23:17:52.985074Z","title":"Thinking while moving: Deep reinforcement learning with concurrent control,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.985074Z"},"links":{"cited_paper":"/paper/2004.06089","citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:000311baa377f9e5b047f287cf7f09d9ca614d8f6cadcffb5b26d99664980664","observation_id":"9765e955-04fd-46fc-b5c1-b2eec546fc1c","resolution":{"observed_at":"2026-08-04T23:17:52.985074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:53.111842Z","title":"Asynchronous reinforcement learning for real-time control of physical robots,","venue":null,"work_id":"4c35a637-c6de-4c86-aa4d-db158691fcbf","year":2022},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.989752Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:d88db4d1ed96edb47fb93997a7878a8e1d561b62608c8ef50ae615b96255c6d5","observation_id":"69c94fc2-3f69-4c1a-996f-3e05f072397d","resolution":{"observed_at":"2026-08-04T23:17:53.161264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14355","last_updated":"2024-12-18T21:43:40Z","snapshot_observed_at":"2026-08-16T19:55:46.427257Z","submitted_at":"2024-12-18T21:43:40Z","title":"Enabling Realtime Reinforcement Learning at Scale with Staggered Asynchronous Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14355","snapshot_observed_at":"2026-08-04T23:17:52.993979Z","title":"Enabling realtime reinforcement learning at scale with staggered asynchronous inference,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.993979Z"},"links":{"cited_paper":"/paper/2412.14355","citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:bba64e964b860ccc63754a546c020ee5fb82a1fb452fb881e7c539207c22a229","observation_id":"7a2b46ba-fbf4-420c-bf80-95161b1c80c2","resolution":{"observed_at":"2026-08-04T23:17:52.993979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:17:52.997124Z","title":"Addressing function approxi- mation error in actor-critic methods,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T23:17:52.997124Z"},"links":{"citing_paper":"/paper/2509.06714"},"observation_digest":"sha256:95e0699400aa1599a37205e8caeb08db07354864323e336351210317671fb354","observation_id":"c4b97198-a9d4-4c58-863e-6e31743cf741","resolution":{"observed_at":"2026-08-04T23:17:52.997124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.06714","last_updated":"2025-09-08T14:09:33Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T16:36:51.404187Z","submitted_at":"2025-09-08T14:09:33Z","title":"RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 24 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2509.06714."}