{"as_of":"2026-08-20T23:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:066caaf3d8b5366e4766e8e064c53506132bb81ee503b6e19d721847e66f233e","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:22:55.700213Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09138/citation-record","integrity":"/paper/2608.09138/integrity","json":"/paper/2608.09138/citation-record.json","paper":"/paper/2608.09138"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2304.13705","last_updated":"2023-04-23T19:10:53Z","snapshot_observed_at":"2026-08-03T01:22:01.078078Z","submitted_at":"2023-04-23T19:10:53Z","title":"Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13705","snapshot_observed_at":"2026-08-14T04:22:55.548447Z","title":"Learn- ing fine-grained bimanual manipulation with low-cost hardware,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.548447Z"},"links":{"cited_paper":"/paper/2304.13705","citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:d7fcdee6514606c7075171262aa96ab4d8bbfafd8c069c9ced84385b325f728b","observation_id":"f32deceb-dae3-42db-b0ea-817fda4a79c6","resolution":{"observed_at":"2026-08-14T04:22:55.548447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.554345Z","title":"Alvinn: An autonomous land ve- hicle in a neural network,","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.554345Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:0fe0ac4c496606bf30e42777df35003f740370c77d04f3eb45e1b371bedeeb17","observation_id":"3bda84c4-1899-4867-a854-6c8f027a7cb7","resolution":{"observed_at":"2026-08-14T04:22:55.554345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.558249Z","title":"Is imitation learning the route to humanoid robots?","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.558249Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:4785ccb09a50768e072d0d439606e31c7b176df3a8c30b7fd5a4b4ef7e4e98ee","observation_id":"0ae4ce74-c564-41fb-987e-ffb79098112c","resolution":{"observed_at":"2026-08-14T04:22:55.558249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.562411Z","title":"The dlr bimanual haptic device with optimized workspace,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.562411Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:aca1f7bebd9f5255cc81466b58146debe074753d2a7c0da0a5d8c1aad9087b34","observation_id":"4845da9e-db0f-42fc-acee-3f371cd3d515","resolution":{"observed_at":"2026-08-14T04:22:55.562411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.566305Z","title":"A low cost modular actuator for dynamic robots,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.566305Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:fb083bff102250aa5db0bb939cd1d3ad7c17166e1ad38507bfdada52a2c0b83a","observation_id":"181028f8-d65f-41c3-aac5-825a143d51a4","resolution":{"observed_at":"2026-08-14T04:22:55.566305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.570363Z","title":"Nimbro avatar: Interactive immersive telepresence with force-feedback telemanipulation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.570363Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:183230974b0c39e0d096e33bec9e5e3b9f9962d0f4fda01a0e6074b0d91079e2","observation_id":"be838120-fae1-4598-9032-087fbfe690b5","resolution":{"observed_at":"2026-08-14T04:22:55.570363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.575430Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.575430Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:43975cb39105f2c8be4c9d280c73579dc1c523dfa8fc28a7ac13768193a48bcb","observation_id":"923afce6-70b5-483b-b0ff-c23316fd896d","resolution":{"observed_at":"2026-08-14T04:22:55.575430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-08-19T04:42:40.974785Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-14T04:22:55.579049Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.579049Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:12441c1b697071d0874ffd6d9d5dbe185abdf500bba0077419abe45facf9a30c","observation_id":"bdb5d2a0-7c24-4fee-8054-676f6564fc6d","resolution":{"observed_at":"2026-08-14T04:22:55.579049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04137","last_updated":"2024-03-14T04:36:31Z","snapshot_observed_at":"2026-08-08T17:26:38.829859Z","submitted_at":"2023-03-07T18:50:03Z","title":"Diffusion Policy: Visuomotor Policy Learning via Action Diffusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04137","snapshot_observed_at":"2026-08-14T04:22:55.582990Z","title":"Diffusion policy: Visuomotor pol- icy learning via action diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.582990Z"},"links":{"cited_paper":"/paper/2303.04137","citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:b257f3bbdad2fdee9ae402e2b1e6adc7a981fa0f375121cbcfa92bb4d58e2891","observation_id":"f75968bd-c54b-4a06-8b9a-a0967e30f948","resolution":{"observed_at":"2026-08-14T04:22:55.582990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.00137","last_updated":"2021-09-01T01:20:25Z","snapshot_observed_at":"2026-08-16T23:38:10.906144Z","submitted_at":"2021-09-01T01:20:25Z","title":"Implicit Behavioral Cloning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.00137","snapshot_observed_at":"2026-08-14T04:22:55.586994Z","title":"Implicit behavioral cloning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.586994Z"},"links":{"cited_paper":"/paper/2109.00137","citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:bd17d8b997b5f9f3c486ade5131db9909a536497ba7d3b7d9804d05bac471d46","observation_id":"dd037313-7bed-4859-9c1c-3a3728db3300","resolution":{"observed_at":"2026-08-14T04:22:55.586994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.591016Z","title":"Bc-z: Zero-shot task generalization with robotic imitation learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.591016Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:dcc2dc3688c7ba6a5d9ccc9f22369a25129a91cfc1d14c36a2d92a1183cf7736","observation_id":"4819dbdf-b972-40a4-aa30-df7071c58951","resolution":{"observed_at":"2026-08-14T04:22:55.591016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.595403Z","title":"Should i run offline reinforcement learning or behavioral cloning?","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.595403Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:03cd721d83bcbfb5b5af5334ccf569e08d08ef787773e8793abb6c777afd2dde","observation_id":"9b14d44a-0762-463e-8791-75232f2e624e","resolution":{"observed_at":"2026-08-14T04:22:55.595403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.599162Z","title":"Q-learning,","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.599162Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:2f2e765600f9ce2e9420bfd38acc309eaeddd1e09b351a928e36e27b8de524cb","observation_id":"c4e25021-4194-41a2-b5d4-be7ee02a929c","resolution":{"observed_at":"2026-08-14T04:22:55.599162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.602925Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.602925Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:54f7bdea770ee7dd14cc8eacaa72a1a9cf8bf22e1373c86a0a5facfec5ac39de","observation_id":"400c0f6d-8e17-4701-9536-71233a7268d2","resolution":{"observed_at":"2026-08-14T04:22:55.602925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.606675Z","title":"Policy gradient methods for reinforcement learning with function approximation,","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.606675Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:384dafbe12f45df567f45fcd3656dbf7d7bca62abc2d0da0cfffb8051ed0ccbb","observation_id":"cd42cb95-2f36-4525-b783-e01b87e6001b","resolution":{"observed_at":"2026-08-14T04:22:55.606675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.610427Z","title":"Actor-critic algo- rithms,","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.610427Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:9d26fc18b8ccf3bd1c0878c282ed9abc139581157297278279d3a4ff4f6318a1","observation_id":"2b101cfe-f947-4a1c-a9ab-7960454721f6","resolution":{"observed_at":"2026-08-14T04:22:55.610427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-08-16T22:06:26.835611Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-14T04:22:55.614104Z","title":"Continuous control with deep reinforcement learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.614104Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:5e54a56838ac0831c2ebac5992eb7258041206bbad6db2cbebc3969e41764758","observation_id":"141311c1-189d-4163-aaab-f2c497978507","resolution":{"observed_at":"2026-08-14T04:22:55.614104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.618072Z","title":"Deep reinforcement learning for robotic manipulation with asynchronous off-policy updates,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.618072Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:69c6e5af0478bac3ff10bdc89c3986c401a84d1460e1628c6e294471b7b538e8","observation_id":"d350b227-c2ad-43d9-812b-66a4fe976aee","resolution":{"observed_at":"2026-08-14T04:22:55.618072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.621690Z","title":"Learning dexterous in-hand manipulation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.621690Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:18ff62fb73f55fa6d04bb39a9ecda07ef0351432782568ee254c6a504bd3e667","observation_id":"30924381-8641-4304-a10a-2fe84585cea0","resolution":{"observed_at":"2026-08-14T04:22:55.621690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.625559Z","title":"How to train your robot with deep reinforcement learning: Lessons we have learned,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.625559Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:7d96110f27295632faacbe70480859347a286567db1907056110c74e5c8748a2","observation_id":"9136e27b-77d6-47b7-8020-337c780ae643","resolution":{"observed_at":"2026-08-14T04:22:55.625559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.629127Z","title":"Never stop learning: The effectiveness of fine-tuning in robotic reinforcement learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.629127Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:76c6a434542eb0995ed62d122059db4ebf4bb28da8fa7a54e1f3b44a3b441be4","observation_id":"380fbe95-2ba3-4aaa-9cff-6820c9559a95","resolution":{"observed_at":"2026-08-14T04:22:55.629127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.632831Z","title":"Robot fine-tuning made easy: Pre-training rewards and policies for autonomous real-world rein- forcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.632831Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:3493ac3b764b5fe6502c7bc71641cf6fdf94999c04608bf47bcb34ddfbfeff00","observation_id":"40f597be-7d24-443f-8c2c-dd32cb01e8e7","resolution":{"observed_at":"2026-08-14T04:22:55.632831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.636543Z","title":"Learning to play table tennis from scratch using muscular robots,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.636543Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:a7ec7cd8f155d7f28ee17e7613e88f990e60e01890f249bd3f171e03c4e6174c","observation_id":"581add2b-f3c0-4348-85d8-490464014a48","resolution":{"observed_at":"2026-08-14T04:22:55.636543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.639913Z","title":"Achieving human level competitive robot table tennis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.639913Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:1fc5f10a9e7822c17bd297bce9a1a3ab91dc594095b39cadab4b3fda7dfbbd16","observation_id":"9861f1b7-e9f4-4f27-965a-29f6e19a9686","resolution":{"observed_at":"2026-08-14T04:22:55.639913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.643750Z","title":"Knotting manipulation of a flexible rope using a high-speed multifingered hand and high-speed visual and tactile sensory feedback,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.643750Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:306311d5a137ef2095e30528fcbe6084a0a662c88dc249c6c3b70cf8530d1510","observation_id":"b19a6da8-a37d-4abe-a27b-8d97052a23c0","resolution":{"observed_at":"2026-08-14T04:22:55.643750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.647588Z","title":"Motion planning for dynamic knotting of a flexible rope with a high-speed robot arm,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.647588Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:53806f94d188f871aeabfe20e001fafaba416b3c38ddafe76dcdbc61ce3333ff","observation_id":"fd837fd1-75ff-40d6-9861-cdddd6d42335","resolution":{"observed_at":"2026-08-14T04:22:55.647588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.651438Z","title":"Dynamic high-speed knotting of a rope by a manipulator,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.651438Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:93fd8a8f2cfd89acccd34d1e99615b11449c4dcb4360650b07600ebdde0f36fe","observation_id":"02a868d3-f1b2-4811-9786-42f37b01fd36","resolution":{"observed_at":"2026-08-14T04:22:55.651438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.04840","last_updated":"2024-05-02T00:26:52Z","snapshot_observed_at":"2026-08-16T19:07:00.013448Z","submitted_at":"2020-11-10T00:19:50Z","title":"Robots of the Lost Arc: Self-Supervised Learning to Dynamically Manipulate Fixed-Endpoint Cables","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.04840","snapshot_observed_at":"2026-08-14T04:22:55.655336Z","title":"Robots of the lost arc: Learning to dynam- ically manipulate fixed-endpoint ropes and cables,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.655336Z"},"links":{"cited_paper":"/paper/2011.04840","citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:0ff1d12c40ad9c7a030c39f0a16bb7c8670bb2d189481960ff7356171cf7721e","observation_id":"24e8b64b-fbc0-461d-a834-ab34166a1d40","resolution":{"observed_at":"2026-08-14T04:22:55.655336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.659394Z","title":"Tossingbot: Learning to throw arbitrary objects with residual physics,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.659394Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:eaa4bc1cf0f7e2e46ce85128d781f73689a85a31a14ed5312ef8d2171fa6c4a6","observation_id":"35ade4ab-7c5b-47b8-9145-48ba0b8fe03e","resolution":{"observed_at":"2026-08-14T04:22:55.659394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.663036Z","title":"Flingbot: The unreasonable effec- tiveness of dynamic manipulation for cloth unfolding,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.663036Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:9bd6035ba0ebd4465eb8b7d64ce8b6dbf94044872fc166a333420959273d255d","observation_id":"143e25eb-cc38-4383-a954-a66110e3385b","resolution":{"observed_at":"2026-08-14T04:22:55.663036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.666473Z","title":"Par4: Very high speed parallel robot for pick-and-place,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.666473Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:d2480a7e183bdee6f0cd340ac411b2c212c08d5d43140d7d9e94b0cbfea9e9dc","observation_id":"9a7ace48-4f88-46d9-9720-f8a6dcf6e731","resolution":{"observed_at":"2026-08-14T04:22:55.666473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.670034Z","title":"Toward fast and optimal robotic pick-and-place on a moving con- veyor,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.670034Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:847ac46e8a0ff245b6e582d188afa28435ea68d255ef3295708c4551e32d90f3","observation_id":"2e6ec1e4-1565-4634-8564-72004f6e4dc0","resolution":{"observed_at":"2026-08-14T04:22:55.670034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.673414Z","title":"Critically fast pick-and- place with suction cups,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.673414Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:5e4b72f5ed11a28b2158ea6c698143a6e909b36f35d7578d217ee1dd8f167c35","observation_id":"f3b25567-91e3-4a3b-8331-2a77d30bf087","resolution":{"observed_at":"2026-08-14T04:22:55.673414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.676939Z","title":"Rainbow: Combining improvements in deep reinforcement learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.676939Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:7627c6ba28b089d40dcac50527df20053161a528aec01be7c7bb0d2da1e11df1","observation_id":"fcee40a1-f6f1-45f9-90c9-a2e29ec906ed","resolution":{"observed_at":"2026-08-14T04:22:55.676939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-14T04:22:55.680695Z","title":"Auto-encoding varia- tional bayes,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.680695Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:20bf3ce571fbbfd3c3845850b28d7d664b2bbd69d3a6629efdddad8c2d93889f","observation_id":"fd78f773-2e4e-4eb2-9fcf-ee968042003f","resolution":{"observed_at":"2026-08-14T04:22:55.680695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.684868Z","title":"Learning structured output representation using deep conditional genera- tive models,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.684868Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:064251e80752220801f2f82690aef7c9c6918c4ae6123a86ce6f570b218c0185","observation_id":"a1c43d05-a67c-4755-a7a9-a940f6160235","resolution":{"observed_at":"2026-08-14T04:22:55.684868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.688665Z","title":"Deep reinforce- ment learning with double q-learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.688665Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:eeb6f5e6035eaf59150d2f439e8dd524f859de5de5559671e766bb6acbd050b1","observation_id":"5fa93002-ca77-4194-981f-9eb7855e514d","resolution":{"observed_at":"2026-08-14T04:22:55.688665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.05952","last_updated":"2016-02-25T17:55:31Z","snapshot_observed_at":"2026-08-15T17:33:32.559096Z","submitted_at":"2015-11-18T20:54:44Z","title":"Prioritized Experience Replay","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.05952","snapshot_observed_at":"2026-08-14T04:22:55.692376Z","title":"Prioritized experience replay,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.692376Z"},"links":{"cited_paper":"/paper/1511.05952","citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:b950759a4beee3f395ff9e79b7f4c5c7d3ecf9ca4cf2edd14e9885c01062b83d","observation_id":"fc61cf26-22eb-40bf-8e1e-afc72e10fb7c","resolution":{"observed_at":"2026-08-14T04:22:55.692376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.696296Z","title":"Dueling network architectures for deep reinforcement learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.696296Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:c80c5e20aecb70855a1dba2348ffc249e6aed39482c38e090d3c86373fcf1e14","observation_id":"1bf4ba4b-b11e-4a4b-ac4d-f63a7fb66272","resolution":{"observed_at":"2026-08-14T04:22:55.696296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:22:55.700213Z","title":"A dis- tributional perspective on reinforcement learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T04:22:55.700213Z"},"links":{"citing_paper":"/paper/2608.09138"},"observation_digest":"sha256:a36915f5868ae0065960dd90f3f29f36e0c923442af7452e73084a91aa8ccc5e","observation_id":"5de7b227-14c4-49f6-825e-7b106d4e9983","resolution":{"observed_at":"2026-08-14T04:22:55.700213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.09138","last_updated":"2026-08-11T17:14:09Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-16T19:26:26.351828Z","submitted_at":"2026-08-10T05:31:41Z","title":"SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":40,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2608.09138."}