{"as_of":"2026-08-15T02:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9121bb488a1bb27e922adce4cdee098e5ee2c26abf2c538171ec081c25c29a38","coverage":[{"denominator":135,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-11T17:23:24.255829Z","state":"measured"},{"denominator":200,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":200,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":365,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T21:10:46.223569Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":101,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2311.01378","last_updated":"2024-02-05T03:46:00Z","snapshot_observed_at":"2026-08-13T00:43:50.403870Z","submitted_at":"2023-11-02T16:34:33Z","title":"Vision-Language Foundation Models as Effective Robot Imitators","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T21:44:27.562453Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2311.01378"},"observation_digest":"sha256:6e1e8ee6f956fd78599f39662313bd0318f5cd21e84d1afa2b22e0f722ae6ba1","observation_id":"df1f8824-7038-47c7-af60-9fcdbb989026","resolution":{"observed_at":"2026-05-16T21:44:27.610048Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2401.00025","last_updated":"2024-07-12T12:51:00Z","snapshot_observed_at":"2026-07-06T17:09:59.848387Z","submitted_at":"2023-12-28T23:34:43Z","title":"Any-point Trajectory Modeling for Policy Learning","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T23:32:50.916085Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2401.00025"},"observation_digest":"sha256:3edcc57759850d2a0b626889d55f58d2a5d8fa503a8c1d0de5c60095ef330c1b","observation_id":"7a9b7694-23f1-4ba4-ba52-53b365426d89","resolution":{"observed_at":"2026-05-16T23:32:50.969577Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2401.02117","last_updated":"2024-01-04T07:55:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T07:55:53Z","title":"Mobile ALOHA: Learning Bimanual Mobile Manipulation with Low-Cost Whole-Body Teleoperation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-14T22:02:55.240949Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2401.02117"},"observation_digest":"sha256:1325dc61a78e5e2b56d5e51ab5d0681de34b7169247a2124c45f8f5dc3716822","observation_id":"38c2da6b-7c81-4afa-ac58-6e51c1673d43","resolution":{"observed_at":"2026-05-14T22:02:55.323436Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2401.03568","last_updated":"2024-01-25T21:20:27Z","snapshot_observed_at":"2026-08-12T12:11:22.336410Z","submitted_at":"2024-01-07T19:11:18Z","title":"Agent AI: Surveying the Horizons of Multimodal Interaction","version":2},"reference_index":160,"source":"arxiv_source","source_observed_at":"2026-05-18T14:25:58.876978Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2401.03568"},"observation_digest":"sha256:65bfc42617ea3ccdb70f5af7381b5ba67015b44e05647ff371a7a180fee0ce8b","observation_id":"6c63a1a5-b154-45a3-a299-db3e9eef1f1c","resolution":{"observed_at":"2026-05-18T14:25:59.523039Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2402.10885","last_updated":"2024-07-25T14:30:22Z","snapshot_observed_at":"2026-07-06T17:31:17.058043Z","submitted_at":"2024-02-16T18:43:02Z","title":"3D Diffuser Actor: Policy Diffusion with 3D Scene Representations","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-17T22:00:04.812281Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2402.10885"},"observation_digest":"sha256:d584331b315a7cd36a7f794fe3abfd77db7d309016b8c6207fed15122493ed1a","observation_id":"410b1e20-189b-4e54-ac00-f7badf3d0996","resolution":{"observed_at":"2026-05-17T22:00:04.867045Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2402.12289","last_updated":"2024-06-25T17:55:35Z","snapshot_observed_at":"2026-08-13T08:07:31.942031Z","submitted_at":"2024-02-19T17:04:04Z","title":"DriveVLM: The Convergence of Autonomous Driving and Large Vision-Language Models","version":5},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-12T19:22:35.305220Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2402.12289"},"observation_digest":"sha256:86771c919fa8b368ae3df49eb66ecb2da5d05c889cf8ba61c860ca7e93ad9a6e","observation_id":"bf16bbea-455e-49d1-b042-1da2404b4aaa","resolution":{"observed_at":"2026-05-12T19:22:35.436751Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2403.01823","last_updated":"2024-06-01T01:54:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-04T08:16:11Z","title":"RT-H: Action Hierarchies Using Language","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-17T06:53:27.642020Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2403.01823"},"observation_digest":"sha256:132f64296e0055807b0371cf5a05cd4a205647dcd9f277306844ea1066c883aa","observation_id":"36fd32a2-1761-4bd6-b365-4f8e9ce7cb7b","resolution":{"observed_at":"2026-05-17T06:53:27.744157Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2403.09631","last_updated":"2024-03-14T17:58:41Z","snapshot_observed_at":"2026-08-13T15:09:51.205767Z","submitted_at":"2024-03-14T17:58:41Z","title":"3D-VLA: A 3D Vision-Language-Action Generative World Model","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-13T18:18:27.211034Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2403.09631"},"observation_digest":"sha256:22054a1fcb95b545308d2f39844e6acba856bc41590b5867f0609eef117c2293","observation_id":"13af462d-d4de-422b-95f2-4a6e7a6c5680","resolution":{"observed_at":"2026-05-13T18:18:27.250764Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2403.12945","last_updated":"2025-04-22T17:57:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-19T17:48:38Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-11T05:51:18.508352Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2403.12945"},"observation_digest":"sha256:ce992070f0939d11924a897fbf5ccb2e72a73658ee9be6b316a9f5e1219028ad","observation_id":"a58eb922-c39e-4767-b787-035180bb3926","resolution":{"observed_at":"2026-05-11T17:23:25.503833Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2404.12377","last_updated":"2024-04-18T17:58:03Z","snapshot_observed_at":"2026-08-12T22:44:50.325579Z","submitted_at":"2024-04-18T17:58:03Z","title":"RoboDreamer: Learning Compositional World Models for Robot Imagination","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-15T20:47:30.225116Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2404.12377"},"observation_digest":"sha256:2f36760151704897420b840de9b26436a0b79a0d5eb871595868dd8c159dc92e","observation_id":"0da8ba8a-1b3d-454a-ad4c-8e3c4669f502","resolution":{"observed_at":"2026-05-15T20:47:30.300105Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2405.05941","last_updated":"2024-05-09T17:30:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-09T17:30:16Z","title":"Evaluating Real-World Robot Manipulation Policies in Simulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T11:06:19.481801Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2405.05941"},"observation_digest":"sha256:9e90471ad023b6d6247ba39432ff46630ccf007410b771f674f298fb6a5b0bc1","observation_id":"fde464ac-ad2c-4f90-bd53-1dd05f0aeacd","resolution":{"observed_at":"2026-05-13T11:06:19.537914Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-08-14T08:22:11.295012Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-11T00:26:15.163358Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2405.12213"},"observation_digest":"sha256:f7dd7bf0621eb2c6e5e94e9511942605a444b78db75a2023e4900279e43c64f7","observation_id":"6e36321b-1dd9-47ee-bd00-5b5fd0730da1","resolution":{"observed_at":"2026-05-11T17:23:25.503833Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2405.14093","last_updated":"2026-05-01T01:50:44Z","snapshot_observed_at":"2026-08-04T06:47:25.827167Z","submitted_at":"2024-05-23T01:43:54Z","title":"A Survey on Vision-Language-Action Models for Embodied AI","version":8},"reference_index":117,"source":"pdf_text","source_observed_at":"2026-05-24T01:25:10.150459Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2405.14093"},"observation_digest":"sha256:5d918a8492166024c31f6642fd26ff9e7a43e669857d502747614af34342ba62","observation_id":"1ce2c515-9b89-4f6c-9211-7d32250f3503","resolution":{"observed_at":"2026-05-24T01:25:54.437489Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2406.02523","last_updated":"2024-06-04T17:41:31Z","snapshot_observed_at":"2026-08-14T15:33:08.751931Z","submitted_at":"2024-06-04T17:41:31Z","title":"RoboCasa: Large-Scale Simulation of Everyday Tasks for Generalist Robots","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T23:46:30.198761Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2406.02523"},"observation_digest":"sha256:543b77afe6677d52a370783c0ca88e49166e6f27e13e73756f30d3a30278541e","observation_id":"75e90200-4f52-45b5-a3eb-29099b7f159b","resolution":{"observed_at":"2026-05-12T23:46:30.243114Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T14:46:35.942338Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2406.09246"},"observation_digest":"sha256:c84cb1438ed38fa134a4e969a22b6b616351ce4f39fec72a96f3ed55f2923c44","observation_id":"db7afa79-75cb-4bea-8ad6-55086dbebe21","resolution":{"observed_at":"2026-05-11T17:23:25.503833Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2408.10188","last_updated":"2024-12-13T02:32:06Z","snapshot_observed_at":"2026-08-05T14:57:53.592979Z","submitted_at":"2024-08-19T17:48:08Z","title":"LongVILA: Scaling Long-Context Visual Language Models for Long Videos","version":6},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-17T03:51:25.396887Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2408.10188"},"observation_digest":"sha256:8de494c1c5838166e6817f364a452572bb78c51f89fd65967a6265d24ba8c74d","observation_id":"5154cb12-06db-403b-9760-a7a14a26b185","resolution":{"observed_at":"2026-05-17T03:51:25.542171Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2409.12514","last_updated":"2025-05-13T11:02:20Z","snapshot_observed_at":"2026-08-07T15:12:56.367961Z","submitted_at":"2024-09-19T07:10:18Z","title":"TinyVLA: Towards Fast, Data-Efficient Vision-Language-Action Models for Robotic Manipulation","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-17T16:12:25.980853Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2409.12514"},"observation_digest":"sha256:5c89c44f6b11dfff34b4010057b82a15767124205298afab8e772b2e80923b9c","observation_id":"f15715b2-c717-4afd-b8a4-bdd4ef8a5ea5","resolution":{"observed_at":"2026-05-17T16:12:26.104367Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2410.06158","last_updated":"2024-10-08T16:00:47Z","snapshot_observed_at":"2026-08-12T23:18:51.506083Z","submitted_at":"2024-10-08T16:00:47Z","title":"GR-2: A Generative Video-Language-Action Model with Web-Scale Knowledge for Robot Manipulation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-12T01:09:33.761708Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2410.06158"},"observation_digest":"sha256:7d32a54a95e82becff35666dbca21fcd8c284cf782e522af35dd3cc875f37911","observation_id":"48865a7a-ac69-4281-9795-6bd3731ce0a6","resolution":{"observed_at":"2026-05-12T01:09:34.000529Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2410.14022","last_updated":"2026-05-10T15:05:10Z","snapshot_observed_at":"2026-08-04T21:08:09.728916Z","submitted_at":"2024-10-17T20:49:45Z","title":"Language Conditioned Multi-Finger Dexterous Manipulation Enabled by Physical Compliance and Switching of Controllers","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-23T19:06:58.600946Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2410.14022"},"observation_digest":"sha256:420a78e1c581c5a4c7164456a98f05455d586e1652eb036169c175526d71cfa7","observation_id":"63b413a3-a9e4-4c2a-bc3b-27d615c893fd","resolution":{"observed_at":"2026-05-23T19:08:21.041640Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T12:38:24.425784Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2410.24164"},"observation_digest":"sha256:f7671b55f9bcf59f5e9a67da1d69569ad6e45878d451ce714013fcf90aea90f3","observation_id":"fe746920-eb9e-419c-87ff-55614ada75bb","resolution":{"observed_at":"2026-05-11T17:23:25.503833Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-12T21:10:46.223569Z","title":"Padalkar, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09052","last_updated":"2024-11-13T22:15:31Z","snapshot_observed_at":"2026-08-14T14:11:44.320954Z","submitted_at":"2024-11-13T22:15:31Z","title":"ClevrSkills: Compositional Language and Visual Reasoning in Robotics","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T21:10:46.223569Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2411.09052"},"observation_digest":"sha256:fb8c4bda388ed5ba375c42f2d32dcb063df548262a557e901d97693a484b7e0f","observation_id":"35813a6d-6e75-457b-9630-ffacb57ebb92","resolution":{"observed_at":"2026-08-12T21:10:46.223569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-12T21:04:21.695202Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09153","last_updated":"2024-11-14T03:13:26Z","snapshot_observed_at":"2026-08-12T20:55:51.448392Z","submitted_at":"2024-11-14T03:13:26Z","title":"VidMan: Exploiting Implicit Dynamics from Video Diffusion Model for Effective Robot Manipulation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T21:04:21.695202Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2411.09153"},"observation_digest":"sha256:9c0bd1cd7df5cee5afa219c14d3f09fa8d1e252e11422035bd0c544e93f6c485","observation_id":"2c1d0f32-5c9c-4a24-8828-89cbb6923da0","resolution":{"observed_at":"2026-08-12T21:04:21.695202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-12T17:49:30.691544Z","title":"Open x- embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.12286","last_updated":"2025-05-01T09:13:09Z","snapshot_observed_at":"2026-08-14T19:57:20.036786Z","submitted_at":"2024-11-19T07:12:48Z","title":"GLOVER: Generalizable Open-Vocabulary Affordance Reasoning for Task-Oriented Grasping","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T17:49:30.691544Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2411.12286"},"observation_digest":"sha256:4956a47a889dcf5b7a8011891d1e2c363d9c7429e779134a76859b3964052562","observation_id":"a93692ce-aaff-4d3d-ba58-569b088c59bf","resolution":{"observed_at":"2026-08-12T17:49:30.691544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-12T17:06:34.125878Z","title":"Padalkar, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12960","last_updated":"2024-11-20T01:27:56Z","snapshot_observed_at":"2026-08-14T05:03:50.107435Z","submitted_at":"2024-11-20T01:27:56Z","title":"I Can Tell What I am Doing: Toward Real-World Natural Language Grounding of Robot Experiences","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T17:06:34.125878Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2411.12960"},"observation_digest":"sha256:5382a0bbb1bc589c863bc7d59f1f78e07eadbfbe133d627e6f533f1489f46ade","observation_id":"42ef1f58-a750-4cf8-9fae-ae63d44765ae","resolution":{"observed_at":"2026-08-12T17:06:34.125878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-12T16:19:11.019141Z","title":"Padalkar, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.13677","last_updated":"2024-11-20T19:53:35Z","snapshot_observed_at":"2026-08-12T19:04:06.850143Z","submitted_at":"2024-11-20T19:53:35Z","title":"Bimanual Dexterity for Complex Tasks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T16:19:11.019141Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2411.13677"},"observation_digest":"sha256:f9bb347362199647a857d40a64c3d3c21821fbc949a3f6d71e57ea4f51d4f42e","observation_id":"9b513ecd-4a11-46c4-bdc7-ca0a40668939","resolution":{"observed_at":"2026-08-12T16:19:11.019141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-12T15:24:14.335219Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.14519","last_updated":"2025-04-01T17:59:17Z","snapshot_observed_at":"2026-08-13T00:41:37.897865Z","submitted_at":"2024-11-21T16:45:43Z","title":"Tra-MoE: Learning Trajectory Prediction Model from Multiple Domains for Adaptive Policy Conditioning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T15:24:14.335219Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2411.14519"},"observation_digest":"sha256:bf9e120c75e51c594fb6f6dc59b4e0db0ffe006c19917c713f38ac1f02f8c27e","observation_id":"b6de5f49-e7f3-4c4e-adda-303f88fefefd","resolution":{"observed_at":"2026-08-12T15:24:14.335219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-12T14:32:58.339109Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15131","last_updated":"2025-03-08T23:37:22Z","snapshot_observed_at":"2026-08-14T18:20:38.660028Z","submitted_at":"2024-11-22T18:56:56Z","title":"WildLMa: Long Horizon Loco-Manipulation in the Wild","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T14:32:58.339109Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2411.15131"},"observation_digest":"sha256:0d6ba3a42937173f0b2ed65044b363ce58fbbeedb1182587fc0ccad030851ed2","observation_id":"bcd16aaa-96b6-4fe2-b074-f69a4abf4eda","resolution":{"observed_at":"2026-08-12T14:32:58.339109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-12T12:58:11.166081Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16627","last_updated":"2025-03-26T02:40:00Z","snapshot_observed_at":"2026-08-14T09:03:13.629438Z","submitted_at":"2024-11-25T18:03:50Z","title":"Inference-Time Policy Steering through Human Interactions","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T12:58:11.166081Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2411.16627"},"observation_digest":"sha256:93da94b471527884357e9fe28ff140a519a48ef73f4a77ca69cb53ae1dd6f16d","observation_id":"29b77cf1-c023-4fa0-b7c9-3777329b74bc","resolution":{"observed_at":"2026-08-12T12:58:11.166081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-12T12:10:40.457894Z","title":"Open x- embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17465","last_updated":"2024-11-26T14:29:47Z","snapshot_observed_at":"2026-08-14T14:50:53.473042Z","submitted_at":"2024-11-26T14:29:47Z","title":"ShowUI: One Vision-Language-Action Model for GUI Visual Agent","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T12:10:40.457894Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2411.17465"},"observation_digest":"sha256:5f259163aa946ad8142a2423ce63c8f47c43adabca0a7561f788b96c8c926191","observation_id":"76ea9d6a-b5ea-472d-b70a-8612b48d9591","resolution":{"observed_at":"2026-08-12T12:10:40.457894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-12T11:06:13.093646Z","title":"Open x-embodiment: Robotic learning datasets and rt-x mod- els","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18623","last_updated":"2024-12-14T18:38:03Z","snapshot_observed_at":"2026-08-12T10:57:30.698813Z","submitted_at":"2024-11-27T18:59:52Z","title":"Lift3D Foundation Policy: Lifting 2D Large-Scale Pretrained Models for Robust 3D Robotic Manipulation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T11:06:13.093646Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2411.18623"},"observation_digest":"sha256:832f22d8eaaa8866cf88bf944b75a1c9d178a347e1c5c83552dd3c2136d9504a","observation_id":"82092fe7-f470-44a2-8dda-b53b11823615","resolution":{"observed_at":"2026-08-12T11:06:13.093646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-12T10:23:15.710143Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.19309","last_updated":"2025-02-04T08:49:11Z","snapshot_observed_at":"2026-08-15T01:47:42.243585Z","submitted_at":"2024-11-28T18:30:10Z","title":"GRAPE: Generalizing Robot Policy via Preference Alignment","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-12T10:23:15.710143Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2411.19309"},"observation_digest":"sha256:11297eeb70ff9582867d20f8f3339e639057ee42bf7e58332641bd45abb230a3","observation_id":"a0cf5428-6973-431a-86c3-f824535bb929","resolution":{"observed_at":"2026-08-12T10:23:15.710143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2411.19650","last_updated":"2024-11-29T12:06:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-29T12:06:03Z","title":"CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-12T07:33:25.188358Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2411.19650"},"observation_digest":"sha256:e9fd98e034811f285d77b05c98e70e27be68459aba831947de0169dfa60e9e63","observation_id":"b6a80201-e81c-4c84-ae3a-a8b2b45b3f0a","resolution":{"observed_at":"2026-05-12T07:33:25.629428Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-12T04:48:34.016217Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.01034","last_updated":"2024-12-02T01:33:49Z","snapshot_observed_at":"2026-08-14T15:17:01.572742Z","submitted_at":"2024-12-02T01:33:49Z","title":"Quantization-Aware Imitation-Learning for Resource-Efficient Robotic Control","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T04:48:34.016217Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.01034"},"observation_digest":"sha256:6f9007a33bf2ff42ed31c5f8635bb90d3109234799218df3fe16c013e8492649","observation_id":"2b3c1139-96b0-49b9-a2e2-0cc0e13fc3ff","resolution":{"observed_at":"2026-08-12T04:48:34.016217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2412.02125","last_updated":"2026-05-01T15:42:42Z","snapshot_observed_at":"2026-08-14T20:28:14.574493Z","submitted_at":"2024-12-03T03:27:48Z","title":"Preference Goal Tuning: Post-Training as Latent Control for Frozen Policies","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-23T08:20:05.898025Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.02125"},"observation_digest":"sha256:36800913eafbcb0f6f5cdbae072d7048812a6165a3f8f59fa1e94d8b84d36c95","observation_id":"0d022d99-66a3-4a04-a043-426f3dedd8d8","resolution":{"observed_at":"2026-05-23T08:22:44.432652Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-11T22:38:32.234754Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03293","last_updated":"2025-06-04T08:30:06Z","snapshot_observed_at":"2026-08-15T01:35:58.775756Z","submitted_at":"2024-12-04T13:11:38Z","title":"Diffusion-VLA: Generalizable and Interpretable Robot Foundation Model via Self-Generated Reasoning","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T22:38:32.234754Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.03293"},"observation_digest":"sha256:f697547adad0cb40e17e6ac2bb20c68551e133a652d2c1dfc58f7fa525d3cca3","observation_id":"41a92526-83c9-4872-8aa4-498af23715c5","resolution":{"observed_at":"2026-08-11T22:38:32.234754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-11T21:39:27.130347Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04244","last_updated":"2025-04-09T10:18:05Z","snapshot_observed_at":"2026-08-14T07:54:33.505335Z","submitted_at":"2024-12-05T15:26:51Z","title":"GigaHands: A Massive Annotated Dataset of Bimanual Hand Activities","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T21:39:27.130347Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.04244"},"observation_digest":"sha256:a51568e740dd9b6757983e4efb394b6fe2b80e9eb7e1df3b4ef15f18696065d2","observation_id":"501492f8-d494-4b30-87e0-c2fdf9abad39","resolution":{"observed_at":"2026-08-11T21:39:27.130347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-11T21:37:57.562382Z","title":"Padalkar, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04273","last_updated":"2024-12-05T15:55:23Z","snapshot_observed_at":"2026-08-11T21:49:55.508827Z","submitted_at":"2024-12-05T15:55:23Z","title":"Reinforcement Learning from Wild Animal Videos","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T21:37:57.562382Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.04273"},"observation_digest":"sha256:2ae195beb320110f177ad6172c44d40b0d011a39f0476bfc482df8bea1c8ead9","observation_id":"ab69c290-8768-4c7f-aae6-6a1caceb376a","resolution":{"observed_at":"2026-08-11T21:37:57.562382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-11T20:25:30.591289Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05789","last_updated":"2024-12-08T02:59:04Z","snapshot_observed_at":"2026-08-13T22:06:37.100311Z","submitted_at":"2024-12-08T02:59:04Z","title":"InfiniteWorld: A Unified Scalable Simulation Framework for General Visual-Language Robot Interaction","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T20:25:30.591289Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.05789"},"observation_digest":"sha256:795cbbdc624e6eb1747b2c9651e69ca40e7cbbbeb61f7985445a32c9f3373f38","observation_id":"e526cd7e-3797-47a8-876a-c1f6ae2b9ec1","resolution":{"observed_at":"2026-08-11T20:25:30.591289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-11T19:22:48.589254Z","title":"Open x- embodiment: Robotic learning datasets and rt-x models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.06784","last_updated":"2024-12-09T18:59:42Z","snapshot_observed_at":"2026-08-14T09:31:52.273196Z","submitted_at":"2024-12-09T18:59:42Z","title":"P3-PO: Prescriptive Point Priors for Visuo-Spatial Generalization of Robot Policies","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T19:22:48.589254Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.06784"},"observation_digest":"sha256:36b4f06260e5c038c3d63950c4092f5883fbafc17214c21eec9b3d2728de7a9d","observation_id":"4e6374f8-a8b9-4957-90f5-0e80e390d85c","resolution":{"observed_at":"2026-08-11T19:22:48.589254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-11T17:55:13.485077Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.08442","last_updated":"2024-12-11T15:06:25Z","snapshot_observed_at":"2026-08-14T20:43:53.624539Z","submitted_at":"2024-12-11T15:06:25Z","title":"From Multimodal LLMs to Generalist Embodied Agents: Methods and Lessons","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T17:55:13.485077Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.08442"},"observation_digest":"sha256:4bedc8c504e5ff3bf2eed53ae65c57aeabeae9dcb271f7511390e7bc50188bd3","observation_id":"2b4b2716-d544-407e-aa64-d9cc7cc513e9","resolution":{"observed_at":"2026-08-11T17:55:13.485077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-11T17:09:58.275906Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09286","last_updated":"2025-05-21T03:15:25Z","snapshot_observed_at":"2026-08-12T22:04:59.210825Z","submitted_at":"2024-12-12T13:56:36Z","title":"Learning Novel Skills from Language-Generated Demonstrations","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T17:09:58.275906Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.09286"},"observation_digest":"sha256:91289f8f27813f81ca546ce66a891973967a328152b6388a20add7448dc46fa8","observation_id":"5f784938-f04f-4733-ae29-775937ec5236","resolution":{"observed_at":"2026-08-11T17:09:58.275906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2412.10345","last_updated":"2025-06-05T21:26:08Z","snapshot_observed_at":"2026-08-12T18:17:40.083518Z","submitted_at":"2024-12-13T18:40:51Z","title":"TraceVLA: Visual Trace Prompting Enhances Spatial-Temporal Awareness for Generalist Robotic Policies","version":3},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-05-15T18:27:22.760982Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.10345"},"observation_digest":"sha256:f6afe88e9a08a79bac76fa2018f88ac58a89e1cf3109aeb751e64c43bc6d25d9","observation_id":"fea5745f-8660-410c-931f-ac8267bae9eb","resolution":{"observed_at":"2026-05-15T18:27:22.873410Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-11T20:41:45.159279Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10410","last_updated":"2024-12-07T05:47:49Z","snapshot_observed_at":"2026-08-14T14:56:42.842054Z","submitted_at":"2024-12-07T05:47:49Z","title":"GROOT-2: Weakly Supervised Multi-Modal Instruction Following Agents","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T20:41:45.159279Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.10410"},"observation_digest":"sha256:5e74e4ffa04491d8dbc7f06862bd714d633e803a02f1a742eb0e2d4b83af0ebe","observation_id":"152c4e05-a8ed-4815-983d-9f22f37cce05","resolution":{"observed_at":"2026-08-11T20:41:45.159279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-11T15:05:13.187367Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11337","last_updated":"2024-12-15T23:05:16Z","snapshot_observed_at":"2026-08-12T16:49:33.525774Z","submitted_at":"2024-12-15T23:05:16Z","title":"Modality-Driven Design for Multi-Step Dexterous Manipulation: Insights from Neuroscience","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T15:05:13.187367Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.11337"},"observation_digest":"sha256:a55b30cbe23ed6cbb12a14935eabefdc445bf93ddf14125e86f7e2ad55f4d454","observation_id":"1f0adb87-3ced-41f3-a9cd-ff28734daedf","resolution":{"observed_at":"2026-08-11T15:05:13.187367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-11T14:29:18.255358Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11974","last_updated":"2024-12-17T14:12:56Z","snapshot_observed_at":"2026-08-12T14:28:34.481864Z","submitted_at":"2024-12-16T16:58:28Z","title":"Emma-X: An Embodied Multimodal Action Model with Grounded Chain of Thought and Look-ahead Spatial Reasoning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T14:29:18.255358Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.11974"},"observation_digest":"sha256:37ac544132cf9ecba9163bbc322e402a49ab567187cb4fec7de7b72acafce502","observation_id":"997481be-b3c8-450c-b094-7504d99584f2","resolution":{"observed_at":"2026-08-11T14:29:18.255358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-11T13:38:41.327698Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12953","last_updated":"2024-12-17T14:34:51Z","snapshot_observed_at":"2026-08-15T00:08:31.858899Z","submitted_at":"2024-12-17T14:34:51Z","title":"Efficient Diffusion Transformer Policies with Mixture of Expert Denoisers for Multitask Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T13:38:41.327698Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.12953"},"observation_digest":"sha256:4939bd6f6387f4c907416388cafd169fb44e57551e3a909a6f15474bfeaccd9c","observation_id":"2fa416a8-ca4a-4ea5-89ae-0f7b0dc28901","resolution":{"observed_at":"2026-08-11T13:38:41.327698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2412.14058","last_updated":"2026-02-13T02:05:15Z","snapshot_observed_at":"2026-08-05T18:48:10.679925Z","submitted_at":"2024-12-18T17:07:20Z","title":"What Matters in Building Vision-Language-Action Models for Generalist Robots","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-17T21:37:50.617813Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.14058"},"observation_digest":"sha256:4d69c59c529dff401c57e5caf5ab28fb61be9bb14397e2ded87dddda0e5da872","observation_id":"cc30b2aa-16b7-48f4-800c-82aa1ba557b4","resolution":{"observed_at":"2026-05-17T21:37:50.763828Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2412.14171","last_updated":"2025-07-02T21:00:36Z","snapshot_observed_at":"2026-08-14T22:29:28.847917Z","submitted_at":"2024-12-18T18:59:54Z","title":"Thinking in Space: How Multimodal Large Language Models See, Remember, and Recall Spaces","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-22T09:27:43.919941Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.14171"},"observation_digest":"sha256:21dc28c8ba93f22fe0fb695535f51a5e604bce83303deb7874ed0ac8b47818b5","observation_id":"c9f34e99-39b6-46e6-9bcc-40029f3bf901","resolution":{"observed_at":"2026-05-22T09:27:44.182209Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-11T12:20:27.948017Z","title":"O’Neill, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14401","last_updated":"2025-05-23T21:41:56Z","snapshot_observed_at":"2026-08-14T14:41:53.384453Z","submitted_at":"2024-12-18T23:15:41Z","title":"The One RING: a Robotic Indoor Navigation Generalist","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T12:20:27.948017Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.14401"},"observation_digest":"sha256:ca67f6014d63a9ef7fdda40e18ada2a565d49e74037847ed262341022943ef3d","observation_id":"bc600f20-455e-4841-be12-92d13cec9fff","resolution":{"observed_at":"2026-08-11T12:20:27.948017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2412.14803","last_updated":"2025-05-04T04:28:53Z","snapshot_observed_at":"2026-08-13T21:27:22.538668Z","submitted_at":"2024-12-19T12:48:40Z","title":"Video Prediction Policy: A Generalist Robot Policy with Predictive Visual Representations","version":2},"reference_index":116,"source":"arxiv_source","source_observed_at":"2026-05-12T18:38:11.110166Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.14803"},"observation_digest":"sha256:45563a2a9d186c733b38ef3744ec992c999256632934bd095643b10443328d71","observation_id":"b7efb935-7144-41c1-807e-96e4eacd5bfc","resolution":{"observed_at":"2026-05-12T18:38:11.276079Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-11T11:37:44.783166Z","title":"Open x- embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15182","last_updated":"2025-08-18T16:14:04Z","snapshot_observed_at":"2026-08-11T11:31:32.953111Z","submitted_at":"2024-12-19T18:54:06Z","title":"STRAP: Robot Sub-Trajectory Retrieval for Augmented Policy Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T11:37:44.783166Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.15182"},"observation_digest":"sha256:7b0d6ccde0bcc59be8e7afb02d42692f252b288ec5e7d4d785e0ad13b7d29371","observation_id":"98e1501b-c102-4b5e-a878-7d955b09e454","resolution":{"observed_at":"2026-08-11T11:37:44.783166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-11T05:00:46.769815Z","title":"Open x- embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-14T07:19:35.317591Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T05:00:46.769815Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.18194"},"observation_digest":"sha256:ca96c1225d7385d5e776e5d537b9015506ec50742df1cf875b23f12c5bfbc561","observation_id":"91b7d84b-6db7-4c21-ab4e-0250096fe101","resolution":{"observed_at":"2026-08-11T05:00:46.769815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-10T23:26:37.435542Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.20451","last_updated":"2025-07-31T14:36:30Z","snapshot_observed_at":"2026-08-14T04:57:05.550863Z","submitted_at":"2024-12-29T12:24:31Z","title":"CoA-VLA: Improving Vision-Language-Action Models via Visual-Textual Chain-of-Affordance","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T23:26:37.435542Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2412.20451"},"observation_digest":"sha256:e49c0b2a37d6d9556a6853b4f0eb1d59a04cc6c59b5e21ff985f9a3356b7e219","observation_id":"c459f902-4341-4340-87ae-03ae951491a7","resolution":{"observed_at":"2026-08-10T23:26:37.435542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-10T22:08:09.604308Z","title":"Open X-Embodiment: Robotic learning datasets and RT-X models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.02765","last_updated":"2025-01-06T05:15:59Z","snapshot_observed_at":"2026-08-14T12:32:34.328935Z","submitted_at":"2025-01-06T05:15:59Z","title":"Visual Large Language Models for Generalized and Specialized Applications","version":1},"reference_index":182,"source":"pdf_text","source_observed_at":"2026-08-10T22:08:09.604308Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2501.02765"},"observation_digest":"sha256:ef43d9cb55ca12e6a369e6446d4b59cf658c6b166391fe9f543ed4879aeee2c7","observation_id":"ef559dfa-dce6-4198-a85f-d0453c20bf1a","resolution":{"observed_at":"2026-08-10T22:08:09.604308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-10T21:41:28.993607Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.04268","last_updated":"2025-01-08T04:30:45Z","snapshot_observed_at":"2026-08-15T00:07:57.337651Z","submitted_at":"2025-01-08T04:30:45Z","title":"Robotic Programmer: Video Instructed Policy Code Generation for Robotic Manipulation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:41:28.993607Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2501.04268"},"observation_digest":"sha256:fa3b6e0116cc2bebb056692a864fe1c809201d896b274b87a9e9127571b2d0ba","observation_id":"47b9eb13-c563-4a63-956f-75232caed42c","resolution":{"observed_at":"2026-08-10T21:41:28.993607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-10T21:31:54.019663Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.04595","last_updated":"2025-01-09T04:13:45Z","snapshot_observed_at":"2026-08-13T09:46:32.403479Z","submitted_at":"2025-01-08T16:23:56Z","title":"MobileH2R: Learning Generalizable Human to Mobile Robot Handover Exclusively from Scalable and Diverse Synthetic Data","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T21:31:54.019663Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2501.04595"},"observation_digest":"sha256:336eae7beab0ede1680a468f8ef08badb519d899af0158647c4a74b4edec016c","observation_id":"6731619c-349b-4041-af21-f108190bb09d","resolution":{"observed_at":"2026-08-10T21:31:54.019663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-11T08:52:31.686474Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2501.09747"},"observation_digest":"sha256:14786253a75ebd8f7f2cf35c4750c024b05a239690ba93bbf55441baecfca8f1","observation_id":"36b4bd67-6172-4190-ad77-550a7bb25457","resolution":{"observed_at":"2026-05-11T17:23:25.503833Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-10T19:29:39.827298Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.10105","last_updated":"2025-03-08T13:55:48Z","snapshot_observed_at":"2026-08-14T09:40:41.520844Z","submitted_at":"2025-01-17T10:45:22Z","title":"Universal Actions for Enhanced Embodied Foundation Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T19:29:39.827298Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2501.10105"},"observation_digest":"sha256:b3b3da914fec76897af24f60502a6179df93498e441cef29af08633cb5234499","observation_id":"feb82f84-14c7-4027-847a-209ace552361","resolution":{"observed_at":"2026-08-10T19:29:39.827298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-10T23:33:32.354452Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.10395","last_updated":"2024-12-28T21:13:48Z","snapshot_observed_at":"2026-08-13T16:56:44.274703Z","submitted_at":"2024-12-28T21:13:48Z","title":"Towards General Purpose Robots at Scale: Lifelong Learning and Learning to Use Memory","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-10T23:33:32.354452Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2501.10395"},"observation_digest":"sha256:d78355fa11d1eb13c71cf14958bafb9deec3ad83003d3e55822552115842886c","observation_id":"04ab681e-8d43-4fe7-bd96-22664c8acf45","resolution":{"observed_at":"2026-08-10T23:33:32.354452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-10T14:43:03.306449Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15068","last_updated":"2025-02-05T08:49:14Z","snapshot_observed_at":"2026-08-10T22:47:39.131078Z","submitted_at":"2025-01-25T04:19:33Z","title":"An Atomic Skill Library Construction Method for Data-Efficient Embodied Manipulation","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:03.306449Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2501.15068"},"observation_digest":"sha256:4a3fa25ad3def930ee6e12f75d96ce865350b59666c8420d9a3dddfd21d241d7","observation_id":"1089a730-24f8-41a8-9dd6-b282d597149f","resolution":{"observed_at":"2026-08-10T14:43:03.306449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-10T16:30:41.735113Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16368","last_updated":"2025-02-04T21:21:49Z","snapshot_observed_at":"2026-08-13T22:52:26.103958Z","submitted_at":"2025-01-22T18:52:41Z","title":"Foundation Models for CPS-IoT: Opportunities and Challenges","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-10T16:30:41.735113Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2501.16368"},"observation_digest":"sha256:b953ad6760723a070873932efdec42136fd768d9e05333579036ec74e3946aa3","observation_id":"560d14aa-e562-4db1-b9f0-a5c9448eb1b9","resolution":{"observed_at":"2026-08-10T16:30:41.735113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-10T11:39:56.068654Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-13T09:27:30.536096Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T11:39:56.068654Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2501.16664"},"observation_digest":"sha256:e1ec93e6d81a8925652f93068f957579af622769ef203bd66cf86dd8c923f620","observation_id":"79c7c249-caf3-450f-8837-c1be54add358","resolution":{"observed_at":"2026-08-10T11:39:56.068654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-09T22:44:50.878440Z","title":"Open x- embodiment: Robotic learning datasets and rt-x models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18733","last_updated":"2025-01-30T20:19:01Z","snapshot_observed_at":"2026-08-14T12:26:50.083405Z","submitted_at":"2025-01-30T20:19:01Z","title":"Integrating LMM Planners and 3D Skill Policies for Generalizable Manipulation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T22:44:50.878440Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2501.18733"},"observation_digest":"sha256:42c98f3420198b86e93bbc8ac8d4cfd96a7d25e3251aa0e6d3943345e79932e6","observation_id":"a499ebdb-b3f9-4a46-a3de-6d38c3585e4a","resolution":{"observed_at":"2026-08-09T22:44:50.878440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-09T22:13:14.919949Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.18867","last_updated":"2025-06-26T03:43:38Z","snapshot_observed_at":"2026-08-14T12:42:36.436107Z","submitted_at":"2025-01-31T03:20:09Z","title":"UP-VLA: A Unified Understanding and Prediction Model for Embodied Agent","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T22:13:14.919949Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2501.18867"},"observation_digest":"sha256:cf69291ec7b0e846e01b8b9f9361c8e31433bdc16d83d289c60a9d3cbfd669b8","observation_id":"f3f94546-5816-4fac-b698-69929c7201dd","resolution":{"observed_at":"2026-08-09T22:13:14.919949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-09T11:19:45.805116Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02753","last_updated":"2025-02-04T22:37:58Z","snapshot_observed_at":"2026-08-13T03:52:51.210125Z","submitted_at":"2025-02-04T22:37:58Z","title":"MuST: Multi-Head Skill Transformer for Long-Horizon Dexterous Manipulation with Skill Progress","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T11:19:45.805116Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2502.02753"},"observation_digest":"sha256:9b91e3ce6787b3ea32b713e8325d428afec4d8682f21a35022d131523566c609","observation_id":"5ec21107-32c3-4b48-95b2-8bcee4355a0a","resolution":{"observed_at":"2026-08-09T11:19:45.805116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-09T06:05:09.917376Z","title":"Geng, D., Herrmann, C., Hur, J., Cole, F., Zhang, S., Pfaff, T., Lopez-Guevara, T., Doersch, C., Aytar, Y ., Rubinstein, M., Sun, C., Wang, O., Owens, A., and Sun, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03072","last_updated":"2025-02-05T11:04:41Z","snapshot_observed_at":"2026-08-12T10:18:09.747034Z","submitted_at":"2025-02-05T11:04:41Z","title":"RoboGrasp: A Universal Grasping Policy for Robust Robotic Control","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T06:05:09.917376Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2502.03072"},"observation_digest":"sha256:d8bbe4918bc95e111f4eaae446dde5109f1f7ef17bb27cfb5b45337c31506fdf","observation_id":"971f31dd-a4bf-4156-85b1-b86cdb77c6a3","resolution":{"observed_at":"2026-08-09T06:05:09.917376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-09T04:45:34.680641Z","title":"arXiv preprint arXiv:2310.08864","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03450","last_updated":"2025-08-08T19:55:03Z","snapshot_observed_at":"2026-08-10T10:28:27.748591Z","submitted_at":"2025-02-05T18:50:38Z","title":"Schema-Guided Scene-Graph Reasoning based on Multi-Agent Large Language Model System","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T04:45:34.680641Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2502.03450"},"observation_digest":"sha256:174a7614b8697549080e1110acf0fcaebe53007f4d44926cfccbf6908f51ffc8","observation_id":"4fe79c77-f6f1-4003-b054-3eb003ffa7a9","resolution":{"observed_at":"2026-08-09T04:45:34.680641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-09T04:42:06.409108Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03465","last_updated":"2025-03-17T06:29:41Z","snapshot_observed_at":"2026-08-13T20:51:08.724872Z","submitted_at":"2025-02-05T18:59:52Z","title":"Seeing World Dynamics in a Nutshell","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T04:42:06.409108Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2502.03465"},"observation_digest":"sha256:669c50fb2935e0247f4d0c4c1dfa13d6aa20c7cd6d20eaa014c0e6e334e12ce2","observation_id":"8729d94d-3d95-4f4d-aad4-f9c3386c1eb3","resolution":{"observed_at":"2026-08-09T04:42:06.409108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-08T22:55:57.805293Z","title":"Open x-embodiment: Robotic learning datasets and rt-x mod- els","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04296","last_updated":"2025-02-06T18:38:26Z","snapshot_observed_at":"2026-08-14T11:24:23.667154Z","submitted_at":"2025-02-06T18:38:26Z","title":"Learning Real-World Action-Video Dynamics with Heterogeneous Masked Autoregression","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T22:55:57.805293Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2502.04296"},"observation_digest":"sha256:ffeaaf0f6884f5368bbbbefaf1d1cbe5f8df23506f2a9472043ad49a4125b1a7","observation_id":"dfdf6f05-9926-47a6-96c9-2c09ee242d80","resolution":{"observed_at":"2026-08-08T22:55:57.805293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-08T22:55:31.090070Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04307","last_updated":"2025-02-06T18:49:35Z","snapshot_observed_at":"2026-08-12T12:37:09.795531Z","submitted_at":"2025-02-06T18:49:35Z","title":"DexterityGen: Foundation Controller for Unprecedented Dexterity","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T22:55:31.090070Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2502.04307"},"observation_digest":"sha256:a064c3f50262ea68374016d5bbbb9fde9ede04f711127263b04e085540bafa1f","observation_id":"12f21e45-92c1-422c-bd20-ee5202dafc1f","resolution":{"observed_at":"2026-08-08T22:55:31.090070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-08T21:27:27.730695Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04809","last_updated":"2025-06-02T14:32:56Z","snapshot_observed_at":"2026-08-12T17:18:07.831913Z","submitted_at":"2025-02-07T10:28:39Z","title":"Humans Coexist, So Must Embodied Artificial Agents","version":3},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-08-08T21:27:27.730695Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2502.04809"},"observation_digest":"sha256:a43d68745c2f311804f0657562dbe781efb696fb6b4ac1ea4d405b7b58edfef9","observation_id":"54e7c1ce-68b4-4261-96a0-0431375b2fa2","resolution":{"observed_at":"2026-08-08T21:27:27.730695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2502.05855","last_updated":"2025-08-09T10:58:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-09T11:25:56Z","title":"DexVLA: Vision-Language Model with Plug-In Diffusion Expert for General Robot Control","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-14T19:48:48.725800Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2502.05855"},"observation_digest":"sha256:a128e72418a67ad8012019598f2e98aa60a5d2686c72290431db7330b4057df8","observation_id":"ad5be411-7c9a-480f-a55a-4e49c5ce7b04","resolution":{"observed_at":"2026-05-14T19:48:49.004617Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-08T13:35:17.928078Z","title":"Collaboration, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07837","last_updated":"2025-05-01T08:09:58Z","snapshot_observed_at":"2026-08-13T19:28:04.511928Z","submitted_at":"2025-02-11T02:16:59Z","title":"RoboBERT: An End-to-end Multimodal Robotic Manipulation Model","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T13:35:17.928078Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2502.07837"},"observation_digest":"sha256:97991b8c7318aa6f007ef649d849803aa872835d2810fd770da49b5f09dac008","observation_id":"ce6d1edd-e04b-4e13-8971-5a415b250dd3","resolution":{"observed_at":"2026-08-08T13:35:17.928078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-08T00:03:16.466863Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08643","last_updated":"2025-02-18T16:45:59Z","snapshot_observed_at":"2026-08-12T11:17:44.563445Z","submitted_at":"2025-02-12T18:57:22Z","title":"A Real-to-Sim-to-Real Approach to Robotic Manipulation with VLM-Generated Iterative Keypoint Rewards","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T00:03:16.466863Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2502.08643"},"observation_digest":"sha256:10ccac088fb5f91c800ae9e738f8b87e0f9a4ee52706fc4e840b667aa8565a87","observation_id":"5ed50014-dc07-4ba7-9b2c-2fb866fddf9a","resolution":{"observed_at":"2026-08-08T00:03:16.466863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-08T00:05:05.799879Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08645","last_updated":"2025-02-16T12:14:53Z","snapshot_observed_at":"2026-08-13T00:45:15.554989Z","submitted_at":"2025-02-12T18:59:04Z","title":"Re$^3$Sim: Generating High-Fidelity Simulation Data via 3D-Photorealistic Real-to-Sim for Robotic Manipulation","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-08T00:05:05.799879Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2502.08645"},"observation_digest":"sha256:0aafbdde7ea5cf1636af4d5150a4327067ab2fea2295a55949c8cb676495c96b","observation_id":"81721795-6080-4d05-9ca5-803d9392ad99","resolution":{"observed_at":"2026-08-08T00:05:05.799879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-07T19:33:22.037078Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.10077","last_updated":"2025-02-14T10:59:09Z","snapshot_observed_at":"2026-08-13T14:33:07.395379Z","submitted_at":"2025-02-14T10:59:09Z","title":"Towards Empowerment Gain through Causal Structure Learning in Model-Based RL","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T19:33:22.037078Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2502.10077"},"observation_digest":"sha256:84f9f43faaa7bb13e0800ef437121a31631c4bdfa9cb5f81fc4c0eb9f3497186","observation_id":"4dcf38bc-b38c-4d02-bb34-db37c81181bf","resolution":{"observed_at":"2026-08-07T19:33:22.037078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2502.19645","last_updated":"2025-04-28T07:49:39Z","snapshot_observed_at":"2026-08-14T04:21:39.686714Z","submitted_at":"2025-02-27T00:30:29Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-11T04:35:31.914360Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2502.19645"},"observation_digest":"sha256:fb84bf74585a10911f7df7e944926f7a504689751d423ad24bba8130b5e37285","observation_id":"d45d68a5-7316-440c-b920-d589cd6fda13","resolution":{"observed_at":"2026-05-11T17:23:25.503833Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2503.03480","last_updated":"2026-04-19T06:23:17Z","snapshot_observed_at":"2026-07-30T14:07:10.544745Z","submitted_at":"2025-03-05T13:16:55Z","title":"SafeVLA: Towards Safety Alignment of Vision-Language-Action Model via Constrained Learning","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-23T01:27:33.123243Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2503.03480"},"observation_digest":"sha256:55a7676b3a76a4cb5e56ad75fc26f47a86f94ad1fa1de08f90d1b8e0dfbd6742","observation_id":"603f2c51-f64f-4359-8e27-85cbd13a4485","resolution":{"observed_at":"2026-05-23T01:32:22.592525Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2503.05231","last_updated":"2025-06-03T00:07:34Z","snapshot_observed_at":"2026-07-06T20:48:22.689787Z","submitted_at":"2025-03-07T08:28:24Z","title":"Kaiwu: A Multimodal Manipulation Dataset and Framework for Robot Learning and Human-Robot Interaction","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-23T01:26:42.319929Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2503.05231"},"observation_digest":"sha256:618ccc0c3098c7a54667357a237b487f029202b1e3505f2a63d62c5546303259","observation_id":"21d507ff-c1c0-4a00-8dc4-b61a8b2524b9","resolution":{"observed_at":"2026-05-23T01:27:21.433773Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2503.10631","last_updated":"2025-06-23T07:37:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-13T17:59:52Z","title":"HybridVLA: Collaborative Diffusion and Autoregression in a Unified Vision-Language-Action Model","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T22:00:48.667428Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2503.10631"},"observation_digest":"sha256:5da8cfed2650b5773cd6cb390910934dfa74004a6164dadf491d5a772cd06169","observation_id":"d3a5a4a4-8f8f-445e-a69c-9f4bb42b1fab","resolution":{"observed_at":"2026-05-15T22:00:48.796311Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2503.22020","last_updated":"2025-03-27T22:23:04Z","snapshot_observed_at":"2026-08-11T02:04:51.188806Z","submitted_at":"2025-03-27T22:23:04Z","title":"CoT-VLA: Visual Chain-of-Thought Reasoning for Vision-Language-Action Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-16T05:21:44.903048Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2503.22020"},"observation_digest":"sha256:cc613a5fc1a85e4d52f57cc9ee43bf1e029c90f4c4068bd3afe3fcb37953369f","observation_id":"b2f23468-b4ea-4b89-bc92-6e7ee45f789e","resolution":{"observed_at":"2026-05-16T05:21:44.966639Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2504.02792","last_updated":"2025-05-23T00:47:24Z","snapshot_observed_at":"2026-08-10T02:54:28.264405Z","submitted_at":"2025-04-03T17:38:59Z","title":"Unified World Models: Coupling Video and Action Diffusion for Pretraining on Large Robotic Datasets","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T16:25:00.365534Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2504.02792"},"observation_digest":"sha256:86ef3339464360388cf435ee8a9719c15f764800e08a2dc02e236eba9e5d2642","observation_id":"83c5c18e-87e3-4a86-8c1c-53e441bdabf0","resolution":{"observed_at":"2026-05-13T16:25:00.476844Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-22T18:02:23.305313Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2504.16054"},"observation_digest":"sha256:7fddfba02fce1a0e490591438f3aeb3d933a706eea525bbea08cde806e77801a","observation_id":"2ecd5116-f2e7-4cb9-afdb-72ec8e93560a","resolution":{"observed_at":"2026-05-22T18:05:00.933566Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2505.03233","last_updated":"2025-08-27T03:43:58Z","snapshot_observed_at":"2026-08-07T00:53:01.614001Z","submitted_at":"2025-05-06T06:59:28Z","title":"GraspVLA: a Grasping Foundation Model Pre-trained on Billion-scale Synthetic Action Data","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-17T20:55:52.109166Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2505.03233"},"observation_digest":"sha256:b78d745b8313adf3891a1dfbdea0611145fb1eb75c0fa0a3a5de612ced47d027","observation_id":"3184f5cd-d330-4483-8cd7-5557fc987175","resolution":{"observed_at":"2026-05-17T20:55:52.179309Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2505.03500","last_updated":"2026-05-01T03:34:16Z","snapshot_observed_at":"2026-08-13T09:19:23.018615Z","submitted_at":"2025-05-06T13:05:04Z","title":"VLAs are Confined yet Capable of Generalizing to Novel Instructions","version":5},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-22T16:46:05.993833Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2505.03500"},"observation_digest":"sha256:a427e5dfec1d5d0a55a125941d1a1cabe37475fcdade71adbb11e3916745aedf","observation_id":"e87e53ae-7615-44ae-9f08-d1bc8505bc44","resolution":{"observed_at":"2026-05-22T16:46:47.436258Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2505.13255","last_updated":"2026-04-24T03:20:34Z","snapshot_observed_at":"2026-08-13T04:26:23.674634Z","submitted_at":"2025-05-19T15:39:08Z","title":"Policy Contrastive Decoding for Robotic Foundation Models","version":6},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T14:09:48.762737Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2505.13255"},"observation_digest":"sha256:bedf9c0a69285c633952df15f53fca19fc1a7d661358196a03dc4dbd553bf1ea","observation_id":"b89ce4ff-6891-42f1-a179-f206162f0909","resolution":{"observed_at":"2026-05-22T14:11:38.462669Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-07T15:30:45.555313Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14938","last_updated":"2025-05-20T21:55:01Z","snapshot_observed_at":"2026-08-11T23:26:52.721604Z","submitted_at":"2025-05-20T21:55:01Z","title":"Scan, Materialize, Simulate: A Generalizable Framework for Physically Grounded Robot Planning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:45.555313Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2505.14938"},"observation_digest":"sha256:cba10b512a2d2d2fbf95ea4f8a52071df932ec4cf22346fa21b43e33839647f2","observation_id":"bc723216-93ef-435f-8f09-47059f797712","resolution":{"observed_at":"2026-08-07T15:30:45.555313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-07T15:29:55.709120Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14986","last_updated":"2025-05-21T00:21:38Z","snapshot_observed_at":"2026-08-14T09:47:16.887472Z","submitted_at":"2025-05-21T00:21:38Z","title":"AnyBody: A Benchmark Suite for Cross-Embodiment Manipulation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:55.709120Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2505.14986"},"observation_digest":"sha256:bffb0cdb2f64ed9f21fa8b74724632a6a5cc8c221efad536e55082f999b9b14e","observation_id":"dbfa6bb9-d5e0-4ed3-85bf-d3fc4ac38f6b","resolution":{"observed_at":"2026-08-07T15:29:55.709120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-07T15:21:12.929203Z","title":"Open X-Embodiment: Robotic learning datasets and RT-X models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.15517","last_updated":"2025-06-18T21:24:31Z","snapshot_observed_at":"2026-08-14T02:10:06.126777Z","submitted_at":"2025-05-21T13:42:52Z","title":"Robo2VLM: Visual Question Answering from Large-Scale In-the-Wild Robot Manipulation Datasets","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:21:12.929203Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2505.15517"},"observation_digest":"sha256:b5967ffc5a5065e82b0999cc45e8773637594e9f92db009decbc545c9af38797","observation_id":"fadc7e27-88de-4086-9c27-191a49deb0b7","resolution":{"observed_at":"2026-08-07T15:21:12.929203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-07T15:03:58.346357Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16640","last_updated":"2025-05-22T13:12:46Z","snapshot_observed_at":"2026-08-13T00:46:07.296703Z","submitted_at":"2025-05-22T13:12:46Z","title":"BadVLA: Towards Backdoor Attacks on Vision-Language-Action Models via Objective-Decoupled Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:58.346357Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2505.16640"},"observation_digest":"sha256:3445f624a624d0c0df51b07030746f3a50d545f704fb8c471687fd198489865d","observation_id":"8dad1db0-5b45-49d9-9e85-76110536429b","resolution":{"observed_at":"2026-08-07T15:03:58.346357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2505.18719","last_updated":"2025-05-24T14:42:51Z","snapshot_observed_at":"2026-08-14T01:02:35.686274Z","submitted_at":"2025-05-24T14:42:51Z","title":"VLA-RL: Towards Masterful and General Robotic Manipulation with Scalable Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T12:55:40.245908Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2505.18719"},"observation_digest":"sha256:57d978284ffa49af17fa0ce0439c8d175acf2f0bdebc9cde3a4d9bd37de69bdd","observation_id":"9e7467a3-69f1-4132-922a-7909a5721cc9","resolution":{"observed_at":"2026-05-16T12:55:40.441396Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-07T14:28:02.818167Z","title":"Open X- Embodiment: Robotic learning datasets and RT-X models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18792","last_updated":"2025-05-24T17:11:32Z","snapshot_observed_at":"2026-08-13T02:21:56.227109Z","submitted_at":"2025-05-24T17:11:32Z","title":"On the Dual-Use Dilemma in Physical Reasoning and Force","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:28:02.818167Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2505.18792"},"observation_digest":"sha256:013dfa313f2fcf0a349f1e9ca13194730e7c987b9921a078704a96a9031ddc8c","observation_id":"cb0e026b-a111-4301-96a1-07fb25f138c8","resolution":{"observed_at":"2026-08-07T14:28:02.818167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-07T14:23:17.726703Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models.arXiv preprint arXiv:2310.08864,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19080","last_updated":"2025-05-25T10:24:44Z","snapshot_observed_at":"2026-08-13T23:10:23.707893Z","submitted_at":"2025-05-25T10:24:44Z","title":"ReFineVLA: Reasoning-Aware Teacher-Guided Transfer Fine-Tuning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:17.726703Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2505.19080"},"observation_digest":"sha256:a464d6f88595d53f99c97933bbe76c22a5c13f8c27fbc0e4dd0316d54db0894d","observation_id":"f5540d1b-c5c0-4ab7-a9aa-e0aa30e0bddf","resolution":{"observed_at":"2026-08-07T14:23:17.726703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-07T14:00:57.569699Z","title":"Collaboration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20290","last_updated":"2025-06-03T22:50:28Z","snapshot_observed_at":"2026-08-13T14:30:25.903303Z","submitted_at":"2025-05-26T17:59:17Z","title":"EgoZero: Robot Learning from Smart Glasses","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:57.569699Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2505.20290"},"observation_digest":"sha256:271753ed2342447fa920f60e67f50aa57040dd861db1bcfa00dbf94a3850e538","observation_id":"5220e522-6f22-4850-8470-031540c7120f","resolution":{"observed_at":"2026-08-07T14:00:57.569699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-07T13:53:41.397501Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20814","last_updated":"2025-05-27T07:22:33Z","snapshot_observed_at":"2026-08-14T19:21:07.548972Z","submitted_at":"2025-05-27T07:22:33Z","title":"Spatial RoboGrasp: Generalized Robotic Grasping Control Policy","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:53:41.397501Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2505.20814"},"observation_digest":"sha256:4d0b4c1fb1de216cc232da0535d3dd5160465a807cf953908c1edeb23d66b0ad","observation_id":"051db9d9-f10b-4ac1-a9a3-605d47487c87","resolution":{"observed_at":"2026-08-07T13:53:41.397501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-07T13:10:29.255452Z","title":"Padalkar, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22626","last_updated":"2025-09-09T06:38:19Z","snapshot_observed_at":"2026-08-09T23:21:52.556876Z","submitted_at":"2025-05-28T17:45:05Z","title":"SCIZOR: A Self-Supervised Approach to Data Curation for Large-Scale Imitation Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:10:29.255452Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2505.22626"},"observation_digest":"sha256:1a11d333407cb4338052fd0b49751038e30cbca352055e6fb8274655f25351a1","observation_id":"f5ef28c8-879a-446b-95d0-91a51eaf63c6","resolution":{"observed_at":"2026-08-07T13:10:29.255452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-07T12:45:23.546515Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23705","last_updated":"2025-05-29T17:40:09Z","snapshot_observed_at":"2026-08-07T12:37:05.162590Z","submitted_at":"2025-05-29T17:40:09Z","title":"Knowledge Insulating Vision-Language-Action Models: Train Fast, Run Fast, Generalize Better","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:23.546515Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2505.23705"},"observation_digest":"sha256:6ea94894e0ec2a073c0cc9abf71ae21842542282f73ae8ede7c45c82af6ff47f","observation_id":"7c2c7512-6277-46f8-802f-7d2bc43cf8fe","resolution":{"observed_at":"2026-08-07T12:45:23.546515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-07T11:34:14.648837Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01953","last_updated":"2025-06-02T17:59:51Z","snapshot_observed_at":"2026-08-13T09:54:33.556478Z","submitted_at":"2025-06-02T17:59:51Z","title":"Fast-in-Slow: A Dual-System Foundation Model Unifying Fast Manipulation within Slow Reasoning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:34:14.648837Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2506.01953"},"observation_digest":"sha256:64fa0f9058d10485f55b8015f3ca9aae6dee2301e071f261c564c0bec7de99cb","observation_id":"eab53bb3-54c2-4e56-93c8-3c9c50bd86fe","resolution":{"observed_at":"2026-08-07T11:34:14.648837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-07T11:11:40.441575Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03350","last_updated":"2025-06-03T19:43:58Z","snapshot_observed_at":"2026-08-10T20:18:21.272344Z","submitted_at":"2025-06-03T19:43:58Z","title":"Adversarial Attacks on Robotic Vision Language Action Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:11:40.441575Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2506.03350"},"observation_digest":"sha256:4acab94d4c557fe7583acb3d21468d7fd2de3fd8c5ddd29fde6aaabafae20e32","observation_id":"e8fbd981-45eb-48d6-9617-ce72bf99ee65","resolution":{"observed_at":"2026-08-07T11:11:40.441575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-07T10:50:50.966075Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04484","last_updated":"2025-07-16T20:26:15Z","snapshot_observed_at":"2026-08-14T04:22:26.886982Z","submitted_at":"2025-06-04T22:03:57Z","title":"Online Adaptation of Terrain-Aware Dynamics for Planning in Unstructured Environments","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.966075Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2506.04484"},"observation_digest":"sha256:ef004ce969b9df2549400df3ce0163ca59c8ce82f7b9cf79019d4ac2ff88d546","observation_id":"a2e35767-92eb-4f44-ab11-df4e8ac69e8e","resolution":{"observed_at":"2026-08-07T10:50:50.966075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2310.08864/citation-record","integrity":"/paper/2310.08864/integrity","json":"/paper/2310.08864/citation-record.json","paper":"/paper/2310.08864"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"28c109e0-5d81-489c-a557-b8790a42e016","year":2021},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:9432bec803fab0c069d9665cdafaee16561d7e1b1daac18b4f0de7a7ce1ce494","observation_id":"178d6776-36db-470d-b017-e16c46ee1e1a","resolution":{"observed_at":"2026-05-11T17:23:25.282476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GPT-4 technical report","venue":null,"work_id":"b949f092-ca09-4cc9-b6f8-51da74319b35","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:1eea23cb859cf185fd6fbd125d23630f5fc92859b354082a017317427e197136","observation_id":"2485ff43-6a67-445d-8b0a-89a7213f5fe4","resolution":{"observed_at":"2026-05-11T17:23:25.295269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":"2305.10403","doi":"10.48550/arxiv.2305.10403","metadata_source":"pith","pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PaLM 2 Technical Report","venue":"cs.CL","work_id":"905ee9a7-ea61-4a94-bd62-2600cbe3e315","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:0d48bfb18fdbf495f90cfb2653e2daa1f4159c237b804819c7a58d40b38e1080","observation_id":"47ed513d-6aa9-47f8-ac1c-c7db4b9ac678","resolution":{"observed_at":"2026-05-12T11:59:27.667882Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Google landmarks dataset v2 - a large-scale benchmark for instance-level recognition and retrieval","venue":null,"work_id":"103aa313-71c5-4614-a2e4-0bc0c4f0caf6","year":2020},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:9f7ae06370ee9ac5c6a0442294b023538244afa593095350b0c0a77cd40eac23","observation_id":"fcc1afb4-e813-41a5-b0a1-b9a4f37b733b","resolution":{"observed_at":"2026-05-11T17:23:25.304725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tencent ML-images: A large-scale multi-label image database for visual representation learning","venue":null,"work_id":"76431414-cdec-43ab-adba-92e61e3c16aa","year":2019},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:52cc40be5e707fe7a097a2d1919674213c5e3d3f9e55131dfa21aeda4728bf02","observation_id":"41bc16d7-153f-4c07-a8c2-7a63fabfe05c","resolution":{"observed_at":"2026-05-11T17:23:25.320351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DBpedia - a large-scale, multilingual knowledge base extracted from wikipedia","venue":null,"work_id":"63c259c4-1065-4838-983f-9b39c5d8886a","year":2015},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:e9b1f704080912a6473e564dee450c7bb406a6333001ea2c8e56b18bee6de89e","observation_id":"5fb35c1b-495f-479e-8e9d-83034e0b3195","resolution":{"observed_at":"2026-05-11T17:23:25.325215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Web data commons- extracting structured data from two large web cor- pora","venue":null,"work_id":"3e4ad89e-664a-4f35-b376-2f580a49bba3","year":2012},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:8cfc11018dfa6fb8fda8ea0ecd2933d0a0b8acc2e27a8e0e3d2b235303644d3a","observation_id":"a64d3b5e-6df8-400c-81bd-3605e7620b04","resolution":{"observed_at":"2026-05-11T17:23:25.334353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"RT-1: Robotics transformer for real-world control at scale","venue":null,"work_id":"3bef6261-27fa-4668-af49-b997ad25d048","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:e3aa0d06d69b87754493969ae5a12bbcbb2b3208ed4b946b82ebaf352b91e449","observation_id":"4d80ed68-f3f0-4550-aa27-c4fd9fa855b4","resolution":{"observed_at":"2026-05-11T17:23:25.345343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":"2307.15818","doi":"10.48550/arxiv.2307.15818","metadata_source":"pith","pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","venue":"cs.RO","work_id":"ff438a8a-8003-4fae-9131-acd418b3597b","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:bfb135dc84a02c669e718d785a14925ac17878e70b09a393d553c46ae1505ac7","observation_id":"23bba126-a8fd-4f01-b6e9-09e8094c89de","resolution":{"observed_at":"2026-05-11T17:23:24.449479Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning modular neural network policies for multi-task and multi-robot transfer","venue":null,"work_id":"9bbf205d-d2b9-4ae7-8e24-d2af99b99f5e","year":2017},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:0e18f4997f3ff291e32a4de85dd2e9ca0f9809bc90067e86e3a82ccc07ffab0d","observation_id":"4c02fa1e-375a-41b5-911c-48baad8b582d","resolution":{"observed_at":"2026-05-11T17:23:25.349795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hardware con- ditioned policies for multi-robot transfer learning","venue":null,"work_id":"e6c477ba-8840-4fb8-8fdf-c72c09adc86f","year":2018},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:51f9e40bd17a1bc516c86e0fd457d57ec68419fba9dd7223b25e82596d1ba0e3","observation_id":"48b211f3-6c54-42b8-869c-cb2bd9a5fe21","resolution":{"observed_at":"2026-05-11T17:23:25.355833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Graph networks as learnable physics engines for inference and control","venue":null,"work_id":"e5c1c812-5b1f-4bb6-bea3-5f88aaa349d8","year":2018},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:13fee46d1594bc9981122b8218b5046cf07adfca2f1fdba5f2703b33bda2d94e","observation_id":"5e3e895a-7a13-4cc6-93de-6449d4b5b618","resolution":{"observed_at":"2026-05-11T17:23:25.372656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to control self-assembling morphologies: a study of generalization via modularity","venue":null,"work_id":"95765c3e-d7f0-474d-b224-4792d52f6bcf","year":2019},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:fd273014eb2879f5f0d17cc82f21f0635a65c5ba3818f509b6b63b0cd2854cb5","observation_id":"70edaf7c-bf45-4558-ad82-ed958463f166","resolution":{"observed_at":"2026-05-11T17:23:25.382014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Variable impedance control in end-effector space. an action space for reinforcement learning in contact rich tasks","venue":null,"work_id":"565a3a0d-1ea5-466e-bc3e-9389fc213dfd","year":2019},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:0a3765efabec22a11d944c046e8497fe49e16c44756809841de3f51778ff7fe0","observation_id":"11f7ab33-ffcd-4bb0-a0f2-7b50492d2a7b","resolution":{"observed_at":"2026-05-11T17:23:25.386360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"One policy to control them all: Shared modular policies for agent- agnostic control","venue":null,"work_id":"46e91f6d-a7a8-4390-9af6-c94f65c74bb1","year":2020},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:0fc3348a4ad86056ba07aaed1b35eaa581529cb1422429ef0e07df52c0b1d426","observation_id":"5abd6c53-e52a-485d-80a0-f1f6bae04869","resolution":{"observed_at":"2026-05-11T17:23:25.399358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.01856","last_updated":"2021-04-14T09:48:02Z","snapshot_observed_at":"2026-08-14T01:09:01.911058Z","submitted_at":"2020-10-05T08:37:11Z","title":"My Body is a Cage: the Role of Morphology in Graph-Based Incompatible Control","version":2},"cited_work":{"arxiv_id":"2010.01856","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.01856","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"My body is a cage: the role of morphology in graph-based incompatible control.Preprint arXiv:2010.01856","venue":null,"work_id":"f583afd4-c833-4549-aa5d-4330ad71e0ef","year":2010},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"cited_paper":"/paper/2010.01856","citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:0293cdd3efe106deb009c92d7534f972031fe0ae5b222c740001738f39867b03","observation_id":"c147a556-1c96-43fb-bbe4-69f537828536","resolution":{"observed_at":"2026-05-11T17:23:24.546621Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"XIRL: Cross-embodiment inverse reinforcement learning","venue":null,"work_id":"39b88422-6c35-47ed-bbaa-fd5f80532c74","year":2021},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:c04486f5435d7fe1c83da1bf337734d61eba9056d28accd16203a997dc8c550e","observation_id":"7d2a29c4-d92f-4f40-8d00-24674a290938","resolution":{"observed_at":"2026-05-11T17:23:25.410747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bayesian meta-learning for few-shot policy adaptation across robotic plat- forms","venue":null,"work_id":"f3a8b9c4-9d39-4c18-bf57-afd04ed49f69","year":2021},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:83a06ef7373e5a977100d757464fd78189d5c29fb56a8ff11ea73d2f0c96b2d7","observation_id":"b6711b3f-e484-4aa1-a075-5571f6ba888e","resolution":{"observed_at":"2026-05-11T17:23:25.424352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Meta- morph: Learning universal controllers with transform- ers","venue":null,"work_id":"1bf55fdb-66e2-4144-8225-41df3b22aeeb","year":2021},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:f3966e190975da97767fb09d2a3efe5e0e4875f2e3dbfe934f0eb3ba9f4fe290","observation_id":"ea443b51-f772-483b-a572-dbe0fa21c041","resolution":{"observed_at":"2026-05-11T17:23:25.433189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A gen- eralist dynamics model for control","venue":null,"work_id":"e618edbd-5475-499a-9e57-dff17d24b257","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:589a1532f0e66ce6f2c618eb0f20180e726205df35c5f621bcc7bc9a74427914","observation_id":"fac56664-f6da-4b81-afa9-68b059fd3617","resolution":{"observed_at":"2026-05-11T17:23:25.437765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GNM: A general navigation model to drive any robot","venue":null,"work_id":"690c5fc9-0fae-4ca5-98c9-a982daeff860","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:ce4672a487045b65020823d0b3fa5b425f584f5ab3114e1a0958bfc9d7ed113d","observation_id":"9d4fcd46-508d-4ee1-99a2-5c7ae52f27d6","resolution":{"observed_at":"2026-05-11T17:23:25.444355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Modularity through attention: Efficient training and transfer of language-conditioned policies for robot manipulation","venue":null,"work_id":"7f5aaa99-232a-48da-9c65-7c40e6d5aedb","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:9cf41f9df2767c1bd31b10d077dd2a9b56fe503bfc03539471040764a5e6299d","observation_id":"e9c91fb8-80cb-4dc9-925f-a21d93d069ec","resolution":{"observed_at":"2026-05-11T17:23:25.451667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"RoboNet: Large-scale multi-robot learning","venue":null,"work_id":"ce4a738c-c00b-4de7-8bfe-2837330f74cc","year":2019},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:afb880880b374ff1f90876ebc7b3603be1db5f425eeb00d654eb17b85b761363","observation_id":"5161ae21-2f13-46f3-8143-3d20568cdcd2","resolution":{"observed_at":"2026-05-11T17:23:25.468356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Know thyself: Transferable visual control policies through robot-awareness","venue":null,"work_id":"fbb24c64-999d-42ae-b7cc-4ccba22944d9","year":2022},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:3476f0925be1a1671ebe02b73ac8a70b00272821605d10f579a1804215e78cb8","observation_id":"609d52f2-55cc-42eb-9e02-1bc93beec2c5","resolution":{"observed_at":"2026-05-11T17:23:25.479359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11706","last_updated":"2023-12-22T13:55:42Z","snapshot_observed_at":"2026-08-14T11:48:54.453482Z","submitted_at":"2023-06-20T17:35:20Z","title":"RoboCat: A Self-Improving Generalist Agent for Robotic Manipulation","version":2},"cited_work":{"arxiv_id":"2306.11706","doi":"10.48550/arxiv.2306.11706","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.11706","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robocat: A self-improving foundation agent for robotic manipulation","venue":"arXiv (Cornell University)","work_id":"143e7731-0488-4088-8e23-63f9d4140118","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"cited_paper":"/paper/2306.11706","citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:007210cab12875c0339a7cb4438c789655848e358cf78e9afc635b4cc798887a","observation_id":"ac657101-c05f-4144-ba2d-a754b9ae6e00","resolution":{"observed_at":"2026-05-11T17:23:24.502341Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03719","last_updated":"2023-07-07T17:21:16Z","snapshot_observed_at":"2026-08-14T22:42:13.750686Z","submitted_at":"2023-07-07T17:21:16Z","title":"Polybot: Training One Policy Across Robots While Embracing Variability","version":1},"cited_work":{"arxiv_id":"2307.03719","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.03719","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Polybot: Training one policy across robots while embracing variability","venue":null,"work_id":"a27d94d3-da73-4c82-bc9f-65dfac1f8eb6","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"cited_paper":"/paper/2307.03719","citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:bbf3301fb5f38eeb84cef5d89b17b3eeefe2b1798ca17fd175db1186db34a5ac","observation_id":"ee13515e-386a-4381-90e1-f5c5d59ded4f","resolution":{"observed_at":"2026-05-11T17:23:24.510240Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A generalist agent","venue":null,"work_id":"a9c8de1c-b3c8-48f6-910b-76bfdd11b59b","year":2022},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:bc1e8c8f5bf78ce3ed038d7a71d097b9d354745cd2806db47174e79ca907586c","observation_id":"d086bec7-9725-4bef-8e1d-d18db97a0ade","resolution":{"observed_at":"2026-05-11T17:23:25.489347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03833","last_updated":"2023-10-30T02:13:12Z","snapshot_observed_at":"2026-08-14T04:01:47.086274Z","submitted_at":"2023-04-07T20:21:47Z","title":"Learning Robot Manipulation from Cross-Morphology Demonstration","version":2},"cited_work":{"arxiv_id":"2304.03833","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.03833","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bridging action space mismatch in learning from demonstra- tions","venue":null,"work_id":"65136fac-1d0d-46ef-aa6e-7db17c80d311","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"cited_paper":"/paper/2304.03833","citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:fef4f4387761b4ec66e42228c6d6835d28dcd588221af030299d10702605f5e1","observation_id":"b5d16cdc-65a5-4994-8713-2146f96c1565","resolution":{"observed_at":"2026-05-11T17:23:24.555892Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robot learning with sensorimotor pre- training","venue":null,"work_id":"f1f937c4-615e-4798-9c42-425b2fdbc27b","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:751ed5ba37cce16aa6cfb09d4b6c8f929efebdb2945a9357b77c7d1121e314f6","observation_id":"8cda9149-1382-4344-8782-576644880ec0","resolution":{"observed_at":"2026-05-11T17:23:25.493582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"UniGrasp: Learning a unified model to grasp with multifingered robotic hands","venue":null,"work_id":"a40f8704-aff6-49df-956b-b27e770a6af6","year":2020},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:1f12ec42a0c018d1482c465a2a0c2d780b905b0b79565c3a8083beb66f38f605","observation_id":"c7096806-2444-419f-a6b1-fb71cfb4c5ef","resolution":{"observed_at":"2026-05-11T17:23:24.562371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adagrasp: Learning an adaptive gripper-aware grasping policy","venue":null,"work_id":"5c59a50f-2bbe-4dba-8f5a-7f59020c0021","year":2021},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:26152b3fa257246cb09180b5e0df048f83e531492827f39839df91bf6332675e","observation_id":"7acaa36d-dfc0-48aa-8218-cd548b43b9dc","resolution":{"observed_at":"2026-05-11T17:23:24.575344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ViNT: A Foun- dation Model for Visual Navigation","venue":null,"work_id":"fc17ceaa-ab3d-4218-856d-51324ee63e72","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:f78fa8b9b2abdc4fa8971a2d13dbd62415ee0286cf5ea2e3ad58b03210119c68","observation_id":"63092245-52f5-4427-94d4-2de2608ab564","resolution":{"observed_at":"2026-05-11T17:23:24.581513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imitation from observation: Learning to imitate behaviors from raw video via context translation","venue":null,"work_id":"4ccb966e-58d8-4617-9522-58f0e1ab69e5","year":2018},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:647807c377d1f16f20dfe1ea0dd5959dc69bde81e03f1fdd14e10e19a01fb61b","observation_id":"dff2cf2c-fbfa-4e0d-aa82-b46ecb03fdcf","resolution":{"observed_at":"2026-05-11T17:23:24.589340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"One-shot imitation from observing hu- mans via domain-adaptive meta-learning","venue":null,"work_id":"7bb4d30a-14b5-4c86-a5fe-13c723c63901","year":2018},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:38b6e5e2effd1851e08d62469e0853e2dedd7b94bb9aa643f375650e46427914","observation_id":"7306f865-d9e9-4f6f-a10d-ac0911fd5896","resolution":{"observed_at":"2026-05-11T17:23:24.601478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Third-person visual imitation learning via decoupled hierarchical controller","venue":null,"work_id":"c03446d6-1131-4a4f-8fcf-a0f768037a67","year":2019},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:ff437eb42bb2751c8be775e4b6c63a5fb60a2e14f5f9132ae7f27999c1e867fd","observation_id":"65a60041-8ef4-430e-b4e7-f74f396f7df3","resolution":{"observed_at":"2026-05-11T17:23:24.605973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.04443","last_updated":"2020-06-21T20:16:28Z","snapshot_observed_at":"2026-07-06T08:43:17.319793Z","submitted_at":"2019-12-10T01:36:18Z","title":"AVID: Learning Multi-Stage Tasks via Pixel-Level Translation of Human Videos","version":3},"cited_work":{"arxiv_id":"1912.04443","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1912.04443","snapshot_observed_at":"2026-07-02T02:26:26.937662Z","title":"Avid: Learning multi-stage tasks via pixel-level translation of human videos","venue":null,"work_id":"c0825d84-9e71-4705-90da-50d016ea05a0","year":1912},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"cited_paper":"/paper/1912.04443","citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:aa1567666b2de5edae0bf01884f8c7d2ce132888c280f06e8efa2556138eaca9","observation_id":"1bf7b9b3-80c1-40ef-b636-f8128555e79f","resolution":{"observed_at":"2026-05-11T17:23:24.368656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning one-shot imitation from humans without humans","venue":null,"work_id":"6494770d-2427-4bde-9c72-25e7b4835cd9","year":2020},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:9c5df6b49fa7d2d08a4a63781507f9a268c4f7a3c20c807fb103792087316339","observation_id":"6a199127-0ab8-4544-a931-9dd241b28175","resolution":{"observed_at":"2026-05-11T17:23:24.624400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement learning with videos: Combining offline observations with interaction","venue":null,"work_id":"18b4be4b-146d-4ba0-bdb0-c557cac0ac0e","year":2021},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:d850393baf44c31f54087f7f061caf7d02d250bfb5c6cdbe8a436b97ce895f41","observation_id":"a4a636ee-121d-45ae-b678-369d3788bd73","resolution":{"observed_at":"2026-05-11T17:23:24.632494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning by watching: Physical imita- tion of manipulation skills from human videos","venue":null,"work_id":"ac5d764d-98bb-4158-b270-c0bb4d2dcc94","year":2021},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:82176ee5ee6ca51860c07b380b2400350771953feebbccedc79b04bbe975c9d4","observation_id":"2b67cee3-9ed9-4647-9515-1fc2e9f77dd5","resolution":{"observed_at":"2026-05-11T17:23:24.640673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"BC-Z: Zero-shot task generalization with robotic imitation learning","venue":null,"work_id":"3d952886-e46d-4ef5-9195-af2fa72ab6a1","year":2021},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:2c6bd19beb5a404c1606ea883f0015930d3185f2c6712327827882f8d586660a","observation_id":"d1e26d8c-446f-4d81-a97e-4387551c17aa","resolution":{"observed_at":"2026-05-11T17:23:24.650034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Human-to-robot imitation in the wild","venue":null,"work_id":"99cf0870-6f83-4c44-ac35-8eb5e9c74019","year":2022},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:2366d9f20e58143691e75396422e93d2991810a17c7739c584a95e32c8c7ebed","observation_id":"77b5b7fd-950f-4bd5-8499-84e465026f9c","resolution":{"observed_at":"2026-05-11T17:23:24.670294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Embodied concept learner: Self-supervised learning of concepts and map- ping through instruction following","venue":null,"work_id":"a7077aca-40d1-4cae-8ae1-72099d39fe6f","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:3439902b75f3defe848e0cc39acf107411bf6b78083b6cb40aa6f1465f9b7bfa","observation_id":"b3b65d28-24a7-45dd-b51d-8916de2f8204","resolution":{"observed_at":"2026-05-11T17:23:24.684692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Affordances from human videos as a versatile representation for robotics","venue":null,"work_id":"9f88ca07-06f0-46c1-bc9a-52b341c3628b","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:9f40f512a640fb17e62ad27f27d0f79853d64a40570d96c1fdd56e7a43d42355","observation_id":"772a72e5-64a2-48a3-b02d-1428ed601070","resolution":{"observed_at":"2026-05-11T17:23:24.695603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1612.06699","last_updated":"2017-06-12T21:38:17Z","snapshot_observed_at":"2026-08-14T21:24:31.642902Z","submitted_at":"2016-12-20T15:04:38Z","title":"Unsupervised Perceptual Rewards for Imitation Learning","version":3},"cited_work":{"arxiv_id":"1612.06699","doi":null,"metadata_source":"pith","pith_arxiv_id":"1612.06699","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unsupervised Perceptual Rewards for Imitation Learning","venue":"cs.CV","work_id":"2ae227e1-f622-44d7-a6ba-f6160cfb2106","year":2016},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"cited_paper":"/paper/1612.06699","citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:a7856538cea56a42fa0714442fc02419b7241964d904654afa0ff06b98b40793","observation_id":"1dd3560f-ac81-43b2-8ba2-79fb22f5ee07","resolution":{"observed_at":"2026-05-11T17:23:24.401377Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Concept2Robot: Learning manipulation con- cepts from instructions and human demonstrations","venue":null,"work_id":"aaef6c1f-80e2-4420-a471-1a00979a1551","year":2020},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:66a9ef1b7035d9386114e8924da65d9462a47e5b61d87e2c38fa0e75528d339d","observation_id":"c74f9780-ce7b-43c2-970f-f050aef08eaa","resolution":{"observed_at":"2026-05-11T17:23:24.704340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.16817","last_updated":"2021-03-31T05:25:05Z","snapshot_observed_at":"2026-08-13T19:48:36.525105Z","submitted_at":"2021-03-31T05:25:05Z","title":"Learning Generalizable Robotic Reward Functions from \"In-The-Wild\" Human Videos","version":1},"cited_work":{"arxiv_id":"2103.16817","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2103.16817","snapshot_observed_at":"2026-07-04T09:59:44.567814Z","title":"Learning generalizable robotic reward functions from” in-the-wild” human videos.arXiv preprint arXiv:2103.16817","venue":null,"work_id":"01177b56-50d1-4b53-8d24-b3f2b8e7809d","year":2021},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"cited_paper":"/paper/2103.16817","citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:bfab84567b2aac57e58e8ea90daf1dd3d7e0b2468cf07d56c3646b646bb5b10c","observation_id":"d34ae0ed-cb99-4719-b501-f14ba59a4359","resolution":{"observed_at":"2026-05-11T17:23:24.495456Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Graph inverse reinforcement learning from diverse videos","venue":null,"work_id":"848b0ae4-696f-4e76-a2c4-aef737c0f984","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:9b7b0e96ce696a73a9de56db2812a9fe93029b5c4087e71c6a9ee2b6976bcba3","observation_id":"2a9bbafe-b871-4ffb-adf1-26c5e9a697a9","resolution":{"observed_at":"2026-05-11T17:23:24.715380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning reward functions for robotic manipulation by observing humans","venue":null,"work_id":"08164af9-a04c-4949-9a52-5c7a0e80bd73","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:6f4e1608644de173f651e1f1f593f33ef0e31868b2294a02e67ea1b26b75e7c8","observation_id":"82892d69-99eb-463b-b7d2-52a333e9c95b","resolution":{"observed_at":"2026-05-11T17:23:24.728968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Manipulator- independent representations for visual imitation","venue":null,"work_id":"b58362ef-60d0-4e10-b2ea-c1de6c49824e","year":2021},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:a3d7db32fd79a7c0a9f1d58b022d8047eb9c9cf5449b59cf527e26a08b3db3dc","observation_id":"97e832bc-b590-4337-8f3d-64e4d8912d12","resolution":{"observed_at":"2026-05-11T17:23:24.744330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mimicplay: Long- horizon imitation learning by watching human play","venue":null,"work_id":"2af2a0da-4e3d-40af-87af-13b1620c7e82","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:72af01dc1d6adeaa54bc1354016a068ad29a115225a133c744c7463bf393d26e","observation_id":"e110446b-e4e5-4298-8e0b-b1198babd40c","resolution":{"observed_at":"2026-05-11T17:23:24.756943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning pre- dictive models from observation and interaction","venue":null,"work_id":"c9f67443-3bd1-4b84-91b9-88dd96717293","year":2020},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:2aba96c47241fc6691d127ef32e0ed50987f994e0bcafb8c6b1548b1776855ec","observation_id":"90667045-9f8c-4cc7-81b4-4adc4bce18a8","resolution":{"observed_at":"2026-05-11T17:23:24.763462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"R3m: A universal visual representation for robot manipulation","venue":null,"work_id":"213cb0e8-8473-48b1-9f52-4c61fbab6675","year":2022},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:517a537417653ce98797090eba2c9bd12761fcf722d248f40f09bc6350df5b68","observation_id":"4f7fe80e-4bdb-425d-a5c3-51e7fb936bb0","resolution":{"observed_at":"2026-05-11T17:23:24.766540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.06173","last_updated":"2022-03-11T18:58:10Z","snapshot_observed_at":"2026-08-13T19:02:29.844973Z","submitted_at":"2022-03-11T18:58:10Z","title":"Masked Visual Pre-training for Motor Control","version":1},"cited_work":{"arxiv_id":"2203.06173","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.06173","snapshot_observed_at":"2026-07-08T01:44:26.089441Z","title":"Masked visual pre-training for motor control","venue":"cs.CV","work_id":"87cf1bc9-a17c-4f06-8a24-80a4a1051a0b","year":2022},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"cited_paper":"/paper/2203.06173","citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:686efef2ead588945c8ea67d15ac232c447a41d4d9771c17001653938324fd5f","observation_id":"e78311b8-b38c-459f-9f01-d6327f5fcbfe","resolution":{"observed_at":"2026-05-11T17:23:24.375414Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Real-world robot learning with masked visual pre-training","venue":null,"work_id":"657604e0-15fd-48f3-9799-7d72a00afb8d","year":2022},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:53d82477914d95396a2d9389057c0d24c063b4750c184928915872eb287384ba","observation_id":"cfe39743-c96c-4cdd-b1b7-256ab78d4f28","resolution":{"observed_at":"2026-05-11T17:23:24.769413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00030","last_updated":"2023-03-07T02:29:59Z","snapshot_observed_at":"2026-08-11T15:42:16.204049Z","submitted_at":"2022-09-30T18:14:07Z","title":"VIP: Towards Universal Visual Reward and Representation via Value-Implicit Pre-Training","version":2},"cited_work":{"arxiv_id":"2210.00030","doi":"10.48550/arxiv.2210.00030","metadata_source":"pith","pith_arxiv_id":"2210.00030","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VIP: Towards Universal Visual Reward and Representation via Value-Implicit Pre-Training","venue":"cs.RO","work_id":"022de141-49ac-43d5-9667-e36913ec1950","year":2022},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"cited_paper":"/paper/2210.00030","citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:427ba472bd7f242cd48b51449e74128db65f5ac5d673261db3f937d818a17688","observation_id":"4196a696-dc19-40fa-a0aa-e3fb74bcf091","resolution":{"observed_at":"2026-05-15T04:42:52.948246Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18240","last_updated":"2024-02-01T19:42:05Z","snapshot_observed_at":"2026-08-13T12:12:10.041373Z","submitted_at":"2023-03-31T17:56:33Z","title":"Where are we in the search for an Artificial Visual Cortex for Embodied Intelligence?","version":2},"cited_work":{"arxiv_id":"2303.18240","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.18240","snapshot_observed_at":"2026-07-03T18:08:46.879474Z","title":"Majumdar, K","venue":null,"work_id":"a30a45a3-bdd7-45bf-a4f4-66d48e56bd4a","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"cited_paper":"/paper/2303.18240","citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:24f88a427a566c5687208abb951edec373b82a33638906016e0b2d576cf37760","observation_id":"299f12b5-75c4-4836-aa6e-882dcc6a1fbc","resolution":{"observed_at":"2026-05-11T17:23:24.436766Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language-driven represen- tation learning for robotics","venue":null,"work_id":"bbe887ed-ccb4-4cda-9926-d1d9bcd0e1eb","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:b892f64d19713e99b9fbf133d6137a535b6b0b5310e831592e4ec11816e08666","observation_id":"827ed74b-4461-4d8c-83a1-64eef09dc05b","resolution":{"observed_at":"2026-05-11T17:23:24.774685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"EC2: Emergent communication for embodied control","venue":null,"work_id":"8f7ab13f-66dc-448f-b934-1f0f0bc609c6","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:bd25614e56e89f23c859870c3af567b3d582eecbd85faa3d81910bd83a98f11e","observation_id":"0193285f-9a48-4a32-a727-5eb1618e7488","resolution":{"observed_at":"2026-05-11T17:23:24.780187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T23:03:00.417230Z","title":"Affordances from human videos as a versatile representation for robotics","venue":null,"work_id":"975abee0-bd7f-48de-ae7b-fe8377f6d6a0","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:d3a8bf5a6b917827c5cf7150eeae0e43eecf3fb7f82383e5013c825d3a499dfd","observation_id":"245a2bcf-2d9a-4378-a906-076da6fa1e7b","resolution":{"observed_at":"2026-05-11T17:23:24.785369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient grasping from RGBD images: Learning using a new rectangle representation","venue":null,"work_id":"484fac5b-fa73-4c1a-87ba-e1c62f8ad1c2","year":2011},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:00df4de7d4c745d4b51dd2bc98c94187def9f464dc772ed15281b351df8efe8a","observation_id":"f534b952-bb41-40d9-b5c7-014f34898407","resolution":{"observed_at":"2026-05-11T17:23:24.788626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Supersizing self- supervision: Learning to grasp from 50k tries and 700 robot hours","venue":null,"work_id":"4d623d98-438a-49a7-95c0-8f48eb2edaf3","year":2016},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:80bc50089b9d862455e67d0bc2fed6fdefc580d3417f4f0ea636bd1c5a27f1a0","observation_id":"67f13fbb-9dc3-4d9e-ad02-b807495f7857","resolution":{"observed_at":"2026-05-11T17:23:24.793057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Leveraging big data for grasp planning","venue":null,"work_id":"b7e17721-a511-4ffb-aa32-f93fcf4499ed","year":2015},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:c6086f78f35b3b540a2f5729943b55660a87480772568cf1b22cd7abc3f20f07","observation_id":"36f6c061-7c65-4c93-a0d8-a121b8ce870a","resolution":{"observed_at":"2026-05-11T17:23:24.800970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dex-Net 2.0: Deep learning to plan robust grasps with synthetic point clouds and analytic grasp metrics","venue":null,"work_id":"62ab4805-aff2-4781-8ca8-e203aaa049ae","year":2017},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:4c2676b9fd218e30ff3b2f5c7efaf349010e6d8058089157feeb002ff971050f","observation_id":"a8ee9c88-7e59-4de8-8a21-fb9259b75e9b","resolution":{"observed_at":"2026-05-11T17:23:24.806886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jacquard: A large scale dataset for robotic grasp detection","venue":null,"work_id":"a0401174-1cfc-4e58-8b5a-b70d1fad7c99","year":2018},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:97a6854bdf7401ad09a46414acfc016e2150d2d8db741f65f6171be17e78610a","observation_id":"80fc3d7d-2a9f-4cab-89c0-ecbb02afe9c8","resolution":{"observed_at":"2026-05-11T17:23:24.810379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning hand-eye coordination for robotic grasping with deep learning and large-scale data collection","venue":null,"work_id":"b4475a91-fefc-4a48-a8ca-21f33e5e9555","year":2018},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:5476835c2a8f35ae800431be107cf27d537c562b564377e7e8e51258878b6c4d","observation_id":"cb5891a4-90fa-4072-97f8-b8ac4539f647","resolution":{"observed_at":"2026-05-11T17:23:24.823775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.10293","last_updated":"2018-11-28T02:40:54Z","snapshot_observed_at":"2026-08-14T18:58:45.167151Z","submitted_at":"2018-06-27T04:34:30Z","title":"QT-Opt: Scalable Deep Reinforcement Learning for Vision-Based Robotic Manipulation","version":3},"cited_work":{"arxiv_id":"1806.10293","doi":"10.48550/arxiv.1806.10293","metadata_source":"pith","pith_arxiv_id":"1806.10293","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"QT-Opt: Scalable Deep Reinforcement Learning for Vision-Based Robotic Manipulation","venue":"cs.LG","work_id":"9a64fd9b-aa3d-48af-ac99-b368b857a6e0","year":2018},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"cited_paper":"/paper/1806.10293","citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:b69055ee6410a5f913104280aba193ef3789cf221b4289ceb38419aa1cd794f9","observation_id":"840759de-2a17-442a-beb3-3abaa9eb7c1b","resolution":{"observed_at":"2026-05-11T17:23:24.391566Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Contactdb: Analyzing and predicting grasp contact via thermal imaging","venue":null,"work_id":"e9de69d5-6cb0-4300-b336-745baf7fdb5e","year":2019},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:5bd137115e43312c93919decc35d87ea99f3631544a4632cb804ab7410b1d810","observation_id":"6627b929-1eec-4887-acca-adf33f4a0a6c","resolution":{"observed_at":"2026-05-11T17:23:24.836357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Graspnet- 1billion: a large-scale benchmark for general object grasping","venue":null,"work_id":"97c541ed-9693-4e17-a5c3-8e00c9f7111c","year":2020},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:f797d61922fbc6e722dd51510f5fef94ace2e8af546b1fa21b49e6ef33459a91","observation_id":"52a58244-474b-4bb2-a20b-e389bb863df5","resolution":{"observed_at":"2026-05-11T17:23:24.843091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ACRONYM: A large-scale grasp dataset based on simulation","venue":null,"work_id":"176b5bfb-885e-403e-90c3-2132a2f94e4b","year":2021},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:7759bf1c6fc63367f6105c04cccf593ca2d29815766b0b7dc982152b02018007","observation_id":"51bc938c-a0be-47e2-bb1b-010c1958858a","resolution":{"observed_at":"2026-05-11T17:23:24.849388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Using simulation and domain adaptation to improve effi- ciency of deep robotic grasping","venue":null,"work_id":"ad533e66-135b-48e4-a709-221c3e374205","year":2018},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:d21f69968a01c11264d05b1321d41ae3cb758c83c94cf7cf0bd3419a22d34d2b","observation_id":"3b086b0e-72db-4cbb-8819-044967c239c2","resolution":{"observed_at":"2026-05-11T17:23:24.866689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fanuc manipulation: A dataset for learning-based manipulation with fanuc mate 200iD robot","venue":null,"work_id":"e36f6dc0-7de3-4766-a600-e44a67520709","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:536be98e972a3e557e2b966e495e82e8a94dad2b6bce611859c725d65cdb4931","observation_id":"4f4821c8-f581-417e-8c6d-00d0e083ddd7","resolution":{"observed_at":"2026-05-11T17:23:24.877352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"More than a million ways to be pushed. a high- fidelity experimental dataset of planar pushing","venue":null,"work_id":"23a5a851-3537-4f8d-8a56-de9f50931346","year":2016},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:c9beff1574c4f4d27a9a4205cde227b337884786074443b94a184b5f6545cacd","observation_id":"d841ae6a-5674-4604-9f82-ef584030555c","resolution":{"observed_at":"2026-05-11T17:23:24.886384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep visual foresight for plan- ning robot motion","venue":null,"work_id":"9564e9a6-3fb2-4ce6-a265-382a88bca271","year":2017},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:2f8f29bcf1c3fda0806c3ee76aea9c8361ff635639c36810b627198f53865e47","observation_id":"85e34e92-e2d7-4b41-9188-634681667482","resolution":{"observed_at":"2026-05-11T17:23:24.890901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.00568","last_updated":"2018-12-03T06:06:25Z","snapshot_observed_at":"2026-08-14T17:49:43.679003Z","submitted_at":"2018-12-03T06:06:25Z","title":"Visual Foresight: Model-Based Deep Reinforcement Learning for Vision-Based Robotic Control","version":1},"cited_work":{"arxiv_id":"1812.00568","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.00568","snapshot_observed_at":"2026-07-04T06:49:37.964200Z","title":"Visual Foresight: Model-Based Deep Reinforcement Learning for Vision-Based Robotic Control","venue":"cs.RO","work_id":"4e0d30bd-36e6-464f-84b3-1e5f4f95cb7d","year":2018},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"cited_paper":"/paper/1812.00568","citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:5b53580ee31d43765930541785ed1fb28586ffc76964e62828eb581b597d0139","observation_id":"b5228cd2-17e7-462e-a504-f0784a9dcccc","resolution":{"observed_at":"2026-05-11T17:23:24.540735Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The princeton shape benchmark","venue":null,"work_id":"99750433-87cf-42bf-ab44-e709848367ad","year":2004},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:379e5abb9b40fef6ff849ea9e9c47ce7be73ff8150f321c634ac6eb95dd504ab","observation_id":"91e5efe1-aed9-4c8d-8ef4-19bb1152ea60","resolution":{"observed_at":"2026-05-11T17:23:24.894597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3DNet: Large-Scale Object Class Recog- nition from CAD Models","venue":null,"work_id":"193070b0-4864-4b65-860e-135361b3cc17","year":2012},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:12602cb8b74dd4118adf752e2a9e18d907690e8dcf250007b245d5e7c8fde6ae","observation_id":"88a0af93-b674-4991-9561-3956ccd979d5","resolution":{"observed_at":"2026-05-11T17:23:24.898780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The kit object models database: An object model database for object recognition, localization and manipulation in service robotics","venue":null,"work_id":"8cad5738-575d-4421-af40-f2566d960d24","year":2012},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:2cac6e0ae9729e92eb986eaf6829275beb8f893753f3a755e585c54ab463d901","observation_id":"9b9fe5d0-d34e-42ac-b310-cdd6a4a11540","resolution":{"observed_at":"2026-05-11T17:23:24.904978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"BigBIRD: A large-scale 3D database of object instances","venue":null,"work_id":"7cf7a38c-3107-4fc2-b2e5-81314cd1245e","year":2014},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:76d4ba9615ea05887fcc87fc9dd0fabd5a3cc3b9cd83a905d9e47b48412837c7","observation_id":"1918c4ab-b414-41f2-90ff-ac67673d2696","resolution":{"observed_at":"2026-05-11T17:23:24.911481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Benchmarking in ma- nipulation research: Using the Yale-CMU-Berkeley object and model set","venue":null,"work_id":"feb6780c-8a3c-4680-b365-1893a8eea6a4","year":2015},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:cc0064a6992a6f43afc8af0fa77950e3ede36187f15410288a1b03e40670f01b","observation_id":"e1fab1d1-b90a-40e1-ada8-ed0b7c935524","resolution":{"observed_at":"2026-05-11T17:23:24.915493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3D ShapeNets: A deep representation for volumetric shapes","venue":null,"work_id":"dbf708e7-ca84-4426-aaee-1e8d8bec0c8a","year":2015},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:5e0ab4930be79e091dfaca54aa13a0166f967938e95c7299b0e29f7327269f81","observation_id":"57ed415d-450b-4680-8821-0f4d33a01516","resolution":{"observed_at":"2026-05-11T17:23:24.922386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Object- Net3D: A large scale database for 3d object recog- nition","venue":null,"work_id":"c20aed2b-e34b-497e-bb03-fd73b43446f2","year":2016},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:c2e24de8184d52c44b101af04eaca914937cf33c0f37a7f685d842228dc322dd","observation_id":"2b8bc9d2-21a3-4345-986b-f1e2eeced206","resolution":{"observed_at":"2026-05-11T17:23:24.928330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Egad! an evolved grasping analysis dataset for diversity and re- producibility in robotic manipulation","venue":null,"work_id":"6df5d14f-2298-439c-baa2-6dd65e5ae237","year":2020},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:056704db8b56b100c908b16f20cdf897f4e83016c88b0eeb35f7f22fe6ad0a18","observation_id":"3ad7a0c2-979f-44f5-9a38-641e23652a57","resolution":{"observed_at":"2026-05-11T17:23:24.934972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ObjectFolder: A dataset of objects with implicit vi- sual, auditory, and tactile representations","venue":null,"work_id":"d161ca96-f7b1-46fb-b69f-0d5d075fafe7","year":2021},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:574254bed571ebf97b81340d14209080d8458550da8613d7e2fbba82f37d14b2","observation_id":"43ff5d5a-5b5d-415d-8c75-2ec8009d34dd","resolution":{"observed_at":"2026-05-11T17:23:24.938743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Google scanned objects: A high-quality dataset of 3D scanned household items","venue":null,"work_id":"85786ec6-1787-46d6-a9b4-a351bb8f77d6","year":2022},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:2fe11eb370fdf04e42b1241f6ecc167ffa4009f69841cf970251ebf7a6efb07e","observation_id":"53585562-50bb-4e02-ac55-9ee85fb6edb6","resolution":{"observed_at":"2026-05-11T17:23:24.944355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08212","last_updated":"2021-04-27T20:06:33Z","snapshot_observed_at":"2026-08-13T19:38:35.034727Z","submitted_at":"2021-04-16T16:38:02Z","title":"MT-Opt: Continuous Multi-Task Robotic Reinforcement Learning at Scale","version":2},"cited_work":{"arxiv_id":"2104.08212","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.08212","snapshot_observed_at":"2026-07-04T06:19:37.558783Z","title":"Mt-opt: Continuous multi-task robotic reinforcement learning at scale","venue":null,"work_id":"d4b61039-1d94-42db-8c6d-4c49c037e711","year":2021},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"cited_paper":"/paper/2104.08212","citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:b36eb9d0719e5744c5262ef1802b2ec4e38ceae779c728c52c0eb40f8730104d","observation_id":"d78f595e-68fc-4867-be40-1694a013e525","resolution":{"observed_at":"2026-05-11T17:23:24.468830Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.02790","last_updated":"2018-11-07T08:01:21Z","snapshot_observed_at":"2026-08-14T18:02:56.589766Z","submitted_at":"2018-11-07T08:01:21Z","title":"RoboTurk: A Crowdsourcing Platform for Robotic Skill Learning through Imitation","version":1},"cited_work":{"arxiv_id":"1811.02790","doi":null,"metadata_source":"pith","pith_arxiv_id":"1811.02790","snapshot_observed_at":"2026-07-04T11:29:50.833627Z","title":"RoboTurk: A Crowdsourcing Platform for Robotic Skill Learning through Imitation","venue":"cs.RO","work_id":"24d36e56-dc83-4a5f-a941-54481ba1bd2c","year":2018},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"cited_paper":"/paper/1811.02790","citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:be86d9bcc3df2d96ec804c424b60ac8489d36e4acb452fbe47652dc1921678f4","observation_id":"963e3228-cde9-4bca-a1b2-586f181d5ad0","resolution":{"observed_at":"2026-05-11T17:23:24.480096Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mul- tiple interactions made easy (MIME): Large scale demonstrations data for imitation","venue":null,"work_id":"0a2b593e-7068-41ca-81ed-781b9ae47ab0","year":2018},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:d88b30d29f1f683d821237e62eda5019a2c5129761d0b78dbb3e167ce2391f68","observation_id":"649058f0-0b6a-4298-a571-da257c71e85b","resolution":{"observed_at":"2026-05-11T17:23:24.948151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling robot supervision to hundreds of hours with RoboTurk: Robotic manipulation dataset through human reasoning and dexterity","venue":null,"work_id":"55169906-9e72-4807-b976-04d68e977ae9","year":2019},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:0fa2e189f9234db88df9cc8a6c0e9e687ed33bed0e126b670a26862cdc805fd1","observation_id":"834650d8-5fc1-4150-b991-74f5c7f21fa4","resolution":{"observed_at":"2026-05-11T17:23:24.957068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bridge data: Boosting generalization of robotic skills with cross-domain datasets","venue":null,"work_id":"948c3b96-ba5d-4583-8777-bc3f9637ad63","year":2022},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:dbe69f996fb72a7aea4f98c73291f9966252b3dd056d8d6f887b0046a41f43ba","observation_id":"896842e8-0349-42cb-aa98-27cc9280c59d","resolution":{"observed_at":"2026-05-11T17:23:24.970412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.03298","last_updated":"2021-09-25T00:37:01Z","snapshot_observed_at":"2026-08-14T11:25:08.505775Z","submitted_at":"2021-08-06T20:48:30Z","title":"What Matters in Learning from Offline Human Demonstrations for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2108.03298","doi":"10.48550/arxiv.2108.03298","metadata_source":"pith","pith_arxiv_id":"2108.03298","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"What Matters in Learning from Offline Human Demonstrations for Robot Manipulation","venue":"cs.RO","work_id":"6a4c95c5-540e-4854-946d-c7c8a6c540ba","year":2021},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"cited_paper":"/paper/2108.03298","citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:c337e4fc2c915cb60ea8dcb7f7c759501354d547283b5b0c31215c9d5af79d5a","observation_id":"67a09f27-7aed-42a2-a335-4a59b5400ef5","resolution":{"observed_at":"2026-05-13T08:51:56.162031Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interac- tive language: Talking to robots in real time","venue":null,"work_id":"da797044-2396-4c85-97a6-86835d897eeb","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:7e5c98f88387edd7e3224d4ef79e7e32a3f4edc0ae6c0e2e5379ad50c1e94a42","observation_id":"9b1ac0bd-4945-49e5-b07c-42ef57f0d261","resolution":{"observed_at":"2026-05-11T17:23:24.976971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"RH20T: A robotic dataset for learning diverse skills in one-shot","venue":null,"work_id":"caebf7f8-e11b-4fd8-ad00-87fe3452bd13","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:539c361964b951467a0300fabb9f020702561dac8b0ce43b073ae9780c19c830","observation_id":"8c4a981d-8c79-4f3d-a4f3-d0dac2d70de7","resolution":{"observed_at":"2026-05-11T17:23:24.980536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"RoboAgent: Towards sample efficient robot manipulation with semantic augmenta- tions and action chunking","venue":null,"work_id":"30a5832f-423c-45df-a5c3-2a04a93d7f58","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:c7e316f2c3eb4b57a4cdd3a6e958fcd3a00743182ab33a52a2eed7780e42c808","observation_id":"f83a5a5e-8a6e-42c6-a8de-86f059bb98e0","resolution":{"observed_at":"2026-05-11T17:23:24.987218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Furni- turebench: Reproducible real-world benchmark for long-horizon complex manipulation","venue":null,"work_id":"aef60982-ed99-4ae9-a26f-0facaaed12ad","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:b6f4b3f24eeccd6d5aa915624e7f76c3fe2c621b6aad8b468a1cd5f715197337","observation_id":"a9b9773b-88b2-4b25-90d7-131d60ff178f","resolution":{"observed_at":"2026-05-11T17:23:24.992238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bridgedata v2: A dataset for robot learning at scale","venue":null,"work_id":"81149388-9eeb-4f7b-bcc9-3a26a5d28309","year":2023},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:94e3b8e9381f05e1516b93b7c87ff8b33d6459435e8eaab22f1f584e9b70a5df","observation_id":"b90560f4-bb00-4291-88c1-1bbb0e879a39","resolution":{"observed_at":"2026-05-11T17:23:24.999359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Understanding natural language","venue":null,"work_id":"f7658bb5-62f5-49b8-8b1a-dc2d4a69d29f","year":null},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:ea4cf0411dcfe5d1214225808ecb683cbd16393d6fd61e36c13ce3cc19d77037","observation_id":"819deca4-19cf-4d50-a050-48aba796638b","resolution":{"observed_at":"2026-05-11T17:23:25.008011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"pii/0010028","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T11:35:42.842885Z","title":"Availability: A heuristic for judging frequency and probability","venue":null,"work_id":"cd0ea2ec-4e26-4a92-a9d6-ee07cc87350f","year":1987},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:5e24fc589871d0b506be64bc202468bc34ee332772e6cafc76d2f64ff01d2aee","observation_id":"2e4a7b9c-7498-42e3-a50d-c1e76c21a326","resolution":{"observed_at":"2026-05-11T17:23:24.380324Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Walk the talk: Connecting language, knowledge, and action in route instructions","venue":null,"work_id":"f008e6e5-73b3-4a66-91a9-ebe796438631","year":2006},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:ad20996278c880660269634a40e06bfcefa0ccb8088d8cd1d1ef82216dd6de47","observation_id":"ccdbff3f-7653-4482-b07e-f34f91e876d6","resolution":{"observed_at":"2026-05-11T17:23:25.012109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Toward understanding natural language directions","venue":null,"work_id":"fbf6c88a-99b0-42a4-820c-3e06c21858d3","year":2010},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:83190c354adc2a21bccb5483c6cf6d041ea208dbb372bdceeb3561847809e73e","observation_id":"6fa4df5d-3832-4a76-9943-99c1c5fa1c67","resolution":{"observed_at":"2026-05-11T17:23:25.016149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to interpret natural language navigation instructions from observa- tions","venue":null,"work_id":"72d4da5f-7d99-4d61-ae0d-87c2af3f0b51","year":2011},"citing_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-11T17:23:24.255829Z"},"links":{"citing_paper":"/paper/2310.08864"},"observation_digest":"sha256:38625fb361ab4d2b6e5cda2c3c7d6fee4ab2ebdaa4e0301892bbb6e4cc72ef88","observation_id":"668464c0-125c-4bea-8574-1667c02613e3","resolution":{"observed_at":"2026-05-11T17:23:25.020922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","latest_version":9,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":17,"verified_fuzzy":82},"total_outbound_references":135},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 100 of 135 outbound references and 100 inbound Pith citation observations for arXiv:2310.08864."}