{"as_of":"2026-08-10T01:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:64889b972a6a139f142a81de39dab3ca7b8b4365151b7034c48406cdfe81a9e9","coverage":[{"denominator":80,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":80,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T04:20:18.114193Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05674/citation-record","integrity":"/paper/2608.05674/integrity","json":"/paper/2608.05674/citation-record.json","paper":"/paper/2608.05674"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.09540","last_updated":"2023-03-22T17:22:35Z","snapshot_observed_at":"2026-08-06T15:07:40.203199Z","submitted_at":"2023-03-16T17:53:24Z","title":"SemDeDup: Data-efficient learning at web-scale through semantic deduplication","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09540","snapshot_observed_at":"2026-08-08T04:20:17.259542Z","title":"Semdedup: Data-efficient learning at web-scale through semantic deduplication.arXiv preprint arXiv:2303.09540, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.259542Z"},"links":{"cited_paper":"/paper/2303.09540","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:2f064e572e6203dbd8b236879b2d5031c75dd0c3adf33b883bb6d5358280e1b0","observation_id":"c6d40d33-a36c-48ab-bfdf-20ed7a5b93fa","resolution":{"observed_at":"2026-08-08T04:20:17.259542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06669","last_updated":"2025-08-04T04:50:21Z","snapshot_observed_at":"2026-08-04T23:08:22.516431Z","submitted_at":"2025-03-09T15:40:29Z","title":"AgiBot World Colosseo: A Large-scale Manipulation Platform for Scalable and Intelligent Embodied Systems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06669","snapshot_observed_at":"2026-08-08T04:20:17.265573Z","title":"Agibot world colosseo: A large-scale manipulation platform for scalable and intelligent embodied systems.arXiv preprint arXiv:2503.06669, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.265573Z"},"links":{"cited_paper":"/paper/2503.06669","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:61acb4f18059de47637baa0a16f611d433aaa91025dbfa97dfda2de738ebb23a","observation_id":"ffb24185-2136-4dfd-90b5-17f10d2c9957","resolution":{"observed_at":"2026-08-08T04:20:17.265573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09985","snapshot_observed_at":"2026-08-08T04:20:17.292790Z","title":"V-jepa 2: Self-supervised video models enable understanding, prediction and planning.arXiv preprint arXiv:2506.09985, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.292790Z"},"links":{"cited_paper":"/paper/2506.09985","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:5efb0b555e9a9fc6ec8115e96b05ca4168c28e57e77d7c20f620bbe483aa836c","observation_id":"721ae9f4-4df6-461b-bbbb-6b0262e2bf3c","resolution":{"observed_at":"2026-08-08T04:20:17.292790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13030","last_updated":"2025-12-25T08:16:05Z","snapshot_observed_at":"2026-07-06T22:38:59.725645Z","submitted_at":"2025-12-15T06:58:40Z","title":"Motus: A Unified Latent Action World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13030","snapshot_observed_at":"2026-08-08T04:20:17.319779Z","title":"Motus: A unified latent action world model.arXiv preprint arXiv:2512.13030, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.319779Z"},"links":{"cited_paper":"/paper/2512.13030","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:6dddd2d20852e60f96425a21f273632a7e9aeb1c8fe142af779104d020899e4c","observation_id":"8a46947c-82bf-44e0-bfea-ad0cb5565f05","resolution":{"observed_at":"2026-08-08T04:20:17.319779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-08T04:20:17.347473Z","title":"Gr00t n1: An open foundation model for generalist humanoid robots.arXiv preprint arXiv:2503.14734, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.347473Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:1437754b7079856ecb81664f168727c8de3b6e8f92fa9d17eccbc3ec692898b7","observation_id":"13f8b882-044e-4d1b-bfff-6d8f5828e5b0","resolution":{"observed_at":"2026-08-08T04:20:17.347473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-08T04:20:17.376394Z","title":"arXiv preprint arXiv:2410.24164, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.376394Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:72db03862fdd549b16307a53edf5832492bed763b27963e266f5f88c5ebea99e","observation_id":"8ae98c6b-2744-47e9-b1ee-28f53e4b4286","resolution":{"observed_at":"2026-08-08T04:20:17.376394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-08T04:20:17.405321Z","title":"Rt-1: Robotics transformer for real-world control at scale.arXiv preprint arXiv:2212.06817, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.405321Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:5ab8a8c4b73f3415bebf0167dbcdb1bf98e4e9b8092abefc851b6dae09430626","observation_id":"9c32cd87-1cab-4c45-bd17-7cc9dfc3c558","resolution":{"observed_at":"2026-08-08T04:20:17.405321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.598384Z","title":"Dennis, Ashley Edwards, Jack Parker-Holder, Yuge Shi, Edward Hughes, Matthew Lai, Aditi Mavalankar, Richie Steigerwald, Chris Apps, et al","venue":null,"work_id":"34583036-7e41-423e-806d-dce96d2b5275","year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.410700Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:87298d9001c6d36b869d0f330c7659513d2c0b97c4a3280a4ad7dec7a4e8abb4","observation_id":"24670e7b-91a9-43a3-86c4-e3b244b8d6ca","resolution":{"observed_at":"2026-08-08T04:20:19.603254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06111","last_updated":"2025-11-03T11:52:57Z","snapshot_observed_at":"2026-08-09T00:51:47.897197Z","submitted_at":"2025-05-09T15:11:13Z","title":"UniVLA: Learning to Act Anywhere with Task-centric Latent Actions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06111","snapshot_observed_at":"2026-08-08T04:20:17.415546Z","title":"Univla: Learning to act anywhere with task-centric latent actions.arXiv preprint arXiv:2505.06111, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.415546Z"},"links":{"cited_paper":"/paper/2505.06111","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:4140c830e5e006856433818e21e7327415ee66829dddeef8eca3982c0741f5e6","observation_id":"31f4f47e-a8c3-41bc-bf7b-724a234e8249","resolution":{"observed_at":"2026-08-08T04:20:17.415546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.583321Z","title":"Egocentric-100k, 2025","venue":null,"work_id":"3aa8b66a-9c1c-427f-8f18-e6c7e3561c95","year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.421097Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:4cd67d6a6321d2afeb9662eb1f709d2d5005b4b1dc25ade48557fb82942d6a32","observation_id":"b73ea498-3bb7-43f4-930f-b8fc3c3e2dc3","resolution":{"observed_at":"2026-08-08T04:20:19.588260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.567389Z","title":"Orb-slam3: An accurate open-source library for visual, visual–inertial, and multimap slam.IEEE transactions on robotics, 37(6): 1874–1890, 2021","venue":null,"work_id":"56d6cc8b-5145-4c7c-9c3f-1f3c07c69328","year":2021},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.425782Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:d096bfd0ba9b25ea65e3c092932a59ec419dd81c2bea82ba070f501a5fc4ca2f","observation_id":"aa93645c-2c4f-454d-b981-b08171337661","resolution":{"observed_at":"2026-08-08T04:20:19.572603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:17.430562Z","title":"Emerging properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.430562Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:729672d1d1c94ec730b446cd65a3f7c6834512aeb7d0a7fb1542653a6f43611f","observation_id":"8f1b3314-28cd-4af7-ad0c-390c3519f802","resolution":{"observed_at":"2026-08-08T04:20:17.430562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21539","last_updated":"2025-06-26T17:55:40Z","snapshot_observed_at":"2026-08-07T12:15:14.265779Z","submitted_at":"2025-06-26T17:55:40Z","title":"WorldVLA: Towards Autoregressive Action World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21539","snapshot_observed_at":"2026-08-08T04:20:17.435194Z","title":"Worldvla: Towards autoregressive action world model.arXiv preprint arXiv:2506.21539, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.435194Z"},"links":{"cited_paper":"/paper/2506.21539","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:67aea62d8cc6fd0ee0ff88b6eee0bb82e81d7976ed304fc0770e05cf2ce95543","observation_id":"80515d3a-d747-4831-a1b6-a5338f3a7438","resolution":{"observed_at":"2026-08-08T04:20:17.435194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19249","last_updated":"2024-09-09T03:06:57Z","snapshot_observed_at":"2026-08-09T21:54:16.978187Z","submitted_at":"2024-02-29T15:22:17Z","title":"Mirage: Cross-Embodiment Zero-Shot Policy Transfer with Cross-Painting","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19249","snapshot_observed_at":"2026-08-08T04:20:17.440001Z","title":"Mirage: Cross-embodiment zero-shot policy transfer with cross-painting.arXiv preprint arXiv:2402.19249, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.440001Z"},"links":{"cited_paper":"/paper/2402.19249","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:c4318ff47519309736d5f515ffb8bb80e13db73c8979c70a02f03ccfa87b9276","observation_id":"716aa8d5-1370-4c20-8bb7-a0f5b4d68207","resolution":{"observed_at":"2026-08-08T04:20:17.440001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:17.444923Z","title":"Moto: Latent motion token as the bridging language for learning robot manipulation from videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.444923Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:efcdc2d4445ba66f18a1642da18ca6fda750c661651236e8b455f05a26008acd","observation_id":"91ac49c7-f39c-4284-a055-45e07e72874f","resolution":{"observed_at":"2026-08-08T04:20:17.444923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:17.449306Z","title":"Rescaling egocentric vision: Collection, pipeline and challenges for epic-kitchens-100.International Journal of Computer Vision, 130:33–55, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.449306Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:4b2c60b1214d6d7850360bef2048d94a10ef9c39e608371fcec5e6cf8bba6e0e","observation_id":"ee7d9eb6-1138-4f80-b461-5e64528d49d3","resolution":{"observed_at":"2026-08-08T04:20:17.449306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.531841Z","title":"Video language planning","venue":null,"work_id":"d570c7a9-1b9e-4721-97fe-8761833905ad","year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.454126Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:e42535aed87625c49f425f7556fecfa8f1848c79eb5a0a73fdaf295116f43260","observation_id":"645db272-770a-4ebe-8f57-0426f8644a29","resolution":{"observed_at":"2026-08-08T04:20:19.536611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.06949","last_updated":"2026-02-06T18:49:43Z","snapshot_observed_at":"2026-07-06T22:44:51.126114Z","submitted_at":"2026-02-06T18:49:43Z","title":"DreamDojo: A Generalist Robot World Model from Large-Scale Human Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.06949","snapshot_observed_at":"2026-08-08T04:20:17.459118Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.459118Z"},"links":{"cited_paper":"/paper/2602.06949","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:605cfe80235206f734ade05b633b1eee00ad5d1f38d844b2cbb3fc5871ceef1c","observation_id":"f0b5aba7-c0a0-46ac-b429-ae57247c91a0","resolution":{"observed_at":"2026-08-08T04:20:17.459118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:17.463745Z","title":"Ego4d: Around the world in 3,000 hours of egocentric video","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.463745Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:abf51a3e0d90df5b7f34330db49037f7eac6870732441f1943a2f61ef1fb593a","observation_id":"8de8c896-699d-405d-8c7a-d2b608ad8e81","resolution":{"observed_at":"2026-08-08T04:20:17.463745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.506743Z","title":"Ego-exo4d: Un- derstanding skilled human activity from first- and third-person perspectives","venue":null,"work_id":"aa513d4f-fd30-4162-9fd2-8608f3f30b8f","year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.468217Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:a3e30d8e191972bf26794b1886ad624570eb23b342963414c756d2e2e62c2bcc","observation_id":"11a84cdf-8427-4d45-bacd-aed56f77fb31","resolution":{"observed_at":"2026-08-08T04:20:19.511385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.493116Z","title":"Prediction with action: Visual policy learning via joint denoising process","venue":null,"work_id":"1967e58f-c037-4cca-810d-ca9e6a215716","year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.472516Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:adbe01068fdba37c90e6d2fe086fb1c970078c73b314260c8f1691638f49863b","observation_id":"806eb031-ca14-46bd-9f85-a381988c4673","resolution":{"observed_at":"2026-08-08T04:20:19.497421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-08T04:20:17.476950Z","title":"Mastering diverse domains through world models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.476950Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:7aedbade91aba96cdab123f3f8a2d660935fccad7f9d0319cea1ccb472d3f477","observation_id":"f6bf58b0-c10d-4373-8062-2a1f7f34cecf","resolution":{"observed_at":"2026-08-08T04:20:17.476950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11709","last_updated":"2026-03-09T06:44:42Z","snapshot_observed_at":"2026-07-06T21:25:23.371749Z","submitted_at":"2025-05-16T21:34:47Z","title":"EgoDex: Learning Dexterous Manipulation from Large-Scale Egocentric Video","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11709","snapshot_observed_at":"2026-08-08T04:20:17.481561Z","title":"Egodex: Learning dexterous manipulation from large-scale egocentric video.arXiv preprint arXiv:2505.11709, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.481561Z"},"links":{"cited_paper":"/paper/2505.11709","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:df74d48530befd1e414d584de718db6e49966d51026f3a7559683e1a3942cf27","observation_id":"90851362-bed0-4675-8750-10ce35cd6849","resolution":{"observed_at":"2026-08-08T04:20:17.481561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:17.486347Z","title":"Robomind 2.0: A multimodal, bimanual mobile manipulation dataset for generalizable embodied intelligence","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.486347Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:4225f5c38df8c891a5a19393782dc2f1a08dbeb56e89e351e739605d17497120","observation_id":"dc57ed6d-da16-499a-aa25-91ec782c4dcd","resolution":{"observed_at":"2026-08-08T04:20:17.486347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14803","last_updated":"2025-05-04T04:28:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T12:48:40Z","title":"Video Prediction Policy: A Generalist Robot Policy with Predictive Visual Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14803","snapshot_observed_at":"2026-08-08T04:20:17.490892Z","title":"Video prediction policy: A generalist robot policy with predictive visual representations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.490892Z"},"links":{"cited_paper":"/paper/2412.14803","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:df78a10397d36796c57204ec2b3e29b67c66a95ae567cadf8df5764c8706f4f0","observation_id":"3d33ec86-7bfb-4347-8b68-057949a39568","resolution":{"observed_at":"2026-08-08T04:20:17.490892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-08-08T04:20:17.512801Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.512801Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:8ee8cbdd86b3e8ea665049c0eb72c6fc784b13a9e41303c9186eab6c5a03e117","observation_id":"e334248f-1372-41be-af1f-6fa9c549d859","resolution":{"observed_at":"2026-08-08T04:20:17.512801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.479271Z","title":"Interndata-m1","venue":null,"work_id":"2863b5c9-20c9-42d0-a72e-6308d10681dc","year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.540722Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:978cb7b8a922ba33098250572541e0f898ca3d7a9f88034c997c246f7e87448a","observation_id":"6612c5d9-83e5-4945-befc-b98369cddf28","resolution":{"observed_at":"2026-08-08T04:20:19.483644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-08T04:20:17.589345Z","title":"Openvla: An open-source vision-language-action model, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.589345Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:d4fe1a9471d239cad8ff986375fa329c6f147548eea015287dfb9d5e4c2d03ec","observation_id":"ef19f389-1546-4e98-9d15-fcb6ad89c383","resolution":{"observed_at":"2026-08-08T04:20:17.589345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.16163","last_updated":"2026-01-22T18:09:30Z","snapshot_observed_at":"2026-08-06T02:05:52.408905Z","submitted_at":"2026-01-22T18:09:30Z","title":"Cosmos Policy: Fine-Tuning Video Models for Visuomotor Control and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.16163","snapshot_observed_at":"2026-08-08T04:20:17.617524Z","title":"Cosmos policy: Fine-tuning video models for visuomotor control and planning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.617524Z"},"links":{"cited_paper":"/paper/2601.16163","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:569f251df1e7c25dc0d127339285c5071a21a54395f9d6adba448b5a9e5bf8ff","observation_id":"92148372-c732-448c-b85c-e6a1223c8fd8","resolution":{"observed_at":"2026-08-08T04:20:17.617524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.464948Z","title":"Learning to act from actionless videos through dense correspondences","venue":null,"work_id":"9dc760b6-39fa-4ea3-b744-94e6f0df8194","year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.648052Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:7d5f8f2788f29d2df5a70752a64ed874401caa9b6369d99001ef226a623e8fe3","observation_id":"cc64ec47-9b59-422a-aee2-8170062b3ef7","resolution":{"observed_at":"2026-08-08T04:20:19.469772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.23000","last_updated":"2026-04-24T20:40:11Z","snapshot_observed_at":"2026-08-07T23:28:46.005647Z","submitted_at":"2026-04-24T20:40:11Z","title":"Learning from the Best: Smoothness-Driven Metrics for Data Quality in Imitation Learning","version":1},"cited_work":{"arxiv_id":"2604.23000","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.23000","snapshot_observed_at":"2026-08-08T04:20:18.796549Z","title":"Learning from the Best: Smoothness-Driven Metrics for Data Quality in Imitation Learning","venue":"cs.RO","work_id":"e0fdd235-0ff4-431e-92c3-faac59286d43","year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.664691Z"},"links":{"cited_paper":"/paper/2604.23000","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:24723da177db87b2f17cbb08c08889cbcd32cbbc7c57502ad59d1db9177d16a1","observation_id":"9ab5775e-274d-45e6-84fa-4d69846f5fc1","resolution":{"observed_at":"2026-08-08T04:20:18.801474Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.449326Z","title":"Let-base-dataset","venue":null,"work_id":"ea9686e4-b9ce-4221-99f0-5f4644de12f9","year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.669540Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:3050fda7465e16b509b6a296741172e66617a4098b62f654bf023bff23dc2555","observation_id":"ee262e71-8c00-4974-941b-56bd4f637e34","resolution":{"observed_at":"2026-08-08T04:20:19.454402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.433080Z","title":"Behavior-1k: A benchmark for embodied ai with 1,000 everyday activities and realistic simulation","venue":null,"work_id":"9d99ae05-110a-462a-9bbd-5d529e292d0b","year":2023},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.674095Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:be27c06842939ef50f3317e9055a75a30014e14e5298967f6c2ab40ee3f81634","observation_id":"ba2db704-6b9c-4731-a224-7c7b96626094","resolution":{"observed_at":"2026-08-08T04:20:19.437835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21998","last_updated":"2026-03-22T15:37:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T17:07:43Z","title":"Causal World Modeling for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.21998","snapshot_observed_at":"2026-08-08T04:20:17.678978Z","title":"Causal world modeling for robot control.arXiv preprint arXiv:2601.21998, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.678978Z"},"links":{"cited_paper":"/paper/2601.21998","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:9765fb5ee7b1e91929d525fc8729324cc5c2bc6432e85d6c1756a4fe2d3fd1ef","observation_id":"f51fd8b7-e43a-4063-8dac-8644d6c42c76","resolution":{"observed_at":"2026-08-08T04:20:17.678978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19650","last_updated":"2024-11-29T12:06:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-29T12:06:03Z","title":"CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19650","snapshot_observed_at":"2026-08-08T04:20:17.684378Z","title":"Cogact: A foundational vision-language-action model for synergizing cognition and action in robotic manipulation.arXiv preprint arXiv:2411.19650, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.684378Z"},"links":{"cited_paper":"/paper/2411.19650","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:4a336ec3d856edcec06b9f6e61c2159b686dcf57e218c2bba9183d8f71d52ecd","observation_id":"03893cec-0a12-4e22-b1eb-b4ace11a6aad","resolution":{"observed_at":"2026-08-08T04:20:17.684378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.418224Z","title":"Hamster: Hierarchical action models for open-world robot manipulation","venue":null,"work_id":"cdea6a12-e385-49b7-aa9b-bce641ad2ed1","year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.689247Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:1f88c73fbe4986b1245b43ca0c3094f118ed97278aee6773dfadfd1ddda157cc","observation_id":"bbc9aa23-ba79-4b69-8162-e900abd766c9","resolution":{"observed_at":"2026-08-08T04:20:19.423118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.23570","last_updated":"2026-04-26T07:21:15Z","snapshot_observed_at":"2026-07-06T23:09:48.137856Z","submitted_at":"2026-04-26T07:21:15Z","title":"EgoLive: A Large-Scale Egocentric Dataset from Real-World Human Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.23570","snapshot_observed_at":"2026-08-08T04:20:17.693692Z","title":"Egolive: A large-scale egocentric dataset from real-world human tasks.arXiv preprint arXiv:2604.23570, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.693692Z"},"links":{"cited_paper":"/paper/2604.23570","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:1b8b1ca6b644b1d0655124a0fda80a9c9bfaeaa9d1630b79d0f1c80bfa002097","observation_id":"73948b7d-7fdd-43fc-9723-f33f793faca5","resolution":{"observed_at":"2026-08-08T04:20:17.693692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04999","last_updated":"2026-07-30T01:04:01Z","snapshot_observed_at":"2026-08-07T15:48:54.327194Z","submitted_at":"2025-05-08T07:07:58Z","title":"CLAM: Continuous Latent Action Models for Robot Learning from Unlabeled Demonstrations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04999","snapshot_observed_at":"2026-08-08T04:20:17.698342Z","title":"Clam: Continuous latent action models for robot learning from unlabeled demonstrations.arXiv preprint arXiv:2505.04999, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.698342Z"},"links":{"cited_paper":"/paper/2505.04999","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:d73f10dfa715c6eb6a918640ce7abe31ca1fca9c8e0bb2975db46c199e6a9057","observation_id":"7b4f74ba-1b1a-44e1-88e8-3c2f236b46ba","resolution":{"observed_at":"2026-08-08T04:20:17.698342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-08T04:20:17.702672Z","title":"Flow matching for generative modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.702672Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:0c892e21fa299f403957494d81491ac02e7f8e233d1a4a4ff50c92c11202daf0","observation_id":"ed480fc6-81e9-41c0-a127-6500b714971a","resolution":{"observed_at":"2026-08-08T04:20:17.702672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.07100","last_updated":"2026-06-30T09:11:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-05T09:51:25Z","title":"LARA: Latent Action Representation Alignment for Vision-Language-Action Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.07100","snapshot_observed_at":"2026-08-08T04:20:17.707960Z","title":"Lara: Latent action representation alignment for vision-language-action models.arXiv preprint arXiv:2606.07100, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.707960Z"},"links":{"cited_paper":"/paper/2606.07100","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:b13e4b659ebbcdccd7cf878b249c9c39bb1b7a9e4f1eb192add336d7426d3de2","observation_id":"13de0e7e-4ccc-4bd0-bbfc-316db8033c25","resolution":{"observed_at":"2026-08-08T04:20:17.707960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12215","last_updated":"2026-06-03T04:04:20Z","snapshot_observed_at":"2026-08-02T23:57:43.860710Z","submitted_at":"2026-02-12T17:53:51Z","title":"LDA-1B: Scaling Latent Dynamics Action Model via Universal Embodied Data Ingestion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.12215","snapshot_observed_at":"2026-08-08T04:20:17.713043Z","title":"Lda-1b: Scaling latent dynamics action model via universal embodied data ingestion","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.713043Z"},"links":{"cited_paper":"/paper/2602.12215","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:da1af97f0356fb6fe14ab838594deab573d9723dd846fc2a7ace153e5aed40ec","observation_id":"745ce748-b8d5-4ec5-b900-cf7f1d14e9c5","resolution":{"observed_at":"2026-08-08T04:20:17.713043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.403218Z","title":"Unifying perception and action: A hybrid- modality pipeline with implicit visual chain-of-thought for robotic action generation","venue":null,"work_id":"02468959-a9dc-403b-b1ff-9006700e1ecf","year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.717794Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:584c7999a1d7433510f74347c716ffc081186868b727a0a1593579642baa3ec1","observation_id":"bc3d9c78-2cd5-4b53-9a4c-1cecfb258ddb","resolution":{"observed_at":"2026-08-08T04:20:19.408442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-09T23:26:27.403993Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00379","snapshot_observed_at":"2026-08-08T04:20:17.721810Z","title":"Latent action learning requires supervision in the presence of distractors.arXiv preprint arXiv:2502.00379, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.721810Z"},"links":{"cited_paper":"/paper/2502.00379","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:06eb4cbcfd4b936673ca48af29508b5049730a05b19685f534fabfecb76f0f6e","observation_id":"67d6486f-d4e1-4932-bd3d-51e284061543","resolution":{"observed_at":"2026-08-08T04:20:17.721810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.388049Z","title":"Cosmos-embed1: A joint video-text embedder for physical ai, 2025","venue":null,"work_id":"9b491461-d6f8-4dd7-a359-fe4b8617e1b2","year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.726667Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:5623daa99ee35729778857ea45a0bd4484f7c248861221b19725d2aa9db2c445","observation_id":"c60be46d-ef60-4bb0-9bfe-b0fcc6a8cd73","resolution":{"observed_at":"2026-08-08T04:20:19.393027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.372521Z","title":"Baihu dataset","venue":null,"work_id":"6a08d939-2414-4836-9986-9a669174cf6b","year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.731387Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:94869bd7a489cb56fa5651c3f2fdf9db16e78ea42bde32f62b14c9242b4a1991","observation_id":"80cb2622-d304-4db9-9a44-f4131d897aa1","resolution":{"observed_at":"2026-08-08T04:20:19.377284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.15692","last_updated":"2025-12-19T18:30:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-17T18:47:31Z","title":"mimic-video: Video-Action Models for Generalizable Robot Control Beyond VLAs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.15692","snapshot_observed_at":"2026-08-08T04:20:17.735904Z","title":"mimic-video: Video-action models for generalizable robot control beyond vlas.arXiv preprint arXiv:2512.15692, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.735904Z"},"links":{"cited_paper":"/paper/2512.15692","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:1741bebe1d2fa26b8b74cb6bb34c9517b9071a1b9f9e2445474626dfc26ffd0a","observation_id":"1f61b309-80d9-4290-9ca4-723161c95eca","resolution":{"observed_at":"2026-08-08T04:20:17.735904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:17.740500Z","title":"Reconstructing hands in 3d with transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.740500Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:2c5baeca4e68dc8b566fd894c006a1b7241c69d1482d13ef553c506ca7415173","observation_id":"0a76d984-57a8-4cc9-b325-ca2139ae8ddc","resolution":{"observed_at":"2026-08-08T04:20:17.740500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-08-08T04:20:17.745291Z","title":"Fast: Efficient action tokenization for vision-language-action models.arXiv preprint arXiv:2501.09747, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.745291Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:4ad4b7bbcbb203b4808f4abf20e3754f99bb9a0c2eb8cb76f038018c0b4307fd","observation_id":"7c76b65f-ff59-42b9-9ba4-09eef952411d","resolution":{"observed_at":"2026-08-08T04:20:17.745291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07607","last_updated":"2026-07-07T17:04:24Z","snapshot_observed_at":"2026-07-13T08:25:19.322550Z","submitted_at":"2026-04-08T21:27:06Z","title":"EgoVerse: An Egocentric Human Dataset for Robot Learning from Around the World","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.07607","snapshot_observed_at":"2026-08-08T04:20:17.749807Z","title":"Egoverse: An egocentric human dataset for robot learning from around the world.arXiv preprint arXiv:2604.07607, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.749807Z"},"links":{"cited_paper":"/paper/2604.07607","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:591a717d3a0f5bc95cbd17ca45ee35caed21d3dd8ac850ce712f36cf0f2fdbe1","observation_id":"7ea55de1-9e25-4592-918e-5463672ec670","resolution":{"observed_at":"2026-08-08T04:20:17.749807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.02610","last_updated":"2022-01-07T18:59:32Z","snapshot_observed_at":"2026-08-09T08:53:11.112938Z","submitted_at":"2022-01-07T18:59:32Z","title":"Embodied Hands: Modeling and Capturing Hands and Bodies Together","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.02610","snapshot_observed_at":"2026-08-08T04:20:17.754322Z","title":"Embodied hands: Modeling and capturing hands and bodies together","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.754322Z"},"links":{"cited_paper":"/paper/2201.02610","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:11dcd7ad2203f09704ac177915f42564f3a375f812c307e606b459a7c641cd5d","observation_id":"4cb9c265-bc4e-4f9d-bec3-23bfec796d23","resolution":{"observed_at":"2026-08-08T04:20:17.754322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.345576Z","title":"Xperience-10m: A large-scale egocentric multimodal dataset with structured 3d/4d annotations, 2026","venue":null,"work_id":"d43d5e4b-43ec-417c-b744-fbfa6c280b5f","year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.782938Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:62f35d134352b80c456e5db840dfa6a8f704687c6f30dfc920949f2d3a8aa92d","observation_id":"bfcce5ac-aa81-4693-a97c-b6043d703c47","resolution":{"observed_at":"2026-08-08T04:20:19.351131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.01544","last_updated":"2026-05-02T17:16:50Z","snapshot_observed_at":"2026-08-06T11:56:50.268753Z","submitted_at":"2026-05-02T17:16:50Z","title":"An Efficient Metric for Data Quality Measurement in Imitation Learning","version":1},"cited_work":{"arxiv_id":"2605.01544","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.01544","snapshot_observed_at":"2026-08-08T04:20:18.588377Z","title":"An Efficient Metric for Data Quality Measurement in Imitation Learning","venue":"cs.RO","work_id":"53c202bf-919f-4ac2-9b8d-ad561dc2b492","year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.811009Z"},"links":{"cited_paper":"/paper/2605.01544","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:c74ea358f70b6018d6e86b984b7856eda763118eb908e9230c1db4b3b23acce4","observation_id":"c4e4ba20-cd19-447b-8044-7863649f348a","resolution":{"observed_at":"2026-08-08T04:20:18.595098Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.329079Z","title":"Emma-x: An embodied multimodal action model with grounded chain of thought and look-ahead spatial reasoning","venue":null,"work_id":"138b5a91-f8f8-4dc9-89b4-0660f66a4269","year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.854766Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:57d5282cafdd65938728da5c0af4a32dcdf432d94878e35b880a3bcc4a15feea","observation_id":"49364af1-a6d4-452d-8c19-456d3b749db8","resolution":{"observed_at":"2026-08-08T04:20:19.334060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.313420Z","title":"Galaxea g0.5 technical report.arxiv, 2026","venue":null,"work_id":"38ce4ed9-56c2-42aa-a76f-753672c335f9","year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.868299Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:abe8b313d632f006d47a6287baa2cf0a3d728b57a337f35cd8e27dc6ab0ba9cd","observation_id":"2e5c3cd3-caf2-4afa-b41b-067b9a6ea88b","resolution":{"observed_at":"2026-08-08T04:20:19.318339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.27792","last_updated":"2026-07-15T07:09:44Z","snapshot_observed_at":"2026-08-02T15:15:08.869109Z","submitted_at":"2026-04-30T12:34:44Z","title":"Motubrain: An Advanced World Action Model for Robot Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.27792","snapshot_observed_at":"2026-08-08T04:20:17.873076Z","title":"Motubrain: An advanced world action model for robot control.arXiv preprint arXiv:2604.27792, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.873076Z"},"links":{"cited_paper":"/paper/2604.27792","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:eaf98e378dff4b85fb92ce98e3c1f18dc30ec7dc113e2f9b1cdd3d4008f15fa0","observation_id":"4d62c81b-731e-4fd1-bafd-25ad225d4eb2","resolution":{"observed_at":"2026-08-08T04:20:17.873076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.297915Z","title":"Predictive in- verse dynamics models are scalable learners for robotic manipulation","venue":null,"work_id":"43d6eec1-4439-4100-a1c9-d951fb216e5d","year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.878492Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:b458ef3de0c6c19cfa65c94d7c06694aab2c5360c73859b94a208edf6dfb1df3","observation_id":"d2755c85-91b4-40fb-ac52-1677357c9d8d","resolution":{"observed_at":"2026-08-08T04:20:19.302893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:17.883021Z","title":"Interndata-a1: Pioneering high-fidelity synthetic data for pre-training generalist policy.arXiv preprint arXiv:2511.16651, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.883021Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:2a386cef73b73899240ec238df11f007868384d0413f544e3126e3a6b52e5b0e","observation_id":"99637964-6c58-47f5-98f7-218681273eae","resolution":{"observed_at":"2026-08-08T04:20:17.883021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.282598Z","title":"Vggt: Visual geometry grounded transformer","venue":null,"work_id":"1d4097a2-284a-4967-b6d7-60d5f0fac5e7","year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.887745Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:72606ca51462d0d0023af36d210390ec1d7c84b400080f305d650886b25c959d","observation_id":"60678bf3-db2a-423d-8762-9066059d9dec","resolution":{"observed_at":"2026-08-08T04:20:19.287600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.267276Z","title":"Scaling proprioceptive-visual learning with heterogeneous pre-trained transformers","venue":null,"work_id":"5b298457-7a03-41e9-8363-a60518fd6ce4","year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.892249Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:af87698b7da8d0410b1b2881076830142a2542733404f7f4a5a247b636bc2e5b","observation_id":"8edb9feb-10ab-4b9b-88a5-b499a8ed7b6d","resolution":{"observed_at":"2026-08-08T04:20:19.271822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:17.896725Z","title":"Vq-vla: Improving vision-language-action models via scaling vector-quantized action tokenizers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.896725Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:4ca64f508a7bb86ac3f949980e2cf30dcb07103d903694f41af07ba5235d084e","observation_id":"40fb96b1-1180-4285-9095-e64b55b5f79a","resolution":{"observed_at":"2026-08-08T04:20:17.896725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.242609Z","title":"Humanego: Zero-shot robot learning from minutes of human egocentric videos.arXiv e-prints, pages arXiv–2605, 2026","venue":null,"work_id":"d67db459-6805-450d-9dbd-026a75c66401","year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.901082Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:39e5875eeae7cacb60abe94abd9982efdaded81e14364320dc705ecb2e7b1349","observation_id":"8480c661-946f-4c66-9deb-eb5acb8461be","resolution":{"observed_at":"2026-08-08T04:20:19.247523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13877","last_updated":"2025-05-27T01:46:53Z","snapshot_observed_at":"2026-07-06T20:09:14.917734Z","submitted_at":"2024-12-18T14:17:16Z","title":"RoboMIND: Benchmark on Multi-embodiment Intelligence Normative Data for Robot Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13877","snapshot_observed_at":"2026-08-08T04:20:17.905555Z","title":"Robomind: Benchmark on multi-embodiment intelligence normative data for robot manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.905555Z"},"links":{"cited_paper":"/paper/2412.13877","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:234a21f643fbcd0d84477c8bc59f3fe0dea9797059189ed9dcb9bc0b40b79ba0","observation_id":"918693b3-e914-4992-9693-0fae7c5b7e5b","resolution":{"observed_at":"2026-08-08T04:20:17.905555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.17441","last_updated":"2026-04-13T12:31:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-21T17:39:22Z","title":"RoboCOIN: An Open-Sourced Bimanual Robotic Data Collection for Integrated Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.17441","snapshot_observed_at":"2026-08-08T04:20:17.918768Z","title":"Robocoin: An open-sourced bimanual robotic data collection for integrated manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.918768Z"},"links":{"cited_paper":"/paper/2511.17441","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:db8564fda48d9810cf2901bf98055dba95253720356d98e6b7bc79b40fbc46e4","observation_id":"6e59e679-5677-4692-ab51-6814aaf0aa31","resolution":{"observed_at":"2026-08-08T04:20:17.918768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.23073","last_updated":"2026-04-30T20:04:38Z","snapshot_observed_at":"2026-07-31T07:02:53.376869Z","submitted_at":"2026-04-24T23:57:45Z","title":"RL Token: Bootstrapping Online RL with Vision-Language-Action Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.23073","snapshot_observed_at":"2026-08-08T04:20:17.942358Z","title":"Rl token: Bootstrapping online rl with vision-language-action models.arXiv preprint arXiv:2604.23073, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.942358Z"},"links":{"cited_paper":"/paper/2604.23073","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:858076e55ca4e7009b23622be2abe40833e5339445f45c16ba324a1acca1aefe","observation_id":"1d31e7d4-fdaa-4e38-98b1-9e465cf63053","resolution":{"observed_at":"2026-08-08T04:20:17.942358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:17.999798Z","title":"Gigaworld-policy: An efficient action-centered world–action model.arXiv preprint arXiv:2603.17240, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.999798Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:df40930e6481dc66d0f5757b3d74089000ee1b8c3a37adbf2cb79e37d9624ee1","observation_id":"9addfd48-b0ce-41fd-a3a5-b9b61e6268fd","resolution":{"observed_at":"2026-08-08T04:20:17.999798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.228308Z","title":"Latent action pretraining from videos","venue":null,"work_id":"464de041-d929-47d6-8d34-04aa4733fe1f","year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.025997Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:7d0d3434082a652c849bd50d0d07cc5aa8e3d5e8da4bf7ae596b3ac14dd10475","observation_id":"cc4d0f29-1699-4bc0-901b-915f80d7efb2","resolution":{"observed_at":"2026-08-08T04:20:19.232813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15922","last_updated":"2026-02-17T15:04:02Z","snapshot_observed_at":"2026-08-09T12:54:21.149243Z","submitted_at":"2026-02-17T15:04:02Z","title":"World Action Models are Zero-shot Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15922","snapshot_observed_at":"2026-08-08T04:20:18.032859Z","title":"World action models are zero-shot policies.arXiv preprint arXiv:2602.15922, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.032859Z"},"links":{"cited_paper":"/paper/2602.15922","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:cf8ec2581950141eac646879226e44bdfb1c55bb1d13545181ed30f30d6235ec","observation_id":"d7de02df-bdd7-4815-90b2-6a59d65b697e","resolution":{"observed_at":"2026-08-08T04:20:18.032859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.02078","last_updated":"2026-06-30T05:51:48Z","snapshot_observed_at":"2026-08-03T12:41:49.134646Z","submitted_at":"2026-01-05T12:59:39Z","title":"Genie Sim 3.0 : A High-Fidelity Comprehensive Simulation Platform for Humanoid Robot","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.02078","snapshot_observed_at":"2026-08-08T04:20:18.038905Z","title":"Genie sim 3.0: A high-fidelity comprehensive simulation platform for humanoid robot.arXiv preprint arXiv:2601.02078, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.038905Z"},"links":{"cited_paper":"/paper/2601.02078","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:ffe9864f6280f230833674a13e336d9c287a41546244c565379879f9d94cf74e","observation_id":"6127a04d-15b7-48aa-8494-b37d76481408","resolution":{"observed_at":"2026-08-08T04:20:18.038905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.17846","last_updated":"2026-06-17T17:06:39Z","snapshot_observed_at":"2026-08-01T08:00:11.218777Z","submitted_at":"2026-06-16T12:14:39Z","title":"Qwen-RobotManip Technical Report: Alignment Unlocks Scale for Robotic Manipulation Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.17846","snapshot_observed_at":"2026-08-08T04:20:18.044437Z","title":"Qwen-robotmanip technical report: Alignment unlocks scale for robotic manipulation foundation models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.044437Z"},"links":{"cited_paper":"/paper/2606.17846","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:4202007c677df19e304f247d612b3317684a83c21fb8298ad6ef4de286a3c0c2","observation_id":"2725f2c2-eb14-403b-843d-87eb122cc2a1","resolution":{"observed_at":"2026-08-08T04:20:18.044437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.16666","last_updated":"2026-03-23T05:41:14Z","snapshot_observed_at":"2026-07-06T22:49:23.750692Z","submitted_at":"2026-03-17T15:33:43Z","title":"Fast-WAM: Do World Action Models Need Test-time Future Imagination?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.16666","snapshot_observed_at":"2026-08-08T04:20:18.049955Z","title":"Fast-wam: Do world action models need test-time future imagination? arXiv preprint arXiv:2603.16666, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.049955Z"},"links":{"cited_paper":"/paper/2603.16666","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:c0c6176ccfef8264d4ca6362347bde4adc8124a3cbaef9744c24d30f6c3d620f","observation_id":"8fcfa032-8c04-4f04-b209-ca046708bcbe","resolution":{"observed_at":"2026-08-08T04:20:18.049955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08693","last_updated":"2025-03-06T19:29:03Z","snapshot_observed_at":"2026-08-07T02:44:43.738657Z","submitted_at":"2024-07-11T17:31:01Z","title":"Robotic Control via Embodied Chain-of-Thought Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08693","snapshot_observed_at":"2026-08-08T04:20:18.055631Z","title":"Robotic control via embodied chain-of-thought reasoning.arXiv preprint arXiv:2407.08693, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.055631Z"},"links":{"cited_paper":"/paper/2407.08693","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:6820e554a2fdce2ee3a32af9f40283bfa7121a4becd646b47fb7c02021df2abe","observation_id":"f216a178-9176-4952-8d7d-dde9833a9aff","resolution":{"observed_at":"2026-08-08T04:20:18.055631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:18.061102Z","title":"Atomicvla: Unlocking the potential of atomic skill learning in robots, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.061102Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:dccaddd43e761f9e0b2db98df3e2ddd92a00ed2d9563625076e34557d31c123e","observation_id":"3a61dded-a74b-4058-9477-5707da93762b","resolution":{"observed_at":"2026-08-08T04:20:18.061102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.213795Z","title":"Efros, Eli Shechtman, and Oliver Wang","venue":null,"work_id":"fb6990a8-092d-4adc-ba82-380e673454cc","year":2018},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.066384Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:cbc4ad8ef1996ccdb5fe9c22ee37ba9a51b9d9aca208af310f837016faa69753","observation_id":"3905c5e6-cfc9-4635-955a-e431ed44d0ed","resolution":{"observed_at":"2026-08-08T04:20:19.218191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20100","last_updated":"2026-04-23T04:10:40Z","snapshot_observed_at":"2026-07-06T23:06:35.507008Z","submitted_at":"2026-04-22T01:51:48Z","title":"JoyAI-RA 0.1: A Foundation Model for Robotic Autonomy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.20100","snapshot_observed_at":"2026-08-08T04:20:18.073152Z","title":"Joyai-ra 0.1: A foundation model for robotic autonomy.arXiv preprintarXiv:2604.20100, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.073152Z"},"links":{"cited_paper":"/paper/2604.20100","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:ea47baaadf1dc942b4be86741bb82e820050a603010bc9dad05b35cb712c1869","observation_id":"d3a32a04-3acf-40dc-8994-f45e6dcb8493","resolution":{"observed_at":"2026-08-08T04:20:18.073152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.198058Z","title":"Dreamvla: a vision-language-action model dreamed with comprehensive world knowledge","venue":null,"work_id":"4b92316c-f764-4708-bce9-63995a435f00","year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.089381Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:213ee83785228270e56c0dab296a3bd6f5c333b07ff1bb93d7ab6bf837ad7c4f","observation_id":"fb08cb4e-37ef-4f48-a50d-bd418300f58e","resolution":{"observed_at":"2026-08-08T04:20:19.202799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:18.097497Z","title":"Cot-vla: Visual chain-of-thought reasoning for vision-language-action models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.097497Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:9c44e8f4f639a0924ee7015ea4d8c04880c3d9b0fa66b1b58236baa562397d4b","observation_id":"48253b1d-1e8b-4b68-a2bb-934fbdffb6f7","resolution":{"observed_at":"2026-08-08T04:20:18.097497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.172557Z","title":"Sim2real vla: Zero-shot generalization of synthesized skills to realistic manipulation","venue":null,"work_id":"fca3c48b-11ad-4d14-8dfe-893f616b12f5","year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.103196Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:30a5346de61436d214fb895311e6a4e4c6b04c49db97b25a899cc2071dfbdbfe","observation_id":"21289431-3773-4879-9487-34d3f0d6fbbe","resolution":{"observed_at":"2026-08-08T04:20:19.177763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02792","last_updated":"2025-05-23T00:47:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-03T17:38:59Z","title":"Unified World Models: Coupling Video and Action Diffusion for Pretraining on Large Robotic Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02792","snapshot_observed_at":"2026-08-08T04:20:18.108528Z","title":"Unified world models: Coupling video and action diffusion for pretraining on large robotic datasets.arXiv preprint arXiv:2504.02792, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.108528Z"},"links":{"cited_paper":"/paper/2504.02792","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:b8d0fdfd76f8ce81d7e94a92c37032f3760abb76472d60c20e0b5339d5fe303f","observation_id":"0b821915-bf46-41c2-8330-6e208628e715","resolution":{"observed_at":"2026-08-08T04:20:18.108528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.156981Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":"0812f53b-f88a-4982-8fb4-968c42f385ca","year":2023},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.114193Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:e8e89acf2dad68951b72750244ac1c6185f55e039d6d853cdc9e5a268dd9a315","observation_id":"ba009782-44f6-47f2-80f5-d6289af2b4da","resolution":{"observed_at":"2026-08-08T04:20:19.161758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00576","last_updated":"2025-08-30T18:04:19Z","snapshot_observed_at":"2026-08-06T11:26:06.418969Z","submitted_at":"2025-08-30T18:04:19Z","title":"Galaxea Open-World Dataset and G0 Dual-System VLA Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00576","snapshot_observed_at":"2026-08-08T04:20:17.578972Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.578972Z"},"links":{"cited_paper":"/paper/2509.00576","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:550ae7ce3eb84697587604e59842f99a208bc94847793d087400ebcfa5e11953","observation_id":"2441a3d6-23f3-4a82-99cc-c6675b880936","resolution":{"observed_at":"2026-08-08T04:20:17.578972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment"},"reference_resolution":{"displayed":80,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":2,"verified_fuzzy":26},"total_outbound_references":80},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 80 of 80 outbound references and 0 inbound Pith citation observations for arXiv:2608.05674."}