{"as_of":"2026-08-10T02:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0ec23ed44aab6d59bde3cb5982836e22faa2645693282cf29d4071d596877b82","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T18:51:36.127656Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T06:48:14.554799Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T22:16:36.335996Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"cited_work":{"arxiv_id":"2509.09769","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.09769","snapshot_observed_at":"2026-07-09T22:16:36.335996Z","title":"Mimicdroid: In-context learning for humanoid manipulation from human play videos","venue":"cs.RO","work_id":"4c061ffd-6240-435f-9a55-7687242781ad","year":2025},"citing_paper":{"arxiv_id":"2511.04671","last_updated":"2026-04-15T03:42:52Z","snapshot_observed_at":"2026-08-01T04:13:43.111071Z","submitted_at":"2025-11-06T18:56:30Z","title":"X-Diffusion: Training Diffusion Policies on Cross-Embodiment Human Demonstrations","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-18T00:37:12.170711Z"},"links":{"cited_paper":"/paper/2509.09769","citing_paper":"/paper/2511.04671"},"observation_digest":"sha256:b1d241171bdc30daf167faf37922b67a4661f25f8fc99de4ca0e2ea2313f0cac","observation_id":"08184c78-6d50-4ee1-bff1-766e366bb783","resolution":{"observed_at":"2026-05-18T00:40:33.752011Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"cited_work":{"arxiv_id":"2509.09769","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.09769","snapshot_observed_at":"2026-07-09T22:16:36.335996Z","title":"Mimicdroid: In-context learning for humanoid manipulation from human play videos","venue":"cs.RO","work_id":"4c061ffd-6240-435f-9a55-7687242781ad","year":2025},"citing_paper":{"arxiv_id":"2604.20348","last_updated":"2026-06-10T16:25:38Z","snapshot_observed_at":"2026-08-07T00:32:25.170573Z","submitted_at":"2026-04-22T08:51:07Z","title":"Bimanual Robot Manipulation via Multi-Agent In-Context Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T00:25:24.362191Z"},"links":{"cited_paper":"/paper/2509.09769","citing_paper":"/paper/2604.20348"},"observation_digest":"sha256:7072597d0778bc1b498793c5e99003c20857eaa40aebd0062a75fd841510607d","observation_id":"64b637e1-d756-4dcc-8b3d-8a34a03298fa","resolution":{"observed_at":"2026-05-10T00:29:47.506260Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"cited_work":{"arxiv_id":"2509.09769","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.09769","snapshot_observed_at":"2026-07-09T22:16:36.335996Z","title":"Mimicdroid: In-context learning for humanoid manipulation from human play videos","venue":"cs.RO","work_id":"4c061ffd-6240-435f-9a55-7687242781ad","year":2025},"citing_paper":{"arxiv_id":"2605.24934","last_updated":"2026-05-28T10:10:45Z","snapshot_observed_at":"2026-07-06T23:34:57.148983Z","submitted_at":"2026-05-24T08:26:41Z","title":"HumanEgo: Zero-Shot Robot Learning from Minutes of Human Egocentric Videos","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-30T01:02:58.035784Z"},"links":{"cited_paper":"/paper/2509.09769","citing_paper":"/paper/2605.24934"},"observation_digest":"sha256:1aca1b41514106cfbebaf0ff85ac511c76fc701574c640b1dccb353bb648fa08","observation_id":"f1cd0c19-d6c0-4d0f-92a5-81be84f8848f","resolution":{"observed_at":"2026-07-01T15:45:48.712142Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"cited_work":{"arxiv_id":"2509.09769","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.09769","snapshot_observed_at":"2026-07-09T22:16:36.335996Z","title":"Mimicdroid: In-context learning for humanoid manipulation from human play videos","venue":"cs.RO","work_id":"4c061ffd-6240-435f-9a55-7687242781ad","year":2025},"citing_paper":{"arxiv_id":"2606.05952","last_updated":"2026-06-04T09:51:57Z","snapshot_observed_at":"2026-08-07T07:35:44.170638Z","submitted_at":"2026-06-04T09:51:57Z","title":"Learning of Robot Safety Policies via Adversarial Synthetic Scenarios","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T01:12:25.956015Z"},"links":{"cited_paper":"/paper/2509.09769","citing_paper":"/paper/2606.05952"},"observation_digest":"sha256:27c75bacaedaea539656ab82e2012806c8903802d853c2af9449b323d4ea1d21","observation_id":"46752ed2-8080-476f-9419-73bd2bdba9ab","resolution":{"observed_at":"2026-07-02T13:36:58.971265Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"cited_work":{"arxiv_id":"2509.09769","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.09769","snapshot_observed_at":"2026-07-09T22:16:36.335996Z","title":"Mimicdroid: In-context learning for humanoid manipulation from human play videos","venue":"cs.RO","work_id":"4c061ffd-6240-435f-9a55-7687242781ad","year":2025},"citing_paper":{"arxiv_id":"2606.26025","last_updated":"2026-07-03T15:34:07Z","snapshot_observed_at":"2026-07-12T12:05:57.041170Z","submitted_at":"2026-06-24T16:53:36Z","title":"In-Context World Modeling for Robotic Control","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-25T19:12:22.513577Z"},"links":{"cited_paper":"/paper/2509.09769","citing_paper":"/paper/2606.26025"},"observation_digest":"sha256:7c5b2ada40cbb4e490ead621a42565997f0aaa7f9e343e0d50097aadf42cfdfd","observation_id":"9afd20f5-db4e-4edf-9feb-0023509c07bc","resolution":{"observed_at":"2026-07-04T21:00:09.579213Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"cited_work":{"arxiv_id":"2509.09769","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.09769","snapshot_observed_at":"2026-07-09T22:16:36.335996Z","title":"Mimicdroid: In-context learning for humanoid manipulation from human play videos","venue":"cs.RO","work_id":"4c061ffd-6240-435f-9a55-7687242781ad","year":2025},"citing_paper":{"arxiv_id":"2606.26025","last_updated":"2026-07-03T15:34:07Z","snapshot_observed_at":"2026-07-12T12:05:57.041170Z","submitted_at":"2026-06-24T16:53:36Z","title":"In-Context World Modeling for Robotic Control","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T05:11:07.089829Z"},"links":{"cited_paper":"/paper/2509.09769","citing_paper":"/paper/2606.26025"},"observation_digest":"sha256:69d04356365968d51f239055d6892c8cb0e6a6ec18c4be59d37c14c0f8e911d9","observation_id":"9da99683-5dd7-469a-8365-3812b0941822","resolution":{"observed_at":"2026-07-04T13:29:51.621126Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09769","snapshot_observed_at":"2026-07-12T12:05:57.682386Z","title":"Mimicdroid: In-context learning for humanoid robot manipulation from human play videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26025","last_updated":"2026-07-03T15:34:07Z","snapshot_observed_at":"2026-07-12T12:05:57.041170Z","submitted_at":"2026-06-24T16:53:36Z","title":"In-Context World Modeling for Robotic Control","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T12:05:57.682386Z"},"links":{"cited_paper":"/paper/2509.09769","citing_paper":"/paper/2606.26025"},"observation_digest":"sha256:3e4aeb5632f8a49c14ca7699d44ec66682461f3b0a727a64da02c021297e0df3","observation_id":"10c874f3-da37-429e-a71c-642627d80fd2","resolution":{"observed_at":"2026-07-12T12:05:57.682386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"cited_work":{"arxiv_id":"2509.09769","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.09769","snapshot_observed_at":"2026-07-09T22:16:36.335996Z","title":"Mimicdroid: In-context learning for humanoid manipulation from human play videos","venue":"cs.RO","work_id":"4c061ffd-6240-435f-9a55-7687242781ad","year":2025},"citing_paper":{"arxiv_id":"2607.06988","last_updated":"2026-07-10T02:22:52Z","snapshot_observed_at":"2026-08-07T16:54:08.238920Z","submitted_at":"2026-07-08T04:23:22Z","title":"WAM-TTT: Steering World-Action Models by Watching Human Play at Test Time","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-09T22:16:31.529359Z"},"links":{"cited_paper":"/paper/2509.09769","citing_paper":"/paper/2607.06988"},"observation_digest":"sha256:7fc06d2499f53230e44ed6ddb2d41c99136f5e3e712603bc3c111af015611e1e","observation_id":"9f163656-9cde-4d67-a8db-f05d86f1c0ee","resolution":{"observed_at":"2026-07-09T22:16:36.338374Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09769","snapshot_observed_at":"2026-07-13T06:48:14.554799Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06988","last_updated":"2026-07-10T02:22:52Z","snapshot_observed_at":"2026-08-07T16:54:08.238920Z","submitted_at":"2026-07-08T04:23:22Z","title":"WAM-TTT: Steering World-Action Models by Watching Human Play at Test Time","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T06:48:14.554799Z"},"links":{"cited_paper":"/paper/2509.09769","citing_paper":"/paper/2607.06988"},"observation_digest":"sha256:24873c4a32011287ac1c8d26083a7c9fc1b0602b3125bd2ac13aa925a7929c49","observation_id":"bca86fbd-c713-43c5-b318-7bf3c3740363","resolution":{"observed_at":"2026-07-13T06:48:14.554799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.09769/citation-record","integrity":"/paper/2509.09769/integrity","json":"/paper/2509.09769/citation-record.json","paper":"/paper/2509.09769"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:35.979246Z","title":"Model-agnostic meta-learning for fast adaptation of deep networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:35.979246Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:09a46845d4fa6f59d7638e5ae34eac3bb09d16078ceb4a112c70b70be38b65a6","observation_id":"49b4c5c5-1134-42d7-890b-13f411560d03","resolution":{"observed_at":"2026-08-04T18:51:35.979246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.01557","last_updated":"2018-02-05T18:36:19Z","snapshot_observed_at":"2026-08-08T14:18:15.699217Z","submitted_at":"2018-02-05T18:36:19Z","title":"One-Shot Imitation from Observing Humans via Domain-Adaptive Meta-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.01557","snapshot_observed_at":"2026-08-04T18:51:35.982472Z","title":"One-shot imitation from observing humans via domain-adaptive meta-learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:35.982472Z"},"links":{"cited_paper":"/paper/1802.01557","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:fde36de63be7ac77c62beb22e46adc4abd76d9b99463e9f9337948698238feb7","observation_id":"8bcd6db7-8ff7-4cde-a333-c674cf4f8a72","resolution":{"observed_at":"2026-08-04T18:51:35.982472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:35.986558Z","title":"Task-embedded control networks for few-shot imitation learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:35.986558Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:c2ed2acd24fc8b9d2929869f0c10251c0af1eec312dff87730700bfcf8501b47","observation_id":"f5075199-53e9-4f50-bbbc-2fd451b1e0c7","resolution":{"observed_at":"2026-08-04T18:51:35.986558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:35.989663Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:35.989663Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:8e8dabd3ddd0cc9c52e84dd3bf0e6a6608ec3c65f6d22bb4f22c69a010ead1f3","observation_id":"4e79cee5-c384-42e8-8fa6-e3c52dea7609","resolution":{"observed_at":"2026-08-04T18:51:35.989663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:35.992047Z","title":"Flamingo: A visual language model for few- shot learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:35.992047Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:d35f5ea69521935a06817baf25cb0a1e27d37c48971fb28d0275794efce3cc62","observation_id":"b0233dc6-c36b-4f2d-b522-0825b6b43474","resolution":{"observed_at":"2026-08-04T18:51:35.992047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:35.995043Z","title":"Prompting decision transformer for few-shot pol- icy generalization,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:35.995043Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:6390450e9eb4c3856424ff0428321d9dd390d558588efd80a65dfa7945d70e00","observation_id":"724a961b-56b2-4e88-b090-13a0d7358b64","resolution":{"observed_at":"2026-08-04T18:51:35.995043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09971","last_updated":"2024-02-01T00:42:31Z","snapshot_observed_at":"2026-08-04T03:14:08.494198Z","submitted_at":"2023-10-15T22:20:39Z","title":"AMAGO: Scalable In-Context Reinforcement Learning for Adaptive Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09971","snapshot_observed_at":"2026-08-04T18:51:35.998019Z","title":"Amago: Scalable in-context reinforcement learning for adaptive agents,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:35.998019Z"},"links":{"cited_paper":"/paper/2310.09971","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:cec79d706d1560e02ee7734599e3ca8ed92ca3f09de67f9f218702635e70ed16","observation_id":"c0b02a88-c2be-414f-b846-d0f8fbb38d4f","resolution":{"observed_at":"2026-08-04T18:51:35.998019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14215","last_updated":"2022-10-25T17:57:49Z","snapshot_observed_at":"2026-08-08T00:48:37.690583Z","submitted_at":"2022-10-25T17:57:49Z","title":"In-context Reinforcement Learning with Algorithm Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14215","snapshot_observed_at":"2026-08-04T18:51:36.001004Z","title":"In-context reinforcement learning with algo- rithm distillation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.001004Z"},"links":{"cited_paper":"/paper/2210.14215","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:d6c151cbe39f805f7e98f2b15e664d361607512194187f12ff26e57db692e570","observation_id":"49b1f0ed-07a2-448f-97d6-684f2da3d7d8","resolution":{"observed_at":"2026-08-04T18:51:36.001004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04759","last_updated":"2025-02-24T16:06:51Z","snapshot_observed_at":"2026-07-06T20:02:35.216265Z","submitted_at":"2024-12-06T03:54:55Z","title":"REGENT: A Retrieval-Augmented Generalist Agent That Can Act In-Context in New Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04759","snapshot_observed_at":"2026-08-04T18:51:36.003802Z","title":"Regent: A retrieval-augmented generalist agent that can act in-context in new environments,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.003802Z"},"links":{"cited_paper":"/paper/2412.04759","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:23b964cca859b90e4bcd429b80d676afa6aebcd507efb14e1f54b59f768844b1","observation_id":"d217f832-5e6c-455a-b125-f53f81695552","resolution":{"observed_at":"2026-08-04T18:51:36.003802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19578","last_updated":"2024-10-17T19:31:39Z","snapshot_observed_at":"2026-08-09T11:45:30.937531Z","submitted_at":"2024-03-28T17:04:00Z","title":"Keypoint Action Tokens Enable In-Context Imitation Learning in Robotics","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19578","snapshot_observed_at":"2026-08-04T18:51:36.007414Z","title":"Keypoint action tokens enable in-context imitation learning in robotics,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.007414Z"},"links":{"cited_paper":"/paper/2403.19578","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:e93bddae1ea38b2b15ea909758303f9e6ededda912c27c276016f5b635b0d9a3","observation_id":"d1f3c36e-f9f0-42d6-9f23-d465ce58dc57","resolution":{"observed_at":"2026-08-04T18:51:36.007414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15980","last_updated":"2024-09-27T20:10:08Z","snapshot_observed_at":"2026-07-06T19:07:16.252072Z","submitted_at":"2024-08-28T17:50:19Z","title":"In-Context Imitation Learning via Next-Token Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15980","snapshot_observed_at":"2026-08-04T18:51:36.010783Z","title":"In-context imitation learning via next-token pre- diction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.010783Z"},"links":{"cited_paper":"/paper/2408.15980","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:277e6f21b9b4ca51ac84ae3ac5c9f5218dce341314836cec122d1f6177ff60ed","observation_id":"e79e46de-9492-40d1-a858-2b00bc01fdc0","resolution":{"observed_at":"2026-08-04T18:51:36.010783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12633","last_updated":"2025-04-25T15:22:45Z","snapshot_observed_at":"2026-08-09T22:16:57.939015Z","submitted_at":"2024-11-19T16:45:52Z","title":"Instant Policy: In-Context Imitation Learning via Graph Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.12633","snapshot_observed_at":"2026-08-04T18:51:36.013303Z","title":"Instant policy: In-context imitation learning via graph diffusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.013303Z"},"links":{"cited_paper":"/paper/2411.12633","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:daae898cd4bbdc17287dc88c219710b543dae182f7155640dffefa222d2f0bda","observation_id":"bc756b72-5d4d-4090-afa6-a22a82fce9ce","resolution":{"observed_at":"2026-08-04T18:51:36.013303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03801","last_updated":"2023-12-06T15:19:28Z","snapshot_observed_at":"2026-08-09T08:26:26.225019Z","submitted_at":"2023-12-06T15:19:28Z","title":"Generalization to New Sequential Decision Making Tasks with In-Context Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03801","snapshot_observed_at":"2026-08-04T18:51:36.016697Z","title":"Generalization to new sequential de- cision making tasks with in-context learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.016697Z"},"links":{"cited_paper":"/paper/2312.03801","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:ef93afd298e6b8309580cc05410f2cb22da99bf939c95e82e848e3904eab6850","observation_id":"93d744c2-b19e-4a63-8727-6175ad7260bc","resolution":{"observed_at":"2026-08-04T18:51:36.016697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17234","last_updated":"2024-09-12T15:22:09Z","snapshot_observed_at":"2026-07-06T18:20:35.626876Z","submitted_at":"2024-05-27T14:50:42Z","title":"Benchmarking General-Purpose In-Context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17234","snapshot_observed_at":"2026-08-04T18:51:36.019940Z","title":"Benchmarking general-purpose in-context learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.019940Z"},"links":{"cited_paper":"/paper/2405.17234","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:c09ee71473e00e8fef8ffb382d5848374bb9ed61d94650813457edc489843ac5","observation_id":"54e1324d-dd74-4240-b012-5a1fbc21dcaf","resolution":{"observed_at":"2026-08-04T18:51:36.019940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04458","last_updated":"2024-01-09T13:38:35Z","snapshot_observed_at":"2026-07-06T14:28:25.630901Z","submitted_at":"2022-12-08T18:30:22Z","title":"General-Purpose In-Context Learning by Meta-Learning Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04458","snapshot_observed_at":"2026-08-04T18:51:36.022159Z","title":"General-purpose in-context learning by meta- learning transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.022159Z"},"links":{"cited_paper":"/paper/2212.04458","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:9c79c6241e0e98619622169450ea2caf270e3b70a1a0825e4ab99eeeea3f931d","observation_id":"b0fb77fe-8fd0-4cb2-b171-cc76dc4ea49f","resolution":{"observed_at":"2026-08-04T18:51:36.022159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02062","last_updated":"2025-08-04T05:01:11Z","snapshot_observed_at":"2026-08-09T09:37:34.204266Z","submitted_at":"2025-08-04T05:01:11Z","title":"RICL: Adding In-Context Adaptability to Pre-Trained Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02062","snapshot_observed_at":"2026-08-04T18:51:36.024764Z","title":"Ricl: Adding in-context adaptability to pre-trained vision-language-action models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.024764Z"},"links":{"cited_paper":"/paper/2508.02062","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:e47c6f22860e8745a0a9e213ab0c9c55734377bba5204c9fe474f17c509f714c","observation_id":"6f9e3fb2-2f4b-4f51-8dde-23275b7f18c2","resolution":{"observed_at":"2026-08-04T18:51:36.024764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.027742Z","title":"Roboturk: A crowdsourcing platform for robotic skill learning through imitation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.027742Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:c4202cb03a1309f0cf0ca4f6083f42b0873a7ca42c805e1007e42b6f15e7c65f","observation_id":"def31ae2-80fe-48f9-96b1-d8309a8ea97c","resolution":{"observed_at":"2026-08-04T18:51:36.027742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-08T01:53:43.555672Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-04T18:51:36.029863Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.029863Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:ebfe325d8ab0ea26ffc23dba8c16ec1abbdc82d5e5aa653dbd7acc553cc2798c","observation_id":"07f99e7f-6d36-4972-b129-f6ba770ffeb3","resolution":{"observed_at":"2026-08-04T18:51:36.029863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.031973Z","title":"Droid: A large-scale in-the-wild robot manipulation dataset,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.031973Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:c438fd2018eef1ac3a97f4ab3566fe6a541342c2bf82e9873dc81154eb7fa4e7","observation_id":"b74bd45c-f74f-4eaa-84d2-b3ffa5aaa2cd","resolution":{"observed_at":"2026-08-04T18:51:36.031973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12422","last_updated":"2023-10-13T05:44:37Z","snapshot_observed_at":"2026-08-08T02:25:42.905263Z","submitted_at":"2023-02-24T02:54:15Z","title":"MimicPlay: Long-Horizon Imitation Learning by Watching Human Play","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12422","snapshot_observed_at":"2026-08-04T18:51:36.033954Z","title":"Mimicplay: Long-horizon imitation learning by watching human play,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.033954Z"},"links":{"cited_paper":"/paper/2302.12422","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:2bbe4e76a95c872b16115611d0e5bdf988ee94c01430166982d1b28ce3c92ef4","observation_id":"8b1c8003-e080-485b-b741-df5d63ee743f","resolution":{"observed_at":"2026-08-04T18:51:36.033954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.037439Z","title":"Learning latent plans from play,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.037439Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:3636d559614ffea51db47769f9dd1326c6425f85aea978393dd10f3cbf0ccd22","observation_id":"37bb429d-0435-4457-96ac-f0202c3c5f22","resolution":{"observed_at":"2026-08-04T18:51:36.037439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.15943","last_updated":"2022-05-03T10:36:39Z","snapshot_observed_at":"2026-07-06T12:03:35.232581Z","submitted_at":"2021-10-29T17:42:08Z","title":"MetaICL: Learning to Learn In Context","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.15943","snapshot_observed_at":"2026-08-04T18:51:36.039660Z","title":"Metaicl: Learning to learn in context,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.039660Z"},"links":{"cited_paper":"/paper/2110.15943","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:c97fb4cc702b360e6219472acbae4b0821527531999aceb4348a1509ed43c22c","observation_id":"9bf8e2bb-386b-424e-8cd8-5854ade764b1","resolution":{"observed_at":"2026-08-04T18:51:36.039660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.042123Z","title":"Okami: Teaching humanoid robots manipulation skills through single video imitation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.042123Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:1394495c645d90ed18803f49f5c660e85d822162f5393d67a4b715e5b50906f4","observation_id":"dd95dc28-dced-43dd-8a9d-070730f29998","resolution":{"observed_at":"2026-08-04T18:51:36.042123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.044696Z","title":"Humanoid policy˜ human policy,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.044696Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:f80d88d220086ddc1ff69e14f603a1eca45c1f99ac4f98b68e2e20d505e9afbc","observation_id":"8a51b61e-29aa-4413-aa4d-e71152c903c6","resolution":{"observed_at":"2026-08-04T18:51:36.044696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.046884Z","title":"Representation and control of the task space in humans and humanoid robots,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.046884Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:d07ea2de3c753ce858af310ef76e79c05e12c05bc6b03ef0b2641952fbc69cb6","observation_id":"509fba2d-f547-4d7d-a2b1-a95c9a41648b","resolution":{"observed_at":"2026-08-04T18:51:36.046884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.049590Z","title":"Masked autoencoders are scalable vision learners,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.049590Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:3f4f68f73722cfa0160e6e06595cca25b6e4d700230af4bd7046b7e38a1e69ed","observation_id":"f88b31c8-61c2-44e0-8b32-f35e88c2554f","resolution":{"observed_at":"2026-08-04T18:51:36.049590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14391","last_updated":"2025-04-10T07:50:15Z","snapshot_observed_at":"2026-07-06T17:20:33.356092Z","submitted_at":"2024-01-25T18:49:57Z","title":"Rethinking Patch Dependence for Masked Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14391","snapshot_observed_at":"2026-08-04T18:51:36.051840Z","title":"Rethinking patch dependence for masked autoen- coders,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.051840Z"},"links":{"cited_paper":"/paper/2401.14391","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:af5751e338b5aee08d4821b35d264ab905acc27230496dcb3392fee048052e2a","observation_id":"3ec0d3bc-0cb9-44a5-ae09-2088c2739165","resolution":{"observed_at":"2026-08-04T18:51:36.051840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12943","last_updated":"2024-08-27T23:15:11Z","snapshot_observed_at":"2026-07-06T17:47:13.814205Z","submitted_at":"2024-03-19T17:47:37Z","title":"Vid2Robot: End-to-end Video-conditioned Policy Learning with Cross-Attention Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12943","snapshot_observed_at":"2026-08-04T18:51:36.054289Z","title":"Vid2robot: End-to-end video-conditioned pol- icy learning with cross-attention transformers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.054289Z"},"links":{"cited_paper":"/paper/2403.12943","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:e95523fb5a4abef09a722f23e9990256d9877cf0c31e8058508051b0731dca17","observation_id":"10acbeeb-755b-47a5-817c-206621baabf8","resolution":{"observed_at":"2026-08-04T18:51:36.054289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02011","last_updated":"2023-02-03T21:39:52Z","snapshot_observed_at":"2026-07-06T14:48:14.652568Z","submitted_at":"2023-02-03T21:39:52Z","title":"Zero-Shot Robot Manipulation from Passive Human Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02011","snapshot_observed_at":"2026-08-04T18:51:36.056679Z","title":"Zero-shot robot manipulation from pas- sive human videos,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.056679Z"},"links":{"cited_paper":"/paper/2302.02011","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:f035ddfe3304c10d33fc16e67bde7d333b1a3ae1db0e323ab52b31f70611ed5c","observation_id":"40cd3cc1-a873-4d66-b080-b5d106956de5","resolution":{"observed_at":"2026-08-04T18:51:36.056679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.058929Z","title":"Hand me the data: Fast robot adaptation via hand path retrieval,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.058929Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:cbc89cdea628172d217eef7562aa7e5046f8f0702a2b32104e69111239fa6b8c","observation_id":"b60583e3-30e0-459a-849a-ee1c62674b06","resolution":{"observed_at":"2026-08-04T18:51:36.058929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.060965Z","title":"Robocasa: Large-scale simulation of ev- eryday tasks for generalist robots,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.060965Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:a54af57409f35b8cd82feddc1769930ff986699e7c7b8999bb5831e17eaa329b","observation_id":"918742f8-31b4-4d7f-ad6f-a71874cdc860","resolution":{"observed_at":"2026-08-04T18:51:36.060965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.12293","last_updated":"2025-01-18T02:57:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-25T15:32:31Z","title":"robosuite: A Modular Simulation Framework and Benchmark for Robot Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.12293","snapshot_observed_at":"2026-08-04T18:51:36.063023Z","title":"Robosuite: A modular simulation frame- work and benchmark for robot learning,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.063023Z"},"links":{"cited_paper":"/paper/2009.12293","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:12d1f80fa889d9334a45ea24a4a9c196042bf85513d2638fd4cc7f614fc0208c","observation_id":"8ebeba5f-2ff0-44c0-b08a-a321f91e036d","resolution":{"observed_at":"2026-08-04T18:51:36.063023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.065798Z","title":"Evolutionary principles in self-referential learning,","venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.065798Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:de9dea546464b50692fe4846e66150b0f4ccf5c5f8fb78edf63c84d47b116dbc","observation_id":"32148449-3222-4240-9882-2ea1883395bd","resolution":{"observed_at":"2026-08-04T18:51:36.065798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.068210Z","title":"Meta-neural networks that learn by learning,","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.068210Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:d1cb94d3f2723421c88dfe8907ca93cb6aad159f12f2fc696c5b5f8e248cf44e","observation_id":"aee686bf-a4e2-4d51-80de-505bdfcf9e6b","resolution":{"observed_at":"2026-08-04T18:51:36.068210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.070278Z","title":"Meta-learning with memory-augmented neu- ral networks,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.070278Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:d21427dbabff5564482346d6c3d838dfe574bba73bd8e15f543beca6bf73d03f","observation_id":"fa7d62ca-4592-4742-9683-69c6a161def8","resolution":{"observed_at":"2026-08-04T18:51:36.070278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.072563Z","title":"Learning to learn using gradient descent,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.072563Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:c6521d38d44d749566d9025809469b885d6c0b04888d002ffd17562b15b6fa6b","observation_id":"02400fbd-9494-42c3-b527-6552e639eb97","resolution":{"observed_at":"2026-08-04T18:51:36.072563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.02779","last_updated":"2016-11-10T01:17:36Z","snapshot_observed_at":"2026-08-02T07:58:55.035919Z","submitted_at":"2016-11-09T00:13:29Z","title":"RL$^2$: Fast Reinforcement Learning via Slow Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.02779","snapshot_observed_at":"2026-08-04T18:51:36.074938Z","title":"Rl2: Fast reinforcement learning via slow reinforcement learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.074938Z"},"links":{"cited_paper":"/paper/1611.02779","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:5c4bf3330ef0a6b515e1a7a0f1c81e5ac8dd9252f4d5b6166d0fedca9029ebcf","observation_id":"adc6d6fb-deb2-42c8-9d04-e7115d8d3350","resolution":{"observed_at":"2026-08-04T18:51:36.074938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.077854Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.077854Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:5462530e6d606065e7998bcf3540bed08b074f2914e01e8f80a5abee20b6ca46","observation_id":"cdc1fc02-0533-4b80-9b16-a0a1c38eb02e","resolution":{"observed_at":"2026-08-04T18:51:36.077854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03380","last_updated":"2021-11-11T19:06:52Z","snapshot_observed_at":"2026-08-08T00:23:32.174067Z","submitted_at":"2021-07-07T17:59:07Z","title":"RRL: Resnet as representation for Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03380","snapshot_observed_at":"2026-08-04T18:51:36.079940Z","title":"Rrl: Resnet as representation for reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.079940Z"},"links":{"cited_paper":"/paper/2107.03380","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:a10200e82915c861e13e616a85a6cb035540d1f42679cd337531b17a93572a17","observation_id":"dca32268-79bc-46cc-8be0-8ab31de29413","resolution":{"observed_at":"2026-08-04T18:51:36.079940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12601","last_updated":"2022-11-18T05:57:09Z","snapshot_observed_at":"2026-08-02T11:48:59.131827Z","submitted_at":"2022-03-23T17:55:09Z","title":"R3M: A Universal Visual Representation for Robot Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.12601","snapshot_observed_at":"2026-08-04T18:51:36.082371Z","title":"R3m: A universal visual representation for robot manipulation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.082371Z"},"links":{"cited_paper":"/paper/2203.12601","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:083867f49740129b24b822a33321f197ead8bfceed3c1b147a761fd93e7119a2","observation_id":"c69ccdf7-8877-4ac6-ae8a-ee135e90f0c8","resolution":{"observed_at":"2026-08-04T18:51:36.082371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.085131Z","title":"Where are we in the search for an artificial visual cortex for embodied intelligence?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.085131Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:77fa43fba6bdd16481593fb961e592a933b46be48f07a9bd4376942c68d50413","observation_id":"5d7d30ec-7118-44fe-994b-5689878dff2d","resolution":{"observed_at":"2026-08-04T18:51:36.085131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.087661Z","title":"Concept2robot: Learning manipulation concepts from instructions and human demonstrations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.087661Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:c04ef73085a2026bfdb98458e5a10cea80a545476819d7fb365d06574f35974f","observation_id":"873910a3-fe4f-49e8-b716-9e1ff0868e50","resolution":{"observed_at":"2026-08-04T18:51:36.087661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.089935Z","title":"Liv: Language-image representations and rewards for robotic control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.089935Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:0ba6aa7e174cfb13486f1e14733fd4876346a9fa2c8e2f0f7445948ff828c343","observation_id":"c4a10568-dce8-441f-8e13-4eb6d82b2fa4","resolution":{"observed_at":"2026-08-04T18:51:36.089935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00030","last_updated":"2023-03-07T02:29:59Z","snapshot_observed_at":"2026-08-02T00:17:16.761436Z","submitted_at":"2022-09-30T18:14:07Z","title":"VIP: Towards Universal Visual Reward and Representation via Value-Implicit Pre-Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.00030","snapshot_observed_at":"2026-08-04T18:51:36.092177Z","title":"Vip: Towards universal visual reward and representation via value-implicit pre-training,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.092177Z"},"links":{"cited_paper":"/paper/2210.00030","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:f509d474a5eecfef27244d835bf933d80c34c06db408226c5b01a2dcfedb6169","observation_id":"bb877225-36ee-4d3a-a5ee-bbf5e02b9119","resolution":{"observed_at":"2026-08-04T18:51:36.092177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23289","last_updated":"2024-10-30T17:59:41Z","snapshot_observed_at":"2026-07-06T19:42:25.742756Z","submitted_at":"2024-10-30T17:59:41Z","title":"Bridging the Human to Robot Dexterity Gap through Object-Oriented Rewards","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23289","snapshot_observed_at":"2026-08-04T18:51:36.094634Z","title":"Bridging the human to robot dex- terity gap through object-oriented rewards,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.094634Z"},"links":{"cited_paper":"/paper/2410.23289","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:621a7c998a3827521dc985c18fae1b524ea0e959a7e3488c5d9c6b36d6a58f7c","observation_id":"ab8183e0-9cea-4518-8edf-f37c2a33ba02","resolution":{"observed_at":"2026-08-04T18:51:36.094634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03666","last_updated":"2024-05-06T17:43:34Z","snapshot_observed_at":"2026-07-06T18:10:33.673157Z","submitted_at":"2024-05-06T17:43:34Z","title":"ScrewMimic: Bimanual Imitation from Human Videos with Screw Space Projection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03666","snapshot_observed_at":"2026-08-04T18:51:36.096917Z","title":"Screwmimic: Bimanual imitation from human videos with screw space projection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.096917Z"},"links":{"cited_paper":"/paper/2405.03666","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:c63a7430a0ca8481537fa16b67cdc4e5ed8cc58ff3cfaf8b8fdf2fb3e0b80288","observation_id":"2e30f510-7f36-47ca-a90a-90391e87da85","resolution":{"observed_at":"2026-08-04T18:51:36.096917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24221","last_updated":"2024-10-31T17:59:55Z","snapshot_observed_at":"2026-08-08T12:50:43.490549Z","submitted_at":"2024-10-31T17:59:55Z","title":"EgoMimic: Scaling Imitation Learning via Egocentric Video","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24221","snapshot_observed_at":"2026-08-04T18:51:36.099335Z","title":"Egomimic: Scaling imitation learning via egocentric video,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.099335Z"},"links":{"cited_paper":"/paper/2410.24221","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:c56b65f59c1c2b73a5a63c81e38a833d7275547ebade24c6fc45d828600bfa23","observation_id":"32091f57-4abb-4acf-95f9-b25915a68215","resolution":{"observed_at":"2026-08-04T18:51:36.099335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.101720Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.101720Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:5f5f8037441100d2490568a9ba422bd226daed7d7eab73b13fd5896ee1bb3f66","observation_id":"7e090c30-8b6c-4e10-8bf9-d753907dd415","resolution":{"observed_at":"2026-08-04T18:51:36.101720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.103866Z","title":"Reconstructing hands in 3D with transform- ers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.103866Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:39a72678754fbedfe293f2b13079a15cfa8a85d13c5503078317ecb8f64a65f8","observation_id":"9fde1f81-89cf-4b44-bd30-56569c5c6e50","resolution":{"observed_at":"2026-08-04T18:51:36.103866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00779","last_updated":"2026-05-28T01:50:51Z","snapshot_observed_at":"2026-08-07T17:36:17.604857Z","submitted_at":"2025-03-02T08:06:55Z","title":"Phantom: Training Robots Without Robots Using Only Human Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00779","snapshot_observed_at":"2026-08-04T18:51:36.106113Z","title":"Phantom: Training robots without robots using only human videos,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.106113Z"},"links":{"cited_paper":"/paper/2503.00779","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:0507de7435e0d20167b091afea25449cc7a89aff31f316c128a67c1ac891dc2c","observation_id":"95d91406-94d2-4a22-a1e9-38d3cc1a2ba9","resolution":{"observed_at":"2026-08-04T18:51:36.106113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20321","last_updated":"2025-09-04T08:23:37Z","snapshot_observed_at":"2026-08-07T22:46:10.482452Z","submitted_at":"2024-05-30T17:56:54Z","title":"Vision-based Manipulation from Single Human Video with Open-World Object Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20321","snapshot_observed_at":"2026-08-04T18:51:36.108784Z","title":"Vision-based manipulation from single hu- man video with open-world object graphs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.108784Z"},"links":{"cited_paper":"/paper/2405.20321","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:990a2d2ed5bf4c30278615fcd8a9c9008eafe02ace6863d7fc23dd717318f386","observation_id":"f3066f7f-e8a0-4f0c-8bc1-bb9f7a5c211f","resolution":{"observed_at":"2026-08-04T18:51:36.108784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-09T18:02:17.307812Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-04T18:51:36.111093Z","title":"Dinov2: Learning robust visual features with- out supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.111093Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:232eee959f9f9fa8eb7f562f22eb4e371e38c8de6bc0ad9d1c71ff85e3199608","observation_id":"b7a1aacb-ddf0-4850-9ced-6162638e0d3f","resolution":{"observed_at":"2026-08-04T18:51:36.111093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13705","last_updated":"2023-04-23T19:10:53Z","snapshot_observed_at":"2026-08-03T01:22:01.078078Z","submitted_at":"2023-04-23T19:10:53Z","title":"Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13705","snapshot_observed_at":"2026-08-04T18:51:36.113708Z","title":"Learning fine-grained bimanual manipulation with low-cost hardware,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.113708Z"},"links":{"cited_paper":"/paper/2304.13705","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:df5bc34e8d603fbed51e03caa56f7db2895f313248b4aef15acd9ea80633a9ae","observation_id":"c7959343-5e0f-4470-ab35-d99baa8b485a","resolution":{"observed_at":"2026-08-04T18:51:36.113708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.116533Z","title":"Robocasa: Large-scale simulation of ev- eryday tasks for generalist robots,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.116533Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:d0ab31eaa4aa787845ded45e0a3439e3c3c365f21c3f46adfe23c1bb0e078bdd","observation_id":"629086a4-0c76-4702-99f1-dcef23c9f511","resolution":{"observed_at":"2026-08-04T18:51:36.116533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.118520Z","title":"Legato: Cross-embodiment imitation using a grasping tool,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.118520Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:05c6e0d98f5284f7731b5c7c0c4baa431519e9107e80ea232030b9305c69cedb","observation_id":"c68f25b1-6ea0-4947-a80c-0f1efd5fdb79","resolution":{"observed_at":"2026-08-04T18:51:36.118520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13669","last_updated":"2024-05-28T06:39:17Z","snapshot_observed_at":"2026-08-09T22:54:11.912855Z","submitted_at":"2024-02-21T10:06:08Z","title":"Self-Distillation Bridges Distribution Gap in Language Model Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13669","snapshot_observed_at":"2026-08-04T18:51:36.121101Z","title":"Self-distillation bridges distribution gap in lan- guage model fine-tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.121101Z"},"links":{"cited_paper":"/paper/2402.13669","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:78adeb8af87fb2ac2d8f04f62a6db1284450941c7e546c65e8c33f53f4c8ea17","observation_id":"b139d678-ebc3-4869-83b6-b94fe3e0e069","resolution":{"observed_at":"2026-08-04T18:51:36.121101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.123316Z","title":"Does continual learning equally forget all pa- rameters?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.123316Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:ec12f7455f040ec22bd919f5d595810a2bb62b6dbf251b9ac29747fae1c2161f","observation_id":"9c882efb-1139-4228-b6eb-e800c10490ce","resolution":{"observed_at":"2026-08-04T18:51:36.123316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.125796Z","title":"Segment anything,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.125796Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:eef00c340cd73096425209dd586188bbc7e7ad35e6cec895a62f0885171f9b03","observation_id":"eaca2272-ab9b-4419-9cba-fef227e19ff3","resolution":{"observed_at":"2026-08-04T18:51:36.125796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.127656Z","title":"Decoupling human and camera motion from videos in the wild,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.127656Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:f921cd4ea9eb66a179ba5869c2628a2c7cd10a368453943f84b020819492c86f","observation_id":"21fce94b-14a0-4ddf-a77e-23c89142ee12","resolution":{"observed_at":"2026-08-04T18:51:36.127656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-08T20:08:45.321600Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":59,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 9 inbound Pith citation observations for arXiv:2509.09769."}