{"as_of":"2026-08-17T21:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:13e26e375b45175d31b84062c9b1331d88cd93a748f33ece215ca062f9604524","coverage":[{"denominator":169,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T19:16:57.396710Z","state":"measured"},{"denominator":102,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":102,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:17:24.978338Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-10T21:18:37.447702Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.04426","snapshot_observed_at":"2026-08-15T15:17:24.978338Z","title":"arXiv preprint arXiv:2607.04426 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-16T22:08:01.798525Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.978338Z"},"links":{"cited_paper":"/paper/2607.04426","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:123ffc4a1636c3d0ddad27c562e0b02bf398dd9c4ef594a9c656fe4b70e6c750","observation_id":"552d0570-b757-4edb-867b-e7857617e555","resolution":{"observed_at":"2026-08-15T15:17:24.978338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"cited_work":{"arxiv_id":"2607.04426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.04426","snapshot_observed_at":"2026-08-10T21:18:37.447702Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","venue":"cs.RO","work_id":"74fc0c93-7d14-47fa-bcfe-8f9b93234ce8","year":2026},"citing_paper":{"arxiv_id":"2608.06756","last_updated":"2026-08-07T03:24:25Z","snapshot_observed_at":"2026-08-17T14:09:11.939745Z","submitted_at":"2026-08-07T03:24:25Z","title":"Capek 0.5: An Execution-Centric Vision-Language Model for Embodied Intelligence","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:33.164594Z"},"links":{"cited_paper":"/paper/2607.04426","citing_paper":"/paper/2608.06756"},"observation_digest":"sha256:96cbf2f94a13a670b99c28a70fd01592bda0bd0e301d796d66bc186cec9cbfe4","observation_id":"7f6474f4-f9c4-455f-9091-189374bf72e2","resolution":{"observed_at":"2026-08-10T21:18:37.517943Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2607.04426/citation-record","integrity":"/paper/2607.04426/integrity","json":"/paper/2607.04426/citation-record.json","paper":"/paper/2607.04426"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"A survey of embodied ai: From simulators to research tasks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:03f915a691d272ff2bad38c42966464c25b504686606262fbf07d50807772507","observation_id":"141927ee-73c4-4369-bbef-f41d36144431","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02385","last_updated":"2024-02-04T07:55:01Z","snapshot_observed_at":"2026-08-16T14:21:45.728518Z","submitted_at":"2024-02-04T07:55:01Z","title":"A Survey on Robotics with Foundation Models: toward Embodied AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02385","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"A survey on robotics with foundation models: Toward embodied ai","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2402.02385","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:db01739b46687f92742f674ad5fed1b5962eba1560d9e266dfb91df325e07155","observation_id":"9c1edee8-2682-463f-a42f-df7bb3e171f7","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18088","last_updated":"2025-08-27T17:52:42Z","snapshot_observed_at":"2026-08-01T01:17:47.017808Z","submitted_at":"2025-06-22T16:26:53Z","title":"RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18088","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Robotwin 2.0: A scalable data generator and benchmark with strong domain randomization for robust bimanual robotic manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2506.18088","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:deb93628c2d6839c92f6e9753a0078657a7b99cd28f305e11b5ba80182fc04b9","observation_id":"60a72b50-6c7b-4375-a943-681ffe53f303","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-17T09:56:52.502317Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Internvl3: Exploring advanced training and test-time recipes for open-source multimodal models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:b4ac2f4c9e444d4aa45d2cc2bc40ebfc08e332523a731e4328bc645341d45712","observation_id":"58165d18-7887-405b-baa3-2afbd455deb6","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Qwen3-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:25ec9518a85409369cc9ac766d8d84f7faabf24d836d88523c530354b274e9a8","observation_id":"28cf012f-3d06-4319-b46c-5ef29d0e95ec","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Qwen3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:5591015efc18b0ff71fe404101ed0e079c1e5c760e84e6fabcc7779f09eb01f2","observation_id":"5533c13a-09e7-414d-89d0-1ff840ab15ab","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:e16689e6c75830e3b02413e48034229fb40d407b1a3ef9f58ee41ce22b7fae61","observation_id":"2ef9bf37-7c1e-41a8-bc78-7a46816425ac","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.18112","last_updated":"2026-06-29T05:42:10Z","snapshot_observed_at":"2026-08-15T10:08:47.759397Z","submitted_at":"2026-06-16T16:17:44Z","title":"Qwen-RobotNav Technical Report: A Scalable Navigation Model Designed for an Agentic Navigation System","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.18112","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Qwen-robotnav technical report: A scalable navigation model designed for an agentic navigation system","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2606.18112","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:11845b8800593721de7e491a43ec5c7388878701b5564dd4f515e90f98e41647","observation_id":"bda8b1a1-daa3-4a73-9f9d-525f9dd8159b","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Embodied navigation foundation model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:dab01defbefc0325f48966aae37870666db1b71e613f6ce75eb3b6dddc9e85ba","observation_id":"6ba5691b-b952-4833-bc33-a6304beed28a","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-08-16T17:53:54.636855Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"π0: A vision-language-action flow model for general robot control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:7886235a4f1fd7284b2f3de957f5e5634b7a107aa244d3950b2905e8a5ad2e42","observation_id":"53966804-dddf-43d0-bed7-fdefd305dd56","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15922","last_updated":"2026-02-17T15:04:02Z","snapshot_observed_at":"2026-08-09T12:54:21.149243Z","submitted_at":"2026-02-17T15:04:02Z","title":"World Action Models are Zero-shot Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15922","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"World action models are zero-shot policies","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2602.15922","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:dd40c0b4ccd57fb7a03f80cc69e8c651413f02a6d8cd7b4fba5aab7afedc9b75","observation_id":"a9fa1942-49dc-429a-bcd5-2b4629eb556d","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"RoboReward: General-purpose vision-language reward models for robotics","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:f6c0946810e0228fcd726f0dc5f164ee08b0405e8ac50fdca7d3875b04399b3f","observation_id":"1c4aa590-11c8-4afe-b1f8-4c74f3172d39","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.02115","last_updated":"2026-05-13T21:07:49Z","snapshot_observed_at":"2026-08-12T16:18:51.295325Z","submitted_at":"2026-03-02T17:38:58Z","title":"Robometer: Scaling General-Purpose Robotic Reward Models via Trajectory Comparisons","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.02115","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"RoboMeter: Scaling general-purpose robotic reward models via trajectory comparisons","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2603.02115","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:e10fbe05dcbeb73b25cbf102fbfb543f13c7ad1e56ff69375176745f44872a48","observation_id":"59ebd359-cb5b-44bd-a2ae-eacdf6469054","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":null,"venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:4bf5a8a2f6f7ab9d38200fab3550483864bb6a38d864e4a2f3c0bf5668a685ff","observation_id":"bd073da7-9d4e-4522-bdcb-dcf59df884ce","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":null,"venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:7fcb326a52b32f5c3757f8634936c543c4c9ab4bc878dcee1a1c93b9911b5f06","observation_id":"504a61aa-e041-4261-bd8e-a3b130c7d4ec","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:8d5f6d94f357341da0c5b9aa9d049a392eee94e6b88ae5d7dde5ab0b2e19fb3f","observation_id":"4059a9bd-021a-41ec-b698-9c681b8e03ad","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"π0.5: A vision-language-action model with open-world generalization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:89ab0f3d6a065f5c1edc86ec245eb6cf3f8054d4bf0c6aad1edb8e91fb85cec1","observation_id":"a11f0199-c5a2-48cd-8264-5b744e947274","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Interleave-vla: Enhancing robot manipulation with interleaved image-text instructions, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:6a27d95d68941c08079332e2abe4fd676065c50f65e9481e85230bcaa8f2163b","observation_id":"d8024768-a443-4f5e-8af0-e68f88e5c6cd","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Do as i can, not as i say: Grounding language in robotic affordances","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:48b995c177f9626b632e49992c34fdb55712dd58d7e5e6ea2f52acb323dd9161","observation_id":"9b4a8d58-da77-4c2d-9b77-64e09f539bfa","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"PaLM-E: An embodied multimodal language model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:860c9e7f8374b1d7e41baef672144c614f98ff49b16fc58f8b1d4a1aa8bfedc7","observation_id":"f70ceaa5-d7ca-4acb-8659-72802253413f","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Code as policies: Language model programs for embodied control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:9a03a2e816b62bf417c4ff838bf491238e91875af07976e529456caaf29c3628","observation_id":"b058d83b-7b2b-4987-b783-11ed6293f832","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Voxposer: Composable 3d value maps for robotic manipulation with language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:408d119c5fe3411a58c24bc1ddbae668df6a3099fca3babfad6a668d1d3cc42a","observation_id":"648bb15a-ea49-4431-8936-94d9c26d43f5","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"RoboCodeX: Multimodal code generation for robotic behavior synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:b09b10fc9285737787e9e3972f12d6054c655905211c451ecc6a61b57e0b9335","observation_id":"2cc9a582-2bab-45f3-9454-e90d5452ef79","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07774","last_updated":"2026-04-09T04:01:27Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T04:01:27Z","title":"RoboAgent: Chaining Basic Capabilities for Embodied Task Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.07774","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"RoboAgent: Chaining basic capabilities for embodied task planning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2604.07774","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:f90592334f6f20662adab184a71c27da19e12c65ed3626775b76c5e941d7910f","observation_id":"5e62c089-d830-47c1-8049-ff8edd7b22ab","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Gr00t n1: An open foundation model for generalist humanoid robots","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:777055c6ff265ba4167e6664bdb3502aff3241f00a1368f944d8a1781c513874","observation_id":"4a918928-a2f2-482a-b288-595ea9092593","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Gr00t n1.5: An improved open foundation model for generalist humanoid robots","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:bdcd09e476972752c2062b6b2281699bac54cad3bad96939ce48184856c4906b","observation_id":"ada86e16-2b55-4088-a0a5-0fe7598a8668","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.30280","last_updated":"2026-06-01T13:48:35Z","snapshot_observed_at":"2026-08-04T01:13:02.026321Z","submitted_at":"2026-05-28T17:36:31Z","title":"Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.30280","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Qwen-vla: Unifying vision-language-action modeling across tasks, environments, and robot embodiments","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2605.30280","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:de19628ebac7034c2427d1ffa94b07405187ad98be248a47faf7adcfcd368710","observation_id":"9766699a-0bce-4b34-b608-09ec4ea3ec5a","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.17030","last_updated":"2026-06-17T13:54:57Z","snapshot_observed_at":"2026-08-01T21:48:31.832288Z","submitted_at":"2026-06-15T17:52:31Z","title":"Qwen-RobotWorld Technical Report: Unifying Embodied World Modeling through Language-Conditioned Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.17030","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Qwen-robotworld technical report: Unifying embodied world modeling through language- conditioned video generation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2606.17030","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:0f61002fd1f277f23ec78a9b81f743d9e13ee86263f4183a16292bd3cefbf743","observation_id":"d342d7b5-fe9e-46dd-997f-5ec135fef29f","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.11236","last_updated":"2026-04-14T10:01:08Z","snapshot_observed_at":"2026-07-06T22:45:29.609382Z","submitted_at":"2026-02-11T16:47:01Z","title":"ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.11236","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Abot-m0: Vla foundation model for robotic manipulation with action manifold learning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2602.11236","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:a33f44a34b4f7aef2ca2d8abb9468fea773b150ff3a17a659e267e7cd27feb82","observation_id":"56ec2478-6d79-44df-9007-85ba28ba5160","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Rynnbrain: Open embodied foundation models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:67a606d2bcf777d9b6c4c58a83d00d1ba466a042d495379181ad8204e1c7b19f","observation_id":"8bb52d65-6ea9-4646-81c9-beee96f73e00","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.02800","last_updated":"2026-06-23T17:33:32Z","snapshot_observed_at":"2026-07-06T23:43:07.940839Z","submitted_at":"2026-06-01T19:12:30Z","title":"Cosmos 3: Omnimodal World Models for Physical AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.02800","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Cosmos 3: Omnimodal world models for physical ai","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2606.02800","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:9c71c7fd75d3a85e7fd5e27a7ef389d1599d5be9d73a4c75457bb1831a3db7f1","observation_id":"2e3ebbcd-57e3-4dbe-8636-e49b96634871","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Ace-brain-0: Spatial intelligence as a shared scaffold for universal embodiments","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:6dcff6644706c9230de7196f9c8a9f10bb8e91cca434cdfa8e377d0a4c5bd3d3","observation_id":"ff92efcc-6e25-4e7c-a4aa-2ecb99a70e42","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15153","last_updated":"2026-05-21T16:50:35Z","snapshot_observed_at":"2026-08-13T15:29:21.214754Z","submitted_at":"2026-05-14T17:50:42Z","title":"Pelican-Unify 1.0: A Unified Embodied Intelligence Model for Understanding, Reasoning, Imagination and Action","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.15153","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Pelican-unify 1.0: A unified embodied intelligence model for understanding, reasoning, imagination and action","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2605.15153","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:6d1632b2c764c58b518557fd8ef73ee07d8dfedeaa42bdb18befd21d2b116abc","observation_id":"d107ad8e-e58f-4504-99cf-7b901ab047d2","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07430","last_updated":"2026-04-08T17:59:48Z","snapshot_observed_at":"2026-08-16T10:04:29.797860Z","submitted_at":"2026-04-08T17:59:48Z","title":"HY-Embodied-0.5: Embodied Foundation Models for Real-World Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.07430","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Hy-embodied-0.5: Embodied foundation models for real-world agents","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2604.07430","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:d6c2287a99778288c7e01f1dea3f3dff3d2868f937a6f9db5906fe27b616e127","observation_id":"52869e84-c7ed-44fc-8db0-d9ee91b7629b","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.15483","last_updated":"2026-04-24T23:18:28Z","snapshot_observed_at":"2026-08-11T15:03:01.640683Z","submitted_at":"2026-04-16T19:18:07Z","title":"${\\pi}_{0.7}$: a Steerable Generalist Robotic Foundation Model with Emergent Capabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.15483","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2604.15483","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:a0269e4e3814c882548777c18705ff2b2f457b6984309e40effe19c604316997","observation_id":"77f5b74a-e87a-4d66-98ab-3129af903266","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"π∗ 0.6: a vla that learns from experience","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:1b6709c2e6b9cdf41f3b1d15cc44defa251775d83578a42a29f91ef454b3c966","observation_id":"ceda9816-273d-4627-b6d5-b6722cf28e35","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.11324","last_updated":"2026-07-11T14:44:40Z","snapshot_observed_at":"2026-07-16T23:17:53.174457Z","submitted_at":"2026-06-09T18:07:50Z","title":"Embodied-R1.5: Evolving Physical Intelligence via Embodied Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.11324","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Embodied-r1","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2606.11324","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:386a2d5d16eaad8392bc63dab72f39ceaa28cb846f71a169e6cee2f605819f14","observation_id":"40513af3-cfa8-4723-8f19-3c1572883530","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.02881","last_updated":"2026-05-08T04:21:51Z","snapshot_observed_at":"2026-08-16T22:33:00.868689Z","submitted_at":"2026-05-04T17:51:21Z","title":"MolmoAct2: Action Reasoning Models for Real-world Deployment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.02881","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Molmoact2: Action reasoning models for real-world deployment","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2605.02881","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:642013dc54a3ecf250ebadf4cecf02b5b35a96ba8d9d77c2b37dd4327f6e45f8","observation_id":"7093daec-0540-48bc-a710-2b00f05698e1","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.17846","last_updated":"2026-06-17T17:06:39Z","snapshot_observed_at":"2026-08-01T08:00:11.218777Z","submitted_at":"2026-06-16T12:14:39Z","title":"Qwen-RobotManip Technical Report: Alignment Unlocks Scale for Robotic Manipulation Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.17846","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Qwen-robotmanip technical report: Alignment unlocks scale for robotic manipulation foundation models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2606.17846","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:91ab3fb41b68d3962e511b321128d840be7dc0d5df9f8c1cf177271a8b3d7a41","observation_id":"a1a78ed6-52c2-4e16-9127-fcb0dc4d66a5","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Abot-n0: Technical report on the vla foundation model for versatile embodied navigation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:873192e58fb8d992b40d333dec1d0b60915a6f5886ed25b14c2472b1ab43db15","observation_id":"5af40899-3c4d-49ba-83e9-a1d7e7a60108","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Gemini Robotics-ER 1.6: Powering real-world robotics tasks through enhanced em- bodied reasoning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:6dfe34558a38a149fc4b0b8ea910b9922e39c80ae7416ae54d5dbeffb93ed3b8","observation_id":"faaff22f-dfa0-47c9-8ab1-15d592b83ca9","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Introducing helix 02: Full-body autonomy, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:33e617d5d2b6449d51690fe9f773665d19c086ba2ff082ddfc3960a568f7abb4","observation_id":"fcf9ce38-f87e-4df2-a044-3f947ac31eaf","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Model merging in llms, mllms, and beyond: Methods, theories, applications, and opportunities","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:4cd2dfc13a1b3ea2b0bd67bc4e2f3b531a53941d9744a99625b04ae91cbe00bb","observation_id":"e8e959ef-3a8e-47aa-9716-2f0f78c9795c","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:bcf0abf6a10cfb26961f509d4899d4b61e712ab3ac972b20c18cbb1062cf70fc","observation_id":"c77a7c9f-8fed-43b9-914a-4b149fa1fc46","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:b7d03c874da40346a6a74c874cfaa6ee898d496e188e687109332e613b47b767","observation_id":"c260d960-5da1-4142-80a2-d5343894d2a4","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Gpt-4o system card.https://openai.com/index/gpt-4o-system-card/, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:dd8b458efd586a932ff4355ed917adb5080bc72cc59f96d6c36c8f9bd77c93c8","observation_id":"f058b581-ad60-4015-b802-a7787c392e00","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Claude sonnet 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:33e9b9d3dfb34c5f49d257c8520bf19757b56de072a13bcbb7a0d9c7b710e8d4","observation_id":"c7c7f3ab-af64-4758-81aa-258786bb90f7","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"SpatialVLM: Endowing vision-language models with spatial reasoning capabilities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:bc3216f32e019dd836ea9c79ceb2659cc50e78815aff6850c999312e6a9899f8","observation_id":"b8cdf4f8-057f-405f-a32c-8e1666e9c794","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"RoboPoint: A vision-language model for spatial affordance prediction for robotics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:f8ae802e4f41e2917838eb105480fdaca2f2886126e7b53bb731901f091b55c3","observation_id":"151f5f20-ec80-4fa0-a285-f1b30583eee6","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"RoboRefer: Towards spatial referring with reasoning in vision-language models for robotics","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:8b9771aa80d30c78ee11b0789e996ce5ee46b5a1feab72f44ee62dad0ec3b06f","observation_id":"1932c905-de85-4bc3-bd57-fff28e24d2d1","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Robobrain: A unified brain model for robotic manipulation from abstract to concrete","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:7580ae4adf56b59efb36ed86bcce1de7ebc389077f7142249a58e30f4be54b41","observation_id":"74304a63-58e8-45f6-8b5c-011c187abc7a","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Robobrain 2.5: Depth in sight, time in mind","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:81fea850327e085e34dd89db4cfa0c007a4254ec88f990a04c1ab283042f2868","observation_id":"ee474def-3ff1-4243-ac9b-1e9352afacc3","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16518","last_updated":"2026-04-28T11:37:12Z","snapshot_observed_at":"2026-08-13T19:00:10.952463Z","submitted_at":"2025-11-20T16:34:55Z","title":"MiMo-Embodied: X-Embodied Foundation Model Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16518","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Mimo-embodied: X-embodied foundation model technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2511.16518","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:775e9cbf71bf48236cda65ee2ea14faa3e32e1244f7d9895484d54155db3d126","observation_id":"ed0ca22f-7515-4283-99ad-b1a05dfdc1ec","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00123","last_updated":"2025-05-30T18:00:34Z","snapshot_observed_at":"2026-08-16T11:17:25.346121Z","submitted_at":"2025-05-30T18:00:34Z","title":"Visual Embodied Brain: Let Multimodal Large Language Models See, Think, and Control in Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00123","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Visual embodied brain: Let multimodal large language models see, think, and control in spaces","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2506.00123","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:c21b4d4fa3cdc3d69dda41ffa0ac05d83687ace1528afebf3e3c91fcee68e039","observation_id":"5ca3a554-d397-484d-9748-597a412c8479","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02029","last_updated":"2025-09-14T06:49:43Z","snapshot_observed_at":"2026-08-12T20:24:27.893763Z","submitted_at":"2025-07-02T17:05:33Z","title":"RoboBrain 2.0 Technical Report","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02029","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Robobrain 2.0 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2507.02029","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:f24bc68facc167ae37e76520d81c333e0b3bf56296b338579b4be15245f0ccb8","observation_id":"eddaea49-160f-4f46-b2b9-b8d3487ef1b8","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Vlaser: Vision-language-action model with synergistic embodied reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:01d4ad88150036d38248df096338f768ab65e39802683eb7620753a5e78b782f","observation_id":"d583d91a-6417-459d-9fa6-2ebbc8e914b1","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Pelican-vl 1.0: A foundation brain model for embodied intelligence","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:493ce822e06dcc4cacb01aec86ef5bd1c2eb50eddc43c66b8442e08f85f4251c","observation_id":"54080e52-ce8c-4bf5-8b82-f3fd26ad96ca","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"RT-1: Robotics transformer for real-world control at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:145a1f303febca2e940565f65c91e0b7c28f293b61739e52b8db1d469f35c512","observation_id":"1e99e69a-0033-4827-92e4-02b8173ea7d9","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"RT-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:490a569b7d535b02ac6968fe00d95cab354f209dbcce20c49899099746798162","observation_id":"04acb0ba-45d5-4c32-9959-c7cc41d7fe34","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Octo: An open-source generalist robot policy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:3e704b42923f4a8818875621fc5466e69e554aa9e1706c69f4ee3a0756b8a963","observation_id":"9f8adba5-4552-4e8f-ab10-8e7466f112e5","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"OpenVLA: An open-source vision-language-action model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:2387d4b40d1e4af9ddb310d839de0533c02e0b217f32fb4f71a701617a0686c6","observation_id":"90fc8551-ae27-4c8b-9644-2bb77415fc4c","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Open X-Embodiment: Robotic learning datasets and RT-X models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:1f0a3911f806e341b93ca06d2d2fa38dd4d3e3f782404f135cc3524c1f1f82ba","observation_id":"8ae275de-1280-41ce-b6aa-e200627afc7c","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01823","last_updated":"2024-06-01T01:54:54Z","snapshot_observed_at":"2026-08-15T10:07:25.118684Z","submitted_at":"2024-03-04T08:16:11Z","title":"RT-H: Action Hierarchies Using Language","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01823","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"RT-H: Action hierarchies using language","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2403.01823","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:34f68b55723815fff679c02313cc4c61268ff8642ccb58d52afc9f46f2f540b5","observation_id":"d418b3a4-033b-43db-bbc6-a9b3be2dc434","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Eo-1: Interleaved vision-text- action pretraining for general robot control","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:304c80867fb73b493a5e51d32f92b8e8f442396d648dea1b425394938ce6b724","observation_id":"4a7f19e4-3639-49ab-bc9d-9727accbdbb9","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19650","last_updated":"2024-11-29T12:06:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-29T12:06:03Z","title":"CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19650","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"CogACT: A foundational vision-language-action model for synergizing cognition and action in robotic manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2411.19650","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:4e4e07763a6fc5f7375469604642d2ae4194966d910339b9f363464dd8fb67d2","observation_id":"bd9eebd2-127e-4c50-a7ef-6a4a573ee6a4","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06158","last_updated":"2024-10-08T16:00:47Z","snapshot_observed_at":"2026-08-12T23:18:51.506083Z","submitted_at":"2024-10-08T16:00:47Z","title":"GR-2: A Generative Video-Language-Action Model with Web-Scale Knowledge for Robot Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06158","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Gr-2: A generative video-language-action model with web-scale knowledge for robot manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2410.06158","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:d404d5da876949db79152a0a603bc27669b70c800bba6a454fea137e34800ecc","observation_id":"8f03d772-fc24-432a-adbe-9a25ee457fe9","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15493","last_updated":"2025-07-22T15:04:37Z","snapshot_observed_at":"2026-08-06T13:23:03.968769Z","submitted_at":"2025-07-21T10:54:13Z","title":"GR-3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15493","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"GR-3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2507.15493","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:676b097cdcd4927715f793b8ad5850749f58225efd98280d5c8316c89f113bdb","observation_id":"60b77533-9dca-4462-84ea-b589a9826d6f","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.23202","last_updated":"2026-04-07T13:15:13Z","snapshot_observed_at":"2026-08-11T13:15:10.525790Z","submitted_at":"2026-03-24T13:50:28Z","title":"Gaze-Regularized Vision-Language-Action Models for Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.23202","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Gaze-regularized vision-language-action models for robotic manipulation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2603.23202","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:6c6638da334afebe74a9d4b83abbcb9e85de1ae337ffe463022dd74d5a2cb491","observation_id":"64cc7f85-a32d-412a-8536-7999f23524a6","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Vla-jepa: Enhancing vision-language-action model with latent world model, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:94b60b505630f8e02ca351ecca87d1cdd553a81977d81138e67117a0449ee375","observation_id":"00cda2d9-a497-42fa-bc7c-0f2268f891c9","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.16163","last_updated":"2026-01-22T18:09:30Z","snapshot_observed_at":"2026-08-13T22:25:02.123367Z","submitted_at":"2026-01-22T18:09:30Z","title":"Cosmos Policy: Fine-Tuning Video Models for Visuomotor Control and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.16163","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Cosmos policy: Fine-tuning video models for visuomotor control and planning, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2601.16163","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:802737fdcdb856039d9cdb1eecd6b9effbc72fcd839b9d0a2c83c8fa4b83d7c0","observation_id":"28fb3364-9f6d-4b9c-bb42-b091c7ca314a","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Gigaworld-policy: An efficient action-centered world–action model","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:d37cf409aadadb63aa3c0259eb48e5f95497a427f02590a036c5ab21de6ab7f5","observation_id":"e10d4955-22cc-4d6d-8715-a21740fe01b3","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26694","last_updated":"2026-05-07T11:23:39Z","snapshot_observed_at":"2026-07-06T23:12:19.460065Z","submitted_at":"2026-04-29T14:01:54Z","title":"Unified 4D World Action Modeling from Video Priors with Asynchronous Denoising","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.26694","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Unified 4d world action modeling from video priors with asynchronous denoising","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2604.26694","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:eb47beeb0a6edf43086d560b0c3141a315da6ffe0092fe6d150726cb7ab1f8bd","observation_id":"06d68dd9-aab4-4a75-ac01-3b64f32c5d02","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.16666","last_updated":"2026-03-23T05:41:14Z","snapshot_observed_at":"2026-08-15T14:30:41.084242Z","submitted_at":"2026-03-17T15:33:43Z","title":"Fast-WAM: Do World Action Models Need Test-time Future Imagination?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.16666","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Fast-wam: Do world action models need test-time future imagination?, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2603.16666","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:9b2260e7dabe21034c964bca060776225a4eb2159d61bb4e59bc53bc1bf8eaa7","observation_id":"7f27a67c-4155-423a-ad86-593274337c6b","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Dreamvla: a vision-language-action model dreamed with comprehensive world knowledge","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:21ff89b5f02ac13a7c85d1cd3931b6517095c841222b5cc9213ed3c61f0bf46c","observation_id":"dc0dd1f3-11d3-4dd1-a5cf-5e46182382d5","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.00078","last_updated":"2026-04-30T14:16:15Z","snapshot_observed_at":"2026-07-06T23:13:33.799847Z","submitted_at":"2026-04-30T14:16:15Z","title":"Being-H0.7: A Latent World-Action Model from Egocentric Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.00078","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Being-h0","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2605.00078","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:52191f7803996e3dde1f5dee3c16b14ca49c3e0420aa67b986ee23bd7f9dd197","observation_id":"44eefec1-bbc7-475f-ba4b-1f4a4598dea3","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.17502","last_updated":"2026-05-30T03:49:39Z","snapshot_observed_at":"2026-08-03T20:59:48.866420Z","submitted_at":"2025-11-21T18:59:32Z","title":"RynnVLA-002: A Unified Vision-Language-Action and World Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.17502","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Rynnvla-002: A unified vision-language-action and world model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2511.17502","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:5aa27306c2d201736246ae38f9e4105f18ccb3eaa85db4bc739acdbe12d922b5","observation_id":"a247e9bc-0198-4fa9-bb9f-c4e5dc329c98","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.00678","last_updated":"2026-07-06T08:13:44Z","snapshot_observed_at":"2026-08-13T20:16:02.364775Z","submitted_at":"2026-07-01T09:21:20Z","title":"ABot-M0.5: Unified Mobility-and-Manipulation World Action Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.00678","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Abot-m0.5: Unified mobility-and-manipulation world action model, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2607.00678","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:ca57c63bdbf84057360b19e9bd8c86bbf63c2433103bf3180d3852df9e03df5f","observation_id":"17b0e8c8-93d0-4fd3-81e9-bb74d27b390a","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Vision-and-language navigation: Interpreting visually-grounded navigation instructions in real environments","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:0de019e9044ecd2904bee8b0b3d02c1a37949a61207836a0249cf2f86346b059","observation_id":"864dbc8a-3285-493e-9047-ba9db8359042","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Think global, act local: Dual-scale graph transformer for vision-and-language navigation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:6d28c70368a0657bba48afc10aecf15468a0238d6db2dee1f94521f18ebf36c7","observation_id":"9afdb9af-1361-45b3-874b-699a4d12c1c2","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Beyond the nav-graph: Vision- and-language navigation in continuous environments","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:a6b6bd8cde9e529493745346f43a7c8f57ab3754efa60e514c631e568edc5c7f","observation_id":"962e6fd2-29f4-4a41-83a8-5a31522491e1","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Vision-and-language navigation with foundation models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:3923352587a114e5bf66f117574b040d8efcdf5aa3879a0e858cdae5f7183511","observation_id":"c34dd25f-b779-4a85-b762-077e359d9d4e","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Navgpt: Explicit reasoning in vision-and-language navigation with large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:864ef152cdd4a718edf4d8cfd0f131b77fe3845e72749791a9dd94f00f3ff18d","observation_id":"3555cc1c-fdbb-4dee-bd49-a9e4733fe0df","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15852","last_updated":"2024-06-30T11:14:13Z","snapshot_observed_at":"2026-08-12T04:00:31.932219Z","submitted_at":"2024-02-24T16:39:16Z","title":"NaVid: Video-based VLM Plans the Next Step for Vision-and-Language Navigation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15852","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Navid: Video-based vlm plans the next step for vision-and-language navigation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2402.15852","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:2ac37f74872291d9d00bd49c61ba8a10715e637133479e0681c70ee6b364075c","observation_id":"96c27ba5-01f0-46d9-8c3d-54894c5a31b1","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04453","last_updated":"2025-02-17T18:27:27Z","snapshot_observed_at":"2026-08-17T17:58:31.496050Z","submitted_at":"2024-12-05T18:58:17Z","title":"NaVILA: Legged Robot Vision-Language-Action Model for Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04453","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Navila: Legged robot vision-language-action model for navigation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2412.04453","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:93666b6b8256aff7daf85b04dc33cde6257ce9e9c99988f0dde71d443b414c26","observation_id":"60e3694c-c7e2-4522-8943-3ba9f774cccf","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06224","last_updated":"2025-02-06T10:14:36Z","snapshot_observed_at":"2026-08-16T16:28:01.153501Z","submitted_at":"2024-12-09T05:55:55Z","title":"Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06224","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Uni-NaVid: A video-based vision-language-action model for unifying embodied navigation tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2412.06224","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:12ef18c997f8a0308fff5f23784fa6a77ae9b089707e9dc0de4dd078df11ab13","observation_id":"761b0e6b-5041-4c56-a8a9-cded259122ca","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05240","last_updated":"2026-07-09T06:53:43Z","snapshot_observed_at":"2026-08-06T19:26:50.907830Z","submitted_at":"2025-07-07T17:49:41Z","title":"StreamVLN: Streaming Vision-and-Language Navigation via SlowFast Context Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05240","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Streamvln: Streaming vision-and-language navigation via slowfast context modeling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2507.05240","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:7fecee10c8c29252a57f8047e21191330f7d0d5141b7a5c8fa7ccdbfca796cff","observation_id":"eb84062f-aa1c-4a85-998a-0afa452ba9d4","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Octonav: Towards generalist embodied navigation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:49765a82f24f97f5f14b3ef484c6b9a469c857dc31434ff380e1e61ccd644d77","observation_id":"3dd353ec-0325-4b1e-a3be-8dbbf91a841d","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Agentvln: Towards agentic vision-and-language navigation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:f7a29495d878d577a2c1965d3ce7d9b79e0993ea1ee51679d259981de1ab8c82","observation_id":"4b54c8f8-097f-43fa-8587-5fb801c461e4","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Learning goal-oriented language-guided navigation with self-improving demonstrations at scale","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:83cb036b7f5640f6658e5039ce8aa840455ce325042bca1d2ae01c2f3e0ec5aa","observation_id":"56c67dc1-15b3-4d69-9282-3dd02bd454cf","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Endowing embodied agents with spatial reasoning capabilities for vision-and-language navigation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:a7646a4de075430a7d0d9e88045e3f8b906fd974d6d211d9c36bd7908a29caf7","observation_id":"b095cb67-ab07-492c-a945-66d2ae287efe","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.25415","last_updated":"2026-05-26T13:51:36Z","snapshot_observed_at":"2026-08-14T16:18:47.323586Z","submitted_at":"2026-03-26T13:10:08Z","title":"Modernising Reinforcement Learning-Based Navigation for Embodied Semantic Scene Graph Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.25415","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Modernising reinforcement learning-based navigation for embodied semantic scene graph generation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2603.25415","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:145013d1ef37b304f6b27d13622218c4cf5201f2d42d9bebdd0218dd65c2973b","observation_id":"78ec595b-d2f1-43c8-92c3-d324399c5d5c","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Sontakke, Jesse Zhang, S´ ebastien M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:c45884ec9efff386daa264cba4c2e1307331b4c74444eb78f70cb6d796951eb1","observation_id":"ef660308-8d90-414f-a3a0-d47002b0ef05","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"VIP: Towards universal visual reward and representation via value-implicit pre-training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:d64f51318643b6f09bd456bd42e9c34d0c5afc5548ab69d7213baf2d34ccf2b8","observation_id":"5210083a-0d52-47c4-8368-140dff9f04df","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Vision language models are in-context value learners","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:ad29d32772e75f9c624d46fc1ab59b82562c709b5d27876ade4c1a738d1b70ac","observation_id":"0da25528-39c7-47c1-8aec-daaa5b5ee79f","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Vision-language models are zero-shot reward models for reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:bbea51dd7e8763686e2027452b9352603442673eabc89d4383ae05ea79af9db4","observation_id":"ffbd59dc-0b7b-4f66-98bd-2681944d382f","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.06665","last_updated":"2025-08-29T04:07:26Z","snapshot_observed_at":"2026-08-16T16:16:42.929304Z","submitted_at":"2022-11-12T13:52:06Z","title":"A Survey on Explainable Reinforcement Learning: Concepts, Algorithms, Challenges","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.06665","snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"A survey on explainable reinforcement learning: Concepts, algorithms, challenges","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"cited_paper":"/paper/2211.06665","citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:fa89729d6fe928af12ffb7083fffbf67e758389f4b906a3392867b973584203c","observation_id":"98b95458-49aa-49e0-901c-a1c5c83564b1","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"LIV: Language-image representations and rewards for robotic control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:17dbb3b60e21cab3b7a09794b6a9720a87e5205bb182361471bcc8cf6459db1b","observation_id":"f6b3acb4-899d-4215-be04-9d528e4b7861","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Rank2Reward: Learning shaped reward functions from passive video","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:cbd6ade21ab618d65f246b1b7d17b636cc880570e384ce129b6dd37513554457","observation_id":"de4c356b-7ed9-4a73-838d-4f50e6e14b46","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"Lim, Jesse Thomason, Erdem Biyik, and Jesse Zhang","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:01983dfca9ab14fe113ddf2e132f5db9ef33eca9738209a0fe0ec728983d5111","observation_id":"0e60e437-ce27-4d9d-be2a-21ebdd005052","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:57.396710Z","title":"SARM: Stage-aware reward modeling for long horizon robot manipulation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:57.396710Z"},"links":{"citing_paper":"/paper/2607.04426"},"observation_digest":"sha256:343f5aee3075e41a82ca6d17f715ba89575025f9360472e3460bfe558cb850df","observation_id":"b89c608b-c6f5-45a1-88db-14a7e3f1d15d","resolution":{"observed_at":"2026-07-11T19:16:57.396710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":169},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 100 of 169 outbound references and 2 inbound Pith citation observations for arXiv:2607.04426."}