{"as_of":"2026-08-15T05:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:971e254e135046b8d6da2f1a136f4ea42fb54bd2b30ad7f0b5d437a5c8ac9c1e","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-08T07:06:13.473493Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:16:39.641954Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T14:52:36.159020Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.06403","snapshot_observed_at":"2026-08-01T16:20:01.326319Z","title":"From foundation to application: Improving vla models in practice.arXiv preprint arXiv:2607.06403,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18042","last_updated":"2026-07-23T15:59:17Z","snapshot_observed_at":"2026-08-11T16:28:43.983398Z","submitted_at":"2026-07-20T15:11:46Z","title":"Anticipate Before Acting: Future-State-Conditioned Vision-Language Navigation","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T16:20:01.326319Z"},"links":{"cited_paper":"/paper/2607.06403","citing_paper":"/paper/2607.18042"},"observation_digest":"sha256:0fe1d4eb36ef5c120d43fa334c06fdd01a2f3c1ced45b485785fd79f009d232e","observation_id":"98631932-0bc3-4b2c-b9cf-0519035d1d01","resolution":{"observed_at":"2026-08-01T16:20:01.326319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.06403","snapshot_observed_at":"2026-07-30T12:42:18.596168Z","title":"From foundation to application: Improving vla models in practice","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23783","last_updated":"2026-07-26T17:58:53Z","snapshot_observed_at":"2026-08-13T03:00:00.482734Z","submitted_at":"2026-07-26T17:58:53Z","title":"$N_0$-TWAM: Scaling Tactile-Native World-Action Model for Contact-Rich Manipulation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-07-30T12:42:18.596168Z"},"links":{"cited_paper":"/paper/2607.06403","citing_paper":"/paper/2607.23783"},"observation_digest":"sha256:5a023952e1c490f6e8f3d4990efb4bc6c090347242cdaca6255aea28df255864","observation_id":"b9201e3b-071c-424e-9891-3f7e9cbdeee6","resolution":{"observed_at":"2026-07-30T12:42:18.596168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.06403","snapshot_observed_at":"2026-07-30T20:30:33.298679Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26807","last_updated":"2026-07-29T11:48:45Z","snapshot_observed_at":"2026-08-13T09:30:11.173244Z","submitted_at":"2026-07-29T11:48:45Z","title":"Route by Kinematics, Act by Observation: Kinematics-Supervised Expert Routing in MoE-Augmented VLA","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-30T20:30:33.298679Z"},"links":{"cited_paper":"/paper/2607.06403","citing_paper":"/paper/2607.26807"},"observation_digest":"sha256:77ea4108663a36cc3c1844901d4c456399e68e0183b85e0fbf6ce663db426784","observation_id":"a10fb45f-1def-4378-b5c1-d489d00bbf8c","resolution":{"observed_at":"2026-07-30T20:30:33.298679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.06403","snapshot_observed_at":"2026-08-04T10:39:54.173311Z","title":"From foundation to application: Improving vla models in practice,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02257","last_updated":"2026-08-03T14:03:26Z","snapshot_observed_at":"2026-08-12T05:03:28.887155Z","submitted_at":"2026-08-03T14:03:26Z","title":"Learning Panorama-Aware VLA for Mobile Manipulation with Whole-Body Teleoperation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T10:39:54.173311Z"},"links":{"cited_paper":"/paper/2607.06403","citing_paper":"/paper/2608.02257"},"observation_digest":"sha256:bfd8604d46420619f0414d49c5d7e10a267b08194b99c4695fc2a638f05d19ae","observation_id":"dc7be8e0-8ee9-462e-97ca-e942cd233604","resolution":{"observed_at":"2026-08-04T10:39:54.173311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"cited_work":{"arxiv_id":"2607.06403","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.06403","snapshot_observed_at":"2026-08-05T14:52:36.159020Z","title":"From Foundation to Application: Improving VLA Models in Practice","venue":"cs.RO","work_id":"ac177a30-4157-4080-aa1a-f60f15ebeef0","year":2026},"citing_paper":{"arxiv_id":"2608.03682","last_updated":"2026-08-05T05:24:32Z","snapshot_observed_at":"2026-08-13T11:11:20.179265Z","submitted_at":"2026-08-04T13:53:48Z","title":"PhyAI: Real-Time Physical AI at the Edge, Scalable Rollouts in the Cloud","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T14:52:35.400227Z"},"links":{"cited_paper":"/paper/2607.06403","citing_paper":"/paper/2608.03682"},"observation_digest":"sha256:b6afde89628e4106ff7efabe3c1eca240c4e353893b03bba1f73e8aaa9de5ea7","observation_id":"d3e28936-f8d4-4800-9924-c778c4249614","resolution":{"observed_at":"2026-08-05T14:52:36.161955Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.06403","snapshot_observed_at":"2026-08-14T04:16:39.641954Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.10232","last_updated":"2026-08-10T21:10:46Z","snapshot_observed_at":"2026-08-14T23:10:20.919981Z","submitted_at":"2026-08-10T21:10:46Z","title":"FACT: Failure-Aware Causal Training for World-Action Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T04:16:39.641954Z"},"links":{"cited_paper":"/paper/2607.06403","citing_paper":"/paper/2608.10232"},"observation_digest":"sha256:7eb84185899d0dc0224221cc0060fb65009f000431f7edc8c8cf08e6aa4c21ae","observation_id":"0aaf8514-feb4-413c-919f-035b15ed4ac0","resolution":{"observed_at":"2026-08-14T04:16:39.641954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.06403","snapshot_observed_at":"2026-08-12T15:40:38.437224Z","title":"From foundation to application: Improving vla models in practice.arXiv preprint arXiv:2607.06403,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10860","last_updated":"2026-08-13T07:46:45Z","snapshot_observed_at":"2026-08-15T05:20:59.359664Z","submitted_at":"2026-08-11T12:33:51Z","title":"Flex-$\\pi$: A Multi-Stream World-Action Model with Compute Flexibility","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T15:40:38.437224Z"},"links":{"cited_paper":"/paper/2607.06403","citing_paper":"/paper/2608.10860"},"observation_digest":"sha256:06d3992f7e91aea0070debb6c71fd5fb5b3af200e923ce2ae82d2e12355a0043","observation_id":"50d7803a-337b-4a30-844b-00f571cee7df","resolution":{"observed_at":"2026-08-12T15:40:38.437224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.06403/citation-record","integrity":"/paper/2607.06403/integrity","json":"/paper/2607.06403/citation-record.json","paper":"/paper/2607.06403"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.02800","last_updated":"2026-06-23T17:33:32Z","snapshot_observed_at":"2026-07-06T23:43:07.940839Z","submitted_at":"2026-06-01T19:12:30Z","title":"Cosmos 3: Omnimodal World Models for Physical AI","version":4},"cited_work":{"arxiv_id":"2606.02800","doi":"10.48550/arxiv.2606.02800","metadata_source":"pith","pith_arxiv_id":"2606.02800","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Cosmos 3: Omnimodal World Models for Physical AI","venue":"cs.CV","work_id":"ac5e3265-03db-4f0f-a27f-6d9bea03379c","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2606.02800","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:9b8a22615e8fa082b952a81e00f66ab0cc43bad511d067b6d4551fb34a26c4c9","observation_id":"5cfc9951-4d25-4d42-a0ba-7eb2e0803ad2","resolution":{"observed_at":"2026-07-08T07:14:45.485926Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:50.194666+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:50.194666+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"cited_work":{"arxiv_id":"2506.09985","doi":"10.48550/arxiv.2506.09985","metadata_source":"pith","pith_arxiv_id":"2506.09985","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","venue":"cs.AI","work_id":"a9c28401-f16a-4933-89f0-788e2f94e52b","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2506.09985","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:804591f3a7d0289e3a1d5d5bebe735b4574aa4e88bf6d38c04aaf0dd9c109953","observation_id":"ad679c6b-c74c-46c5-8811-c36109dc0cf5","resolution":{"observed_at":"2026-07-08T07:14:45.493399Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:37.559938+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:37.559938+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07993","last_updated":"2026-05-19T11:30:49Z","snapshot_observed_at":"2026-08-11T09:58:02.434831Z","submitted_at":"2026-04-09T09:01:43Z","title":"HEX: Humanoid-Aligned Experts for Cross-Embodiment Whole-Body Manipulation","version":2},"cited_work":{"arxiv_id":"2604.07993","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.07993","snapshot_observed_at":"2026-07-08T07:14:45.495383Z","title":"HEX: Humanoid-Aligned Experts for Cross-Embodiment Whole-Body Manipulation","venue":"cs.RO","work_id":"a4f1182c-7f97-4374-825f-96b01770ccfe","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2604.07993","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:e2c93ba6a71fa24ddfc18f4c3175a0a244c30d4019d7c66e97a69b9103b32e8e","observation_id":"003e4f82-c2c8-4c38-9672-109e2ab194a2","resolution":{"observed_at":"2026-07-08T07:14:45.498061Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":"2503.14734","doi":"10.48550/arxiv.2503.14734","metadata_source":"pith","pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","venue":"cs.RO","work_id":"e2db69c7-ee8a-4cb7-a761-7b8de1dfcf97","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:b9f75ce30e4dc4088d93f45ec8ad2205243664a48187e284e0b518b93a5f31b6","observation_id":"f74c6e13-d353-4e0f-8184-eb646ba6a0bc","resolution":{"observed_at":"2026-07-08T07:14:45.502118Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-07-12T08:49:11.206777+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T08:49:11.206777+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.711195Z","title":null,"venue":null,"work_id":"e93d113d-48ef-45c6-b452-0d83de0fb5d1","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:ec90ca816577a77efa1fb4b4c3a67958c4b7ae65655d58201b99ad81b741ea7f","observation_id":"86cab0f7-a598-4d4c-b632-021ef85ad981","resolution":{"observed_at":"2026-07-08T07:24:43.712960Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.702853Z","title":"InProceedings of Robotics: Science and Systems","venue":null,"work_id":"0d169bf6-2b8d-4d34-8dfb-3fb638981045","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:c9c8d45d864b9e7cb9ee72dc22fb3bac1893fd1bf11f8ea210b2be7afeeab698","observation_id":"dda130c9-d3f6-40bd-a14a-ac9bfca4c787","resolution":{"observed_at":"2026-07-08T07:24:43.704491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.12684","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T23:07:47.711193Z","title":"arXiv preprint arXiv:2602.12684 (2026)","venue":null,"work_id":"d4ca4245-5a33-487c-83b0-988ef4c60db7","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:f9eed1be5ef6b4b2bbe6e6d8317026b7ea0d16dd2e86ccfd9c09dcfbdbe20218","observation_id":"91d09b23-e93c-4f91-a230-f1db8a83125a","resolution":{"observed_at":"2026-07-08T07:14:45.505934Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15493","last_updated":"2025-07-22T15:04:37Z","snapshot_observed_at":"2026-08-06T13:23:03.968769Z","submitted_at":"2025-07-21T10:54:13Z","title":"GR-3 Technical Report","version":2},"cited_work":{"arxiv_id":"2507.15493","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.15493","snapshot_observed_at":"2026-07-10T04:16:48.751910Z","title":"GR-3 Technical Report","venue":"cs.RO","work_id":"7f3b800b-0146-4c37-b178-0801cd4270db","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2507.15493","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:a23f5ed96732c6c560940ffe961277c6a651792d388b4c3e42e9228108ada986","observation_id":"7d8a7ae8-e647-4482-9483-5308709382ad","resolution":{"observed_at":"2026-07-08T07:14:45.482564Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2606.15768","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:14:45.463941Z","title":"Lawam: Latent world action models for efficient dynamics-aware robot policies.arXiv preprint arXiv:2606.15768, 2026","venue":null,"work_id":"c34e3100-0d69-44b3-b033-3fac5e9d64ed","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:c3df3f63f710a0eea0daa55194a9ae2927a8328f0ae263b624d42e8127fa4f46","observation_id":"84bce366-b3c6-4b47-aa2e-27f5c335d9db","resolution":{"observed_at":"2026-07-08T07:14:45.468230Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.00678","last_updated":"2026-07-06T08:13:44Z","snapshot_observed_at":"2026-08-13T20:16:02.364775Z","submitted_at":"2026-07-01T09:21:20Z","title":"ABot-M0.5: Unified Mobility-and-Manipulation World Action Model","version":2},"cited_work":{"arxiv_id":"2607.00678","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.00678","snapshot_observed_at":"2026-07-08T07:14:45.470221Z","title":"ABot-M0.5: Unified Mobility-and-Manipulation World Action Model","venue":"cs.CV","work_id":"198dfc69-f4bf-4de4-9c96-1c13b46e30fe","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2607.00678","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:e994c8f44f407dae437d81ba9359761aa35528c080a86fe03071f4e1d9cd7947","observation_id":"49ec92c7-707e-4b92-9041-be7498122d83","resolution":{"observed_at":"2026-07-08T07:14:45.472368Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.673631Z","title":"Dexworldmodel: Causal latent world modeling towards automated learning of embodied tasks, 2026","venue":null,"work_id":"195ee403-dfe1-4332-b057-2d7901e9977a","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:3b78b4bc121a66f7f9416bbf36a655e22f9030c0dd8e9559a2a414c244afa1d0","observation_id":"bc4f3dae-fafa-47c1-ba37-c76f365535c6","resolution":{"observed_at":"2026-07-08T07:24:43.675975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.05693","last_updated":"2026-07-08T05:36:16Z","snapshot_observed_at":"2026-08-10T04:18:53.177072Z","submitted_at":"2025-12-05T13:21:05Z","title":"HiMoE-VLA: Hierarchical Mixture-of-Experts for Generalist Vision-Language-Action Policies","version":2},"cited_work":{"arxiv_id":"2512.05693","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.05693","snapshot_observed_at":"2026-07-09T02:19:49.242114Z","title":"Himoe-vla: Hierarchical mixture-of-experts for generalist vision-language-action policies","venue":null,"work_id":"2e3fe795-adc6-4e30-a0e7-d184ea103fba","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2512.05693","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:c4183480fe4157789ba6d7647bd5f6912fb349beee9b1f6995309a212e39d9f0","observation_id":"22113d00-53bb-49f0-bb94-23dbbf411775","resolution":{"observed_at":"2026-07-09T02:19:49.242114Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.708389Z","title":"Galaxea g0.5 technical report, 2026","venue":null,"work_id":"91a7d7cf-77c8-40e4-b231-61830e023ebe","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:191db30b47bff0d28b3d7b471b5546ed4bcde4c4108b8030c8d766ebbda9804d","observation_id":"cc3a46fa-a757-4bb3-a01b-df17909688d3","resolution":{"observed_at":"2026-07-08T07:24:43.710268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00576","last_updated":"2025-08-30T18:04:19Z","snapshot_observed_at":"2026-08-14T02:52:34.768729Z","submitted_at":"2025-08-30T18:04:19Z","title":"Galaxea Open-World Dataset and G0 Dual-System VLA Model","version":1},"cited_work":{"arxiv_id":"2509.00576","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.00576","snapshot_observed_at":"2026-07-08T07:14:45.460259Z","title":"Galaxea open-world dataset and G0 dual-system VLA model","venue":"cs.RO","work_id":"568af32f-f647-4c11-a106-65ddfa305082","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2509.00576","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:8f095e1e5e5892e69adbe68dbebdac1afb130dce9ded3c845e812872f3689327","observation_id":"853afccb-f2b6-4f39-8a32-ce3bea1f01f7","resolution":{"observed_at":"2026-07-08T07:14:45.462253Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"cited_work":{"arxiv_id":"2605.03269","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.03269","snapshot_observed_at":"2026-07-10T07:26:54.401445Z","title":"RLDX-1 Technical Report","venue":"cs.RO","work_id":"c9a872cd-f003-489b-866b-c4f8c2501c79","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2605.03269","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:dc7ece82eeb7ac334ed9d392f94f4b727c97bff146d7baa4f030cbaf2aeff104","observation_id":"b0d968cf-f23c-4deb-b81d-c421f2bd1c1c","resolution":{"observed_at":"2026-07-08T07:14:45.478990Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.679858Z","title":"OpenVLA: An open-source vision-language-action model","venue":null,"work_id":"abec555c-7087-4fdf-bb91-2cea7288e766","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:73db0c7082889dbf45fc601212658ea29496cd43c5850b60eadefceffbb8570b","observation_id":"10e80ea4-bf94-4929-b266-8784b39cb6cf","resolution":{"observed_at":"2026-07-08T07:24:43.681788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.15169","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:14:45.451588Z","title":"Forcevla2: Unleashing hybrid force-position control with force awareness for contact-rich manipulation","venue":null,"work_id":"33f8c9ec-a90b-40bf-97c0-4a8f8adff56b","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:acd46892990dc37b9f9ee7f55ec16f11e64dba50814b57f446815cfc0d5c4ae0","observation_id":"fc61d89c-b1a4-4adc-ba11-40f28e2e2673","resolution":{"observed_at":"2026-07-08T07:14:45.454088Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.12062","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:26:10.991036Z","title":"HoloBrain-0 technical report","venue":null,"work_id":"ae9c3bee-5775-4997-a93a-47049c7cab3e","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:311b255eb66d38509578a33b1b0c807334391dc5de35cb4037a27dc361196844","observation_id":"414594b6-6e00-4fa7-923a-6c634c02b9fe","resolution":{"observed_at":"2026-07-08T07:14:45.438202Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-11T01:48:59.557045Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:483fe831c59cf3142f57696fc8165ea6dd138b1dde6003ed5dac6170d0c1be6d","observation_id":"7a9673b0-6999-4e6f-9221-507e0d6c44ba","resolution":{"observed_at":"2026-07-08T07:14:45.441802Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15597","last_updated":"2025-07-21T13:19:09Z","snapshot_observed_at":"2026-08-06T15:25:42.125132Z","submitted_at":"2025-07-21T13:19:09Z","title":"Being-H0: Vision-Language-Action Pretraining from Large-Scale Human Videos","version":1},"cited_work":{"arxiv_id":"2507.15597","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.15597","snapshot_observed_at":"2026-07-10T04:16:48.668605Z","title":"Being-h0: vision-language-action pretraining from large-scale human videos","venue":"cs.CV","work_id":"5aebd66f-99a4-4264-a778-dd17abb8d446","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2507.15597","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:2cdfce18c6e45396a3ec14ac73b09e194fa1db2a81819d586adcd2d2c0e1e948","observation_id":"c898bc55-29e6-4ff2-b04c-63542be34257","resolution":{"observed_at":"2026-07-08T07:14:45.445289Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.12993","doi":"10.48550/arxiv.2601.12993","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Being-h0","venue":"arXiv (Cornell University)","work_id":"2c66b688-268c-4501-bc7a-88376b03d92f","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:c5a8584fb6bf48b1230d82880534453218d25c541b98a0105586e764015ad73c","observation_id":"6c238041-d146-4740-8dc5-4dd34b9f904b","resolution":{"observed_at":"2026-07-08T07:14:45.449397Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.00078","last_updated":"2026-04-30T14:16:15Z","snapshot_observed_at":"2026-07-06T23:13:33.799847Z","submitted_at":"2026-04-30T14:16:15Z","title":"Being-H0.7: A Latent World-Action Model from Egocentric Videos","version":1},"cited_work":{"arxiv_id":"2605.00078","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.00078","snapshot_observed_at":"2026-07-10T04:16:48.652559Z","title":"Being-H0.7: A Latent World-Action Model from Egocentric Videos","venue":"cs.RO","work_id":"acd97985-0a4e-4d72-8d96-a565b720b855","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2605.00078","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:cfac0a10e07508af47b7f469dc60b9e8709e87da0def6c312b74ab1a1ced5d7a","observation_id":"91bcbe7b-0b66-45da-a1f9-82fd7c9fa25c","resolution":{"observed_at":"2026-07-08T07:14:45.425343Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12215","last_updated":"2026-06-03T04:04:20Z","snapshot_observed_at":"2026-08-02T23:57:43.860710Z","submitted_at":"2026-02-12T17:53:51Z","title":"LDA-1B: Scaling Latent Dynamics Action Model via Universal Embodied Data Ingestion","version":2},"cited_work":{"arxiv_id":"2602.12215","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.12215","snapshot_observed_at":"2026-07-09T22:16:36.379086Z","title":"Chen et al","venue":"cs.RO","work_id":"3871a208-87bb-40c9-922d-9203ad3a857f","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2602.12215","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:4eafb68398d1dfec14827cfa506a2bd9e70cfb94442c1c200012a7bafecf9304","observation_id":"9c7c5ceb-597e-468c-b36b-ef4f15c62d99","resolution":{"observed_at":"2026-07-08T07:14:45.429695Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11689","last_updated":"2026-04-13T16:30:35Z","snapshot_observed_at":"2026-08-13T15:12:59.369126Z","submitted_at":"2026-04-13T16:30:35Z","title":"LARY: A Latent Action Representation Yielding Benchmark for Generalizable Vision-to-Action Alignment","version":1},"cited_work":{"arxiv_id":"2604.11689","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.11689","snapshot_observed_at":"2026-07-08T07:14:45.431275Z","title":"LARY: A Latent Action Representation Yielding Benchmark for Generalizable Vision-to-Action Alignment","venue":"cs.CV","work_id":"6c1314e7-29f9-42ba-be35-94fb6d627ba7","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2604.11689","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:e3bb537927f3d7316ed5b939a6f4dcb6c57ed80707816d71859600ee075be45c","observation_id":"09d20cf5-02cc-40c1-b310-e721e2ea7bbf","resolution":{"observed_at":"2026-07-08T07:14:45.433532Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T07:56:04.954255Z","title":"Qwen3.6-27B: Flagship-level coding in a 27B dense model, April 2026","venue":null,"work_id":"2bf8376a-c906-4375-9261-41d52a22bfb9","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:b20e0bc46d729f9d3d9e061597f24263c6823946fd1dca88985643f975d0a7a7","observation_id":"a7e6a948-fdb6-4cbc-9887-7506ede97bf2","resolution":{"observed_at":"2026-07-08T07:24:43.693592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.694418Z","title":null,"venue":null,"work_id":"6e8a3436-da04-4188-908e-359164d6bcd1","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:620c0671021e217df090bcb027063e9dff3c8334e4db8f3a028400fc55bf041f","observation_id":"200de719-b032-4001-99d9-62d85cf3582a","resolution":{"observed_at":"2026-07-08T07:24:43.695786Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.685540Z","title":"World guidance: World modeling in condition space for action generation","venue":null,"work_id":"b88638c6-7b51-4f6f-940b-e6b4937025f8","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:52156a5e4266a29fb760c058a487ab1ef2acce28579713b3324bca0bd53bcc18","observation_id":"a50f5f59-ac4b-4439-9906-daba83719e83","resolution":{"observed_at":"2026-07-08T07:24:43.687497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.676956Z","title":"Masked depth modeling for spatial perception","venue":null,"work_id":"7b81e6de-6b80-4685-8578-aacd6fc714d5","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:7e4f9b43aea6799e6db4210c25b38606f1f00be7bd1e03c43c2055c5b924be3b","observation_id":"1d7926b9-6a1e-44e7-b461-e6af4cac3c85","resolution":{"observed_at":"2026-07-08T07:24:43.678764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.08122","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:14:45.404867Z","title":"Towards human-like manipulation through RL-augmented teleoperation and mixture-of-dexterous-experts VLA.arXiv preprint arXiv:2603.08122, 2026","venue":null,"work_id":"db685b2b-f13e-4e70-8d1b-a836e3531459","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:422a07d65cef72d756eeac061e8a6cc639d98a409e90e88f5522ef7cecec2db5","observation_id":"d86c13d0-8e17-4dfe-ac6a-dab771786a42","resolution":{"observed_at":"2026-07-08T07:14:45.408586Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20020","last_updated":"2025-03-25T19:02:56Z","snapshot_observed_at":"2026-08-13T04:40:33.458745Z","submitted_at":"2025-03-25T19:02:56Z","title":"Gemini Robotics: Bringing AI into the Physical World","version":1},"cited_work":{"arxiv_id":"2503.20020","doi":"10.48550/arxiv.2503.20020","metadata_source":"pith","pith_arxiv_id":"2503.20020","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemini Robotics: Bringing AI into the Physical World","venue":"cs.RO","work_id":"f7c5ce10-8364-4fbe-964f-2802b81c3a98","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2503.20020","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:4363abfc36e112c2835b7cbed626e18ff2f0a89eb3c8d39b1fbd032fdf741b72","observation_id":"f87599c4-14d9-4a46-97d3-26cbd1f2227d","resolution":{"observed_at":"2026-07-08T07:14:45.412977Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.699669Z","title":"Gen-1: Scaling embodied foundation models to mastery.Generalist AI Blog, 2026","venue":null,"work_id":"1215b35f-0045-4d62-9237-66b27afb5dcc","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:71ffabc3764b1de9c3b1244118760abb529fa96c5c9764d8b7c592ba89f9db49","observation_id":"e1815cef-e8cf-43ef-8c62-97586520cf08","resolution":{"observed_at":"2026-07-08T07:24:43.701906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.682691Z","title":"GR00T N1.6: An improved open foundation model for generalist humanoid robots","venue":null,"work_id":"609e320b-ab52-4598-bed0-d62abffa71e0","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:853e82dd41354a5c311b16dc1b72a528a5eb8825d446366948f76ed1525ac5c7","observation_id":"6fc84b0e-6424-425a-b3e2-68d61766908b","resolution":{"observed_at":"2026-07-08T07:24:43.684694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.705342Z","title":"Qwen-robotmanip technical report: Alignment unlocks scale for robotic manipulation foundation models","venue":null,"work_id":"79fc0c14-5439-4985-b95a-c8bdd0673de2","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:f03bdf21a946fdcad1125d3182f6e4a26e747843d65660a352b86cf48012ba49","observation_id":"9a260665-5e6e-4215-bd3a-d4184da1253e","resolution":{"observed_at":"2026-07-08T07:24:43.707305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.30280","last_updated":"2026-06-01T13:48:35Z","snapshot_observed_at":"2026-08-04T01:13:02.026321Z","submitted_at":"2026-05-28T17:36:31Z","title":"Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments","version":2},"cited_work":{"arxiv_id":"2605.30280","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.30280","snapshot_observed_at":"2026-07-10T19:47:32.615085Z","title":"Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments","venue":"cs.RO","work_id":"88b299ef-a020-4d77-898a-de62683da6ed","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2605.30280","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:c56af1a0ecbde676f96364351a7b1225e6106da982bb2882b1390a4b520fb1b7","observation_id":"e3815cc7-0ec4-4778-a075-b92499ecd99c","resolution":{"observed_at":"2026-07-08T07:14:45.417284Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.14349","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:14:45.395412Z","title":"Vision-centric activation and coordination for multimodal large language models","venue":null,"work_id":"5eeb69b7-9408-480a-9d98-3671dce190de","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:a90e1879bf9b23a5606bff51e62205577351b4bd01f871b656e9b391e7f4cdd5","observation_id":"dfc55af1-d17c-4f73-bb2c-ae5e12688dc7","resolution":{"observed_at":"2026-07-08T07:14:45.398070Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.696729Z","title":"The Great March 100: 100 detail-oriented tasks for evaluating embodied ai agents","venue":null,"work_id":"6edb7d96-4544-4fc1-8a52-fac7f039aed8","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:b478dcc275ec1575c5d09d6e3772d8b87e2dff49babbf5e13ff1ea97161a79d2","observation_id":"e14e13a8-c8c0-411d-8d07-72518703617a","resolution":{"observed_at":"2026-07-08T07:24:43.698622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.688385Z","title":"Videorope: What makes for good video rotary position embedding? InInt","venue":null,"work_id":"db583a9c-55a8-402c-9626-c5a015d37674","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:732ad68b21613f41255c53b7d9c4c7ce52e39e90eb02680bef2252c5901a3fc4","observation_id":"a33f30d5-2454-4287-bcc9-6475f0bd0426","resolution":{"observed_at":"2026-07-08T07:24:43.690508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18692","last_updated":"2026-02-26T03:30:01Z","snapshot_observed_at":"2026-08-11T08:52:29.230329Z","submitted_at":"2026-01-26T17:08:04Z","title":"A Pragmatic VLA Foundation Model","version":2},"cited_work":{"arxiv_id":"2601.18692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.18692","snapshot_observed_at":"2026-07-10T07:26:54.460833Z","title":"A Pragmatic VLA Foundation Model","venue":"cs.RO","work_id":"9b5a37fb-5c5d-4fbb-a804-d518173f2011","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2601.18692","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:02ed5bec1a48f7ef3e10a71823b655b1a2a7a5824fdc75d034f2852695d82ebe","observation_id":"fad77dea-ea50-4f54-a5e8-29f3e5b9bfa3","resolution":{"observed_at":"2026-07-08T07:14:45.387940Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.716557Z","title":"Hy-embodied-0.5-x: An enhanced embodied foundation model for real-world agents","venue":null,"work_id":"1dcfe1a1-0362-4258-ad3d-d625677d1849","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:db5f1c29b02b54e2c6e8cb60456624f249399d750917ce4bebc52205cd1b3375","observation_id":"826ef41b-3fe4-4b80-82aa-a6989304975a","resolution":{"observed_at":"2026-07-08T07:24:43.718522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.12265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:14:45.389717Z","title":"OmniStream: Mastering perception, reconstruction and action in continuous streams","venue":null,"work_id":"cde067bb-54de-4acd-b611-49a821df4a83","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:ce9b2bc45923a058f99224053d19e36abfc0ef667240ad4dbc1399b9f69545e3","observation_id":"b24c01e9-c49b-49d3-9a91-7304df6f9778","resolution":{"observed_at":"2026-07-08T07:14:45.393708Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.713978Z","title":"Magma: A foundation model for multimodal AI agents","venue":null,"work_id":"46f85f7b-c3d9-483d-af34-d38e228b66e1","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:391ee0525c784c779c3f1c82ec276155a87a738d561454bd397ffe6e68416767","observation_id":"0151f29a-b4ac-4cd7-841c-c12b40ffbc18","resolution":{"observed_at":"2026-07-08T07:24:43.715649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.11236","last_updated":"2026-04-14T10:01:08Z","snapshot_observed_at":"2026-07-06T22:45:29.609382Z","submitted_at":"2026-02-11T16:47:01Z","title":"ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning","version":2},"cited_work":{"arxiv_id":"2602.11236","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.11236","snapshot_observed_at":"2026-07-08T07:14:45.378913Z","title":"ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning","venue":"cs.CV","work_id":"30745958-0491-4e57-a989-e53b1a7fe19f","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2602.11236","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:a6a40b94c9180bed64dc6499d9e91fe4c7e07177542ba8a7d8e960c8c0bbdede","observation_id":"233158c1-bc37-43e6-9c03-04ddb6cefe9f","resolution":{"observed_at":"2026-07-08T07:14:45.381619Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11757","last_updated":"2026-04-13T17:30:01Z","snapshot_observed_at":"2026-07-06T23:00:03.762376Z","submitted_at":"2026-04-13T17:30:01Z","title":"StarVLA-$\\alpha$: Reducing Complexity in Vision-Language-Action Systems","version":1},"cited_work":{"arxiv_id":"2604.11757","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.11757","snapshot_observed_at":"2026-07-08T07:14:45.383420Z","title":"StarVLA-$\\alpha$: Reducing Complexity in Vision-Language-Action Systems","venue":"cs.RO","work_id":"12a3a5c8-e654-4f54-af2c-2f58d033ffc9","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2604.11757","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:eb2f8258ad3ef970eca3dab743f335f598c0fca22a2fba0b91005fb3deb533a4","observation_id":"77d13554-2337-4648-a28b-1f0e9f6599ba","resolution":{"observed_at":"2026-07-08T07:14:45.385142Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.08113","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:14:45.400005Z","title":"Samoe- vla: A scene adaptive mixture-of-experts vision-language-action model for autonomous driving","venue":null,"work_id":"85554142-7ae2-4404-9f40-fdb59f003371","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:d414f91dd3ffbe7b973190aa30f8c7f8d94752df5ccd1c62e84ad859a46d3e9f","observation_id":"738073c5-f75c-40ba-aed7-3ee744efdefc","resolution":{"observed_at":"2026-07-08T07:14:45.403016Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.22159","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:14:45.419065Z","title":"Forcevla: Enhancing vla models with a force-aware moe for contact-rich manipulation","venue":null,"work_id":"0b6974ec-d23e-487a-8190-e895bab17267","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:16cb045ec679311e3be12b0811127c7579f4c1545459327768a877b5df5d1c47","observation_id":"7019218b-1805-44b6-9062-ccefc4d59f97","resolution":{"observed_at":"2026-07-08T07:14:45.421603Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.30877","last_updated":"2026-06-01T02:49:15Z","snapshot_observed_at":"2026-08-02T17:03:10.577295Z","submitted_at":"2026-05-29T06:04:03Z","title":"Wall-OSS-0.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2605.30877","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.30877","snapshot_observed_at":"2026-07-10T04:16:48.754139Z","title":"Wall-OSS-0.5 Technical Report","venue":"cs.RO","work_id":"6386bad8-4e7c-4c42-9ab5-4b6af1f11a64","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2605.30877","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:d38fbb09439f0644c2d86c52ce41b6d7ff8c896462cd0e33316518f40d5d93a8","observation_id":"9d0f20ee-5153-47d9-8194-1471d3e15e7f","resolution":{"observed_at":"2026-07-08T07:14:45.374157Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.11766","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T23:37:42.924974Z","title":"Igniting vlms toward the embodied space","venue":null,"work_id":"a0f111cf-bd1b-4bc6-ad3a-f8ffbc1045f4","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:199eed281aa46b93bcf92e9ea7a34a3ab813c904761943366c5116f93311e36c","observation_id":"b61eabe8-f1df-46c2-bb7a-665fb8187bde","resolution":{"observed_at":"2026-07-08T07:14:45.377496Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.07648","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:14:45.368441Z","title":"AtomicVLA: Unlocking the potential of atomic skill learning in robots.arXiv preprint arXiv:2603.07648, 2026","venue":null,"work_id":"d7f0a9a6-8928-4e9c-9518-ee5aac4b484a","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:2b657c14afe669701d1bcdfd2db3bd4573e3468b85be2a33d3c9eed277fa0651","observation_id":"b610e1b9-44f4-4f9c-867c-890dbb7e5f3b","resolution":{"observed_at":"2026-07-08T07:14:45.370620Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.28548","last_updated":"2026-05-27T14:39:42Z","snapshot_observed_at":"2026-08-05T18:31:00.706002Z","submitted_at":"2026-05-27T14:39:42Z","title":"GEM: Generative Supervision Helps Embodied Intelligence","version":1},"cited_work":{"arxiv_id":"2605.28548","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.28548","snapshot_observed_at":"2026-07-08T07:14:45.365277Z","title":"GEM: Generative Supervision Helps Embodied Intelligence","venue":"cs.CV","work_id":"8cbd1bec-4e45-408e-8d75-d09023d50911","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2605.28548","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:0a7eb0eb2583b92688a38d8dad9985adea6ec44cbcc690a87ad13c3b47438ebf","observation_id":"5f4a89b6-e6f7-4190-8252-542136a69e98","resolution":{"observed_at":"2026-07-08T07:14:45.366955Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":2,"verified_exact":31,"verified_fuzzy":14},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 7 inbound Pith citation observations for arXiv:2607.06403."}