{"as_of":"2026-08-19T21:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7ea2404b296217bce930fbace9ffa59eafaba154c31d7910ed3cb21cc9b9d81d","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T21:58:48.611343Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T20:46:04.923901Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.31286","snapshot_observed_at":"2026-07-11T20:46:04.923901Z","title":"Demavla: A vision-language-action foundation model for generalizable deformable manipulation.arXiv preprint arXiv:2605.31286,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04234","last_updated":"2026-07-05T11:12:29Z","snapshot_observed_at":"2026-07-11T20:46:04.581079Z","submitted_at":"2026-07-05T11:12:29Z","title":"SoftVTBench: A Safety-Aware Visuo-Tactile Benchmark for Physically Constrained Robotic Manipulation of Deformable Objects","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-11T20:46:04.923901Z"},"links":{"cited_paper":"/paper/2605.31286","citing_paper":"/paper/2607.04234"},"observation_digest":"sha256:364f18f2570afc00c38b42d35175994fc8f78f9afab0570ad950ca8c0c39e00b","observation_id":"a8523749-3fbd-4682-9e55-639488fd01b0","resolution":{"observed_at":"2026-07-11T20:46:04.923901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.31286","snapshot_observed_at":"2026-07-11T11:21:18.588143Z","title":"DeMaVLA: A vision-language-action foundation model for generalizable deformable manipulation.arXiv preprint arXiv:2605.31286, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04927","last_updated":"2026-07-06T10:57:01Z","snapshot_observed_at":"2026-08-14T09:59:31.893846Z","submitted_at":"2026-07-06T10:57:01Z","title":"DSWAM: A Dual-System World Action Foundation Model for Fine-Grained Robot Manipulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-11T11:21:18.588143Z"},"links":{"cited_paper":"/paper/2605.31286","citing_paper":"/paper/2607.04927"},"observation_digest":"sha256:c32ea1e6966414f4c9ac96a119f526f45849eb32a199f884487007eda6398caf","observation_id":"f8f84011-ab4c-4c8d-a5ac-eb0591ac4d79","resolution":{"observed_at":"2026-07-11T11:21:18.588143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.31286","snapshot_observed_at":"2026-07-11T14:23:57.266710Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05468","last_updated":"2026-07-06T07:10:22Z","snapshot_observed_at":"2026-08-19T09:02:30.811257Z","submitted_at":"2026-07-06T07:10:22Z","title":"Learning 4D Geometric Priors for Inference-Efficient World Action Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-07-11T14:23:57.266710Z"},"links":{"cited_paper":"/paper/2605.31286","citing_paper":"/paper/2607.05468"},"observation_digest":"sha256:b7072a4a34778841df94ebfba391b3f1d35683691ff36abb7ab3e85772e029b4","observation_id":"1ccb8264-a599-42c5-bf2e-e74afb398eb1","resolution":{"observed_at":"2026-07-11T14:23:57.266710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.31286/citation-record","integrity":"/paper/2605.31286/integrity","json":"/paper/2605.31286/citation-record.json","paper":"/paper/2605.31286"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:1007ddf8f7e974a84910edea16a72f77e992c16a704040735e87c839631d3cf7","observation_id":"d31bef59-942d-4b01-b1d9-40da007ba36e","resolution":{"observed_at":"2026-07-01T19:56:10.394231Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-08T07:16:45.596308Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":"2407.07726","doi":"10.48550/arxiv.2407.07726","metadata_source":"pith","pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PaliGemma: A versatile 3B VLM for transfer","venue":"cs.CV","work_id":"df6f48b3-5792-47c7-9614-cb856ea31ad9","year":2024},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:af5030f8cbd53cd165a09ad0b6fa95470ce6401e9b425da8eeb6dd4f1e436f10","observation_id":"dc6a7625-44a6-42e1-9a5b-c858f355c4d5","resolution":{"observed_at":"2026-07-01T19:56:10.428612Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-22T13:22:31.538292+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T13:22:31.538292+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":"2503.14734","doi":"10.48550/arxiv.2503.14734","metadata_source":"pith","pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","venue":"cs.RO","work_id":"e2db69c7-ee8a-4cb7-a761-7b8de1dfcf97","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:70852c9aefa93fa1741b8297299ecb19599bdd4d3e054a5465e2a3d91bd0e765","observation_id":"d86c246f-5270-4827-81ed-4d82d80fa67e","resolution":{"observed_at":"2026-07-01T19:56:10.340717Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-12T08:49:11.206777+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T08:49:11.206777+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-08-16T17:53:54.636855Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":"2410.24164","doi":"10.48550/arxiv.2410.24164","metadata_source":"pith","pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","venue":"cs.LG","work_id":"f790abdc-a796-482f-a40d-f8ee035ecfc2","year":2024},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:0a8c04690dec562e0e1bf8e14c30afd944ca4e9cd8c9b9fd5f7895a94ac0b2f0","observation_id":"86a0d7f4-aa26-40ff-a8cb-1ff68843b1dd","resolution":{"observed_at":"2026-07-01T19:56:10.423826Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.05964","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T23:37:42.592261Z","title":"Training-time action conditioning for efficient real-time chunking","venue":null,"work_id":"6020f742-1ba8-46fa-9efb-b9088733c37a","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:453c76ee768cc9ea70c1c63bac771d49814c39ae6ac578ead46e17bf52bd6c91","observation_id":"b8b71efe-b976-4e16-8f61-badf360c53e5","resolution":{"observed_at":"2026-07-01T19:56:10.412825Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T21:58:48.611343Z","title":"Real-time execution of action chunking flow policies.Advances in Neural Information Processing Systems, 38:33383–33407, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:8b021dac3fb8537c9d5edfd834e415fb7a4d0c6e3d2bb90ef3f18319896106b5","observation_id":"3baeb24a-5909-4a9a-9bb7-c2ffca01c367","resolution":{"observed_at":"2026-06-28T21:58:48.611343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.12684","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T23:07:47.711193Z","title":"arXiv preprint arXiv:2602.12684 (2026)","venue":null,"work_id":"d4ca4245-5a33-487c-83b0-988ef4c60db7","year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:3a136e877ddaa59ace7d5929cf9b419108380a3fa3042df34d679c09dcd3fc43","observation_id":"0bc8d3e1-d01f-4537-93fe-2d7e6d1492b5","resolution":{"observed_at":"2026-07-01T19:56:10.421785Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T21:58:48.611343Z","title":"Interactive imitation learning in robotics: A survey.Foundations and Trends®in Robotics, 10(1-2):1–197, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:df4645b68b142fbaea65dada4adad957d11daac73aa0ac9180a8bb7d2922e069","observation_id":"3b44f106-5c57-48d6-bd86-8313d80eb5d9","resolution":{"observed_at":"2026-06-28T21:58:48.611343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.17502","last_updated":"2026-05-30T03:49:39Z","snapshot_observed_at":"2026-08-03T20:59:48.866420Z","submitted_at":"2025-11-21T18:59:32Z","title":"RynnVLA-002: A Unified Vision-Language-Action and World Model","version":3},"cited_work":{"arxiv_id":"2511.17502","doi":"10.48550/arxiv.2511.17502","metadata_source":"pith","pith_arxiv_id":"2511.17502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Rynnvla-002: A unified vision-language-action and world model","venue":"cs.RO","work_id":"f28355c2-726f-4492-899f-be74df2c09cd","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2511.17502","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:d9c21b66ab9ffcdb43797077a5893880dc0972bdb3863b2e88c3905aade474b7","observation_id":"649ee648-8e63-44a7-8195-f24c1d4bb078","resolution":{"observed_at":"2026-07-01T19:56:10.427156Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15493","last_updated":"2025-07-22T15:04:37Z","snapshot_observed_at":"2026-08-06T13:23:03.968769Z","submitted_at":"2025-07-21T10:54:13Z","title":"GR-3 Technical Report","version":2},"cited_work":{"arxiv_id":"2507.15493","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.15493","snapshot_observed_at":"2026-07-10T04:16:48.751910Z","title":"GR-3 Technical Report","venue":"cs.RO","work_id":"7f3b800b-0146-4c37-b178-0801cd4270db","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2507.15493","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:27feb1405ea76833b60585beeba73f5503c918177e3f42d0ef666516ec141221","observation_id":"3546b866-9125-46e2-872e-6903d860429e","resolution":{"observed_at":"2026-07-01T19:56:10.424772Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18088","last_updated":"2025-08-27T17:52:42Z","snapshot_observed_at":"2026-08-01T01:17:47.017808Z","submitted_at":"2025-06-22T16:26:53Z","title":"RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation","version":2},"cited_work":{"arxiv_id":"2506.18088","doi":"10.48550/arxiv.2506.18088","metadata_source":"pith","pith_arxiv_id":"2506.18088","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation","venue":"cs.RO","work_id":"9b985126-4a2f-4bdf-b014-2a7524ec634e","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2506.18088","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:f743e26a6723ce47938cd4dce734660068f22fbe28fb743a7cb0f0c77d529b7e","observation_id":"baae2a12-7ed8-416f-a29f-65fc208ddc12","resolution":{"observed_at":"2026-07-01T19:56:10.429643Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05014","last_updated":"2026-04-06T17:59:21Z","snapshot_observed_at":"2026-08-11T13:37:09.952888Z","submitted_at":"2026-04-06T17:59:21Z","title":"StarVLA: A Lego-like Codebase for Vision-Language-Action Model Developing","version":1},"cited_work":{"arxiv_id":"2604.05014","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.05014","snapshot_observed_at":"2026-07-10T07:26:54.478996Z","title":"StarVLA: A Lego-like Codebase for Vision-Language-Action Model Developing","venue":"cs.RO","work_id":"e9be5436-00f8-4b43-b82a-ff154145e079","year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2604.05014","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:ca2d3af027e77ee4b46ca3b836c91df64332f6d6404f82ff95f462a55d350050","observation_id":"69b1b96c-2985-4494-996b-88bd41ff2eaf","resolution":{"observed_at":"2026-07-01T19:56:10.379180Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02117","last_updated":"2024-01-04T07:55:53Z","snapshot_observed_at":"2026-08-15T12:54:53.410743Z","submitted_at":"2024-01-04T07:55:53Z","title":"Mobile ALOHA: Learning Bimanual Mobile Manipulation with Low-Cost Whole-Body Teleoperation","version":1},"cited_work":{"arxiv_id":"2401.02117","doi":"10.48550/arxiv.2401.02117","metadata_source":"pith","pith_arxiv_id":"2401.02117","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mobile ALOHA: Learning Bimanual Mobile Manipulation with Low-Cost Whole-Body Teleoperation","venue":"cs.RO","work_id":"5f6ff8ef-ed80-4c00-92c2-361c80bf8448","year":2024},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2401.02117","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:cec38b09953dbf3289e49b156d06f17fc8f3dcaf0447af9fba67dcca0de5a0d8","observation_id":"00efa83e-7c76-44d8-ae8b-4b4977cf3de8","resolution":{"observed_at":"2026-07-01T19:56:10.381185Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.08273","last_updated":"2021-09-17T01:21:16Z","snapshot_observed_at":"2026-08-16T17:56:00.491816Z","submitted_at":"2021-09-17T01:21:16Z","title":"ThriftyDAgger: Budget-Aware Novelty and Risk Gating for Interactive Imitation Learning","version":1},"cited_work":{"arxiv_id":"2109.08273","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2109.08273","snapshot_observed_at":"2026-07-03T12:48:11.111034Z","title":"Thriftydagger: Budget-aware novelty and risk gating for interactive imitation learning","venue":null,"work_id":"f1678abd-ca2e-4c2f-a858-081c1f0fbc23","year":2021},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2109.08273","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:a8295ec436f9e8c88bcbec633bf7dc25740429f05c5bae11030b0c9e1fa3c794","observation_id":"5b63e49f-108f-4948-98ab-13e3850f0b70","resolution":{"observed_at":"2026-07-01T19:56:10.409160Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.07953","last_updated":"2025-09-09T17:41:29Z","snapshot_observed_at":"2026-08-14T11:53:09.061661Z","submitted_at":"2025-09-09T17:41:29Z","title":"RaC: Robot Learning for Long-Horizon Tasks by Scaling Recovery and Correction","version":1},"cited_work":{"arxiv_id":"2509.07953","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.07953","snapshot_observed_at":"2026-07-03T12:28:07.233597Z","title":"Rac: Robot learning for long-horizon tasks by scaling recovery and correction","venue":null,"work_id":"0d6ddd41-d7e6-4fb7-aa20-a1a734ca73cb","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2509.07953","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:14d970a8174a1eb0b752a5a3fb009756087dacbad6da2871de99c6860bd0dc7e","observation_id":"f3531602-0d1b-40cc-8a46-a9a56b74f387","resolution":{"observed_at":"2026-07-01T19:56:10.410282Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:45164c08ac03d390f4b40183405e2ab01c51bb670818cf389aae6b6496e27f6d","observation_id":"f25ab638-847b-491d-a10f-6304913606e0","resolution":{"observed_at":"2026-07-01T19:56:10.403716Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":"2504.16054","doi":"10.1609/aaai.v40i28.39562","metadata_source":"pith","pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","venue":"cs.LG","work_id":"d1ad7304-d09a-49bc-809e-846439f6aff9","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:b623fc6df073aa6229fa11169901ed12f85e9bcd3da79c1b3b6b2eae4b9c59ee","observation_id":"6502b855-75d6-437b-b569-94d3fa4dfb64","resolution":{"observed_at":"2026-07-01T19:56:10.398578Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00576","last_updated":"2025-08-30T18:04:19Z","snapshot_observed_at":"2026-08-14T02:52:34.768729Z","submitted_at":"2025-08-30T18:04:19Z","title":"Galaxea Open-World Dataset and G0 Dual-System VLA Model","version":1},"cited_work":{"arxiv_id":"2509.00576","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.00576","snapshot_observed_at":"2026-07-08T07:14:45.460259Z","title":"Galaxea open-world dataset and G0 dual-system VLA model","venue":"cs.RO","work_id":"568af32f-f647-4c11-a106-65ddfa305082","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2509.00576","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:7407b3fe2646cba1063168279aa1aad0af1c5f97dceeba4a99632e9c35fd3991","observation_id":"5f1ceea0-ab82-46d1-80f0-3a8b7b3fb9e9","resolution":{"observed_at":"2026-07-01T19:56:10.401207Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T21:58:48.611343Z","title":"Hg-dagger: Interactive imitation learning with human experts","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:dbb0fe9a15d195d734e9e071520e64977edb6747abf85468f643dccaf9376677","observation_id":"9971aaf8-5eb7-4986-a1e1-84f9dcfa6e4b","resolution":{"observed_at":"2026-06-28T21:58:48.611343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-16T21:53:14.144225Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":"2406.09246","doi":"10.18653/v1/2022.naacl-main.68","metadata_source":"pith","pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","venue":"cs.RO","work_id":"3e7e65c5-5aed-4fe9-8414-2092bcb31cc7","year":2024},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:43625c12b43bcd3660187cd9b25903267e1ed36540af8215c9282daa9430e4ae","observation_id":"661eb9c4-c784-4ecd-9c89-3e375c28f63c","resolution":{"observed_at":"2026-07-01T19:56:10.426409Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T21:58:48.611343Z","title":"Reinforcement learning with augmented data.Advances in neural information processing systems, 33:19884–19895, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:85b6b77158c0b585fea02200a2465933d8a14d39079949172f38cdceba5e563e","observation_id":"c6209d33-3571-4bce-b111-00e70158b444","resolution":{"observed_at":"2026-06-28T21:58:48.611343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.10341","last_updated":"2022-02-17T06:29:46Z","snapshot_observed_at":"2026-08-16T17:20:40.399645Z","submitted_at":"2022-02-17T06:29:46Z","title":"Efficient Learning of Safe Driving Policy via Human-AI Copilot Optimization","version":1},"cited_work":{"arxiv_id":"2202.10341","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2202.10341","snapshot_observed_at":"2026-07-01T19:56:10.416267Z","title":"Efficient learning of safe driving policy via human-ai copilot optimization","venue":null,"work_id":"1cf5f451-ec83-49bc-9711-3b28ade4c3e4","year":2022},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2202.10341","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:83479c91bb821365bf6135c182fdc8d9925d8dacabaa20b671c29eae7dec0176","observation_id":"b2c245e3-e9de-43e1-a95d-67ed23389d15","resolution":{"observed_at":"2026-07-01T19:56:10.417816Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.01801","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T17:40:00.364043Z","title":"Gr-rl: Going dexterous and precise for long-horizon robotic manipulation","venue":null,"work_id":"4f346bfa-1c16-4774-8008-440611a77af7","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:96281087b4ef09c48fc5530f64b7464b80dae2022083a2e8d0b8a987ef3ce1d7","observation_id":"303ed987-7efa-4c1f-9f94-64bdbeb09045","resolution":{"observed_at":"2026-07-01T19:56:10.396125Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.12062","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:26:10.991036Z","title":"HoloBrain-0 technical report","venue":null,"work_id":"ae9c3bee-5775-4997-a93a-47049c7cab3e","year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:5d622aaedcc9561d0886e568058a3acb945f16d4a0ff5146a60836ecdb218b94","observation_id":"7efd9857-db2a-4235-adf5-185c32fc30f5","resolution":{"observed_at":"2026-07-01T19:56:10.374801Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-16T02:30:42.660030Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":"2210.02747","doi":"10.1038/s41467-024-47656-z","metadata_source":"pith","pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flow Matching for Generative Modeling","venue":"cs.LG","work_id":"6edb71c4-5d64-40af-a394-9757ea051a36","year":2022},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:87a20f47e4f00b2238509ec4c3bdff14e41a5a5c8c1e8a9905dc4c50f71bfcfc","observation_id":"0bfdb06d-9720-4581-ae5d-4454bc18913c","resolution":{"observed_at":"2026-07-01T19:56:10.361856Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.12993","doi":"10.48550/arxiv.2601.12993","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Being-h0","venue":"arXiv (Cornell University)","work_id":"2c66b688-268c-4501-bc7a-88376b03d92f","year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:1e47f33dee1fceb2c91010802439d9d6277d7b3120a546cc67fe48b1565893fd","observation_id":"e0dcd32a-d2b5-437d-931b-7a0379f56b7d","resolution":{"observed_at":"2026-07-01T19:56:10.387419Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.06733","last_updated":"2020-12-12T05:30:35Z","snapshot_observed_at":"2026-08-16T18:59:04.898571Z","submitted_at":"2020-12-12T05:30:35Z","title":"Human-in-the-Loop Imitation Learning using Remote Teleoperation","version":1},"cited_work":{"arxiv_id":"2012.06733","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.06733","snapshot_observed_at":"2026-07-04T13:09:50.357171Z","title":"Human-in-the-loop imitation learning using remote tele- operation","venue":null,"work_id":"d26db493-4fc8-4cd0-833f-2934093e0b1b","year":2012},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2012.06733","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:3b44348969df32d4e5a184b00e8687e0bc009fd55758be84eae1e5aa12740e55","observation_id":"02bc5ddc-ea70-40d3-9c9f-bd502fcc6c9d","resolution":{"observed_at":"2026-07-01T19:56:10.370614Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":"2501.09747","doi":"10.48550/arxiv.2501.09747","metadata_source":"pith","pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","venue":"cs.RO","work_id":"83a8f966-6cfa-4f21-81f3-87440aae238f","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:0d948d0ddd7053415be0e17112c22b76d6d32dd33dbf24a010eb9ee59f337bf2","observation_id":"6b0e00ea-2806-42c1-b3f1-4da682061fc8","resolution":{"observed_at":"2026-07-01T19:56:10.383901Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T21:58:48.611343Z","title":"A reduction of imitation learning and structured prediction to no-regret online learning","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:e22104c10a81d1e0cb4c29d3d852c5bb818d5261d9c3dc0f83986a7433e2ac32","observation_id":"282d1af0-5a82-4121-8dda-60230e9a3c7a","resolution":{"observed_at":"2026-06-28T21:58:48.611343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.12099","doi":"10.48550/arxiv.2602.12099","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gigabrain-0.5 m*: a vla that learns from world model-based reinforcement learning","venue":"Open MIND","work_id":"f07c9e2b-1cb9-49ef-b237-baf8dd3da0e4","year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:ca374f4cb1e1d23cb3b4b0c7f44d4fa9d0f79c7ddf5b04246561fcd0182e0c92","observation_id":"30b04f0f-7b75-4878-8525-60865447498e","resolution":{"observed_at":"2026-07-01T19:56:10.390427Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07771","last_updated":"2025-03-10T18:52:54Z","snapshot_observed_at":"2026-08-16T12:51:22.992846Z","submitted_at":"2025-03-10T18:52:54Z","title":"RoboCopilot: Human-in-the-loop Interactive Imitation Learning for Robot Manipulation","version":1},"cited_work":{"arxiv_id":"2503.07771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.07771","snapshot_observed_at":"2026-07-04T06:19:37.569345Z","title":"Robocopilot: Human-in-the-loop interactive imitation learning for robot manipulation","venue":null,"work_id":"704de9db-444f-4a85-9a6e-a8e9edc935e6","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2503.07771","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:9f94df9a6c2d7cee6dea770052cfc27f0b3373cff14fe5052cc4683eaecc3500","observation_id":"144a15e2-87f3-4934-bac9-a89fd6d816c5","resolution":{"observed_at":"2026-07-01T19:56:10.411949Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18692","last_updated":"2026-02-26T03:30:01Z","snapshot_observed_at":"2026-08-11T08:52:29.230329Z","submitted_at":"2026-01-26T17:08:04Z","title":"A Pragmatic VLA Foundation Model","version":2},"cited_work":{"arxiv_id":"2601.18692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.18692","snapshot_observed_at":"2026-07-10T07:26:54.460833Z","title":"A Pragmatic VLA Foundation Model","venue":"cs.RO","work_id":"9b5a37fb-5c5d-4fbb-a804-d518173f2011","year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2601.18692","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:208466e184c0827978c50cefde233c555ca10e099b9afa6cc4235027d886c51d","observation_id":"a827281b-00c4-4db8-a95e-0a4cb8330a04","resolution":{"observed_at":"2026-07-01T19:56:10.415298Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.11236","last_updated":"2026-04-14T10:01:08Z","snapshot_observed_at":"2026-07-06T22:45:29.609382Z","submitted_at":"2026-02-11T16:47:01Z","title":"ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning","version":2},"cited_work":{"arxiv_id":"2602.11236","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.11236","snapshot_observed_at":"2026-07-08T07:14:45.378913Z","title":"ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning","venue":"cs.CV","work_id":"30745958-0491-4e57-a989-e53b1a7fe19f","year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2602.11236","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:8833485fc57e1fbe9882f789f54e0dacd5f67dccc931b3d2df5af6b1336771ef","observation_id":"3226f6d6-6d58-4bd1-882d-ebfc51706b56","resolution":{"observed_at":"2026-07-01T19:56:10.393321Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.09021","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:10:07.664649Z","title":"χ0: Resource-aware robust manipulation via taming distributional inconsistencies","venue":null,"work_id":"4f11a14a-a1a6-4d0f-8175-106b806f50f2","year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:cc2ae1a32da59bbc9fa3c5910e293a408784471b9b16568279c1fba540afb3e5","observation_id":"1e35cda1-f2a5-42f0-b844-59321df3fb55","resolution":{"observed_at":"2026-07-01T19:56:10.388956Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.11766","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T23:37:42.924974Z","title":"Igniting vlms toward the embodied space","venue":null,"work_id":"a0f111cf-bd1b-4bc6-ad3a-f8ffbc1045f4","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:0b2f2243f744bfdd41a4acf923d27e118becaad9aad4de1fb5a266dea0cc7352","observation_id":"5d4ce01d-0765-4e20-a9ba-43dea1aa92a6","resolution":{"observed_at":"2026-07-01T19:56:10.376197Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20100","last_updated":"2026-04-23T04:10:40Z","snapshot_observed_at":"2026-08-16T05:48:33.705590Z","submitted_at":"2026-04-22T01:51:48Z","title":"JoyAI-RA 0.1: A Foundation Model for Robotic Autonomy","version":2},"cited_work":{"arxiv_id":"2604.20100","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.20100","snapshot_observed_at":"2026-07-03T17:08:42.641379Z","title":"JoyAI-RA 0.1: A Foundation Model for Robotic Autonomy","venue":"cs.RO","work_id":"917f12b3-433d-4099-895a-95b79d353370","year":2026},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2604.20100","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:fc9d4a5261d62963853757cb7020c0fe79d2bb84cad993e3e28f887220087cda","observation_id":"de67d6c5-8687-4df8-acd0-8354226005d1","resolution":{"observed_at":"2026-07-01T19:56:10.353861Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.10274","last_updated":"2025-10-11T16:20:17Z","snapshot_observed_at":"2026-08-18T08:46:36.907284Z","submitted_at":"2025-10-11T16:20:17Z","title":"X-VLA: Soft-Prompted Transformer as Scalable Cross-Embodiment Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":"2510.10274","doi":"10.48550/arxiv.2510.10274","metadata_source":"pith","pith_arxiv_id":"2510.10274","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"X-VLA: Soft-Prompted Transformer as Scalable Cross-Embodiment Vision-Language-Action Model","venue":"cs.RO","work_id":"13faca8d-e96d-4e6c-a441-9f2683d11934","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2510.10274","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:970942d38b0ab133e8688f27e13f3976981147caac12dda20c608ab355036c3e","observation_id":"af956799-8209-4fc5-81da-52d926799d12","resolution":{"observed_at":"2026-07-01T19:56:10.363522Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T21:58:48.611343Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:3947ba8095666e133e2f1239c36e5fb611e0a19a8ea784bea734adaec9fb443c","observation_id":"b3ef4f82-d55c-4413-bd89-f10d377a319c","resolution":{"observed_at":"2026-06-28T21:58:48.611343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-13T09:03:31.012534Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":6,"verified_exact":31,"verified_fuzzy":0},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 3 inbound Pith citation observations for arXiv:2605.31286."}