{"as_of":"2026-08-08T19:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d858dc951fd88c2307f6f4329cfe009ad6d45b8631e002021e36efb1ee2a8422","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":31,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:10:11.693083Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T09:59:44.548397Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2412.14803","last_updated":"2025-05-04T04:28:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T12:48:40Z","title":"Video Prediction Policy: A Generalist Robot Policy with Predictive Visual Representations","version":2},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-05-12T18:38:11.110166Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2412.14803"},"observation_digest":"sha256:ae31aed4bcbbd74b85e84df1d3a912df3be926a555adb1878145750337588c0e","observation_id":"a4dcedf2-a314-48ff-a734-3fb524645888","resolution":{"observed_at":"2026-05-12T18:38:11.188770Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2502.05855","last_updated":"2025-08-09T10:58:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-09T11:25:56Z","title":"DexVLA: Vision-Language Model with Plug-In Diffusion Expert for General Robot Control","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-14T19:48:48.725800Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2502.05855"},"observation_digest":"sha256:b2e29f43250c03f54c34f3b2f0823ee387d954b29ef721845e49a6e92e7dc252","observation_id":"b0f97b08-27e5-4fcf-a420-409b0c1ef202","resolution":{"observed_at":"2026-05-14T19:48:48.815167Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2505.18719","last_updated":"2025-05-24T14:42:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-24T14:42:51Z","title":"VLA-RL: Towards Masterful and General Robotic Manipulation with Scalable Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T12:55:40.245908Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2505.18719"},"observation_digest":"sha256:78c12e669c577b992a8ddb281d3ba5d2d38cfb34b86ca10476d1618a5fce10dc","observation_id":"7108ed8c-d69a-4c54-b1fd-20506952726b","resolution":{"observed_at":"2026-05-16T12:55:40.499761Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-07T14:10:11.693083Z","title":"Improving vision-language-action model with online reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19767","last_updated":"2025-05-26T09:50:15Z","snapshot_observed_at":"2026-08-07T14:04:30.303953Z","submitted_at":"2025-05-26T09:50:15Z","title":"RFTF: Reinforcement Fine-tuning for Embodied Agents with Temporal Feedback","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:11.693083Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2505.19767"},"observation_digest":"sha256:3b7ecfc80a7cdc468390d9800554e77e49c1c022a249563e1ef716347415648d","observation_id":"a27cf8f7-cea0-43b4-b7c8-1ec0799ea99a","resolution":{"observed_at":"2026-08-07T14:10:11.693083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-07T00:40:21.447558Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13045","last_updated":"2025-08-24T10:01:04Z","snapshot_observed_at":"2026-08-08T06:33:39.031465Z","submitted_at":"2025-06-16T02:27:25Z","title":"Continual Learning for Generative AI: From LLMs to MLLMs and Beyond","version":4},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:21.447558Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2506.13045"},"observation_digest":"sha256:19bd2790f722d65e5d68859ef05af473a21f2ae105a674422b9b4c713c133e47","observation_id":"7c594d43-1aa7-4147-8322-d05287c928d0","resolution":{"observed_at":"2026-08-07T00:40:21.447558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-06T23:36:12.864759Z","title":"Improving vision-language-action model with online reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17639","last_updated":"2026-06-16T03:02:33Z","snapshot_observed_at":"2026-08-07T21:39:08.232650Z","submitted_at":"2025-06-21T08:45:32Z","title":"RLRC: Reinforcement Learning-based Recovery for Compressed Vision-Language-Action Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:36:12.864759Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2506.17639"},"observation_digest":"sha256:3a2311d2ec2642bd08f813ac25b6d500d834dfdceb156ef055eb78a6a74907e5","observation_id":"65301ea4-71ca-451a-a691-056ceb3600ae","resolution":{"observed_at":"2026-08-06T23:36:12.864759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-06T19:53:06.290688Z","title":"Improving vision-language-action model with online reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04452","last_updated":"2025-07-06T16:18:40Z","snapshot_observed_at":"2026-08-08T10:00:23.689092Z","submitted_at":"2025-07-06T16:18:40Z","title":"SimLauncher: Launching Sample-Efficient Real-world Robotic Reinforcement Learning via Simulation Pre-training","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:06.290688Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2507.04452"},"observation_digest":"sha256:b3b86ce0a974dbd79e5c73e664e88cf09e077bf28256aca5479ffadc587db226","observation_id":"689c3033-cf16-4782-a3a7-eb31f2b0ae21","resolution":{"observed_at":"2026-08-06T19:53:06.290688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-05T20:35:43.638797Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10257","last_updated":"2025-08-14T00:51:36Z","snapshot_observed_at":"2026-08-07T13:33:54.413844Z","submitted_at":"2025-08-14T00:51:36Z","title":"Source Component Shift Adaptation via Offline Decomposition and Online Mixing Approach","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T20:35:43.638797Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2508.10257"},"observation_digest":"sha256:8566cefe3adf15368b94dc2c7e60ea0ace79bcb4343d0e9e4218fcb56b43c441","observation_id":"2634ff7d-e50f-4d87-b330-b96d3689fa0c","resolution":{"observed_at":"2026-08-05T20:35:43.638797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-05T20:38:40.022379Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10259","last_updated":"2025-08-14T00:57:58Z","snapshot_observed_at":"2026-08-08T01:00:17.824912Z","submitted_at":"2025-08-14T00:57:58Z","title":"Leveraging OS-Level Primitives for Robotic Action Management","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T20:38:40.022379Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2508.10259"},"observation_digest":"sha256:c4f8e79995ec2885d3bef8e3bdd1119ad501d88e3371c81bf552cf52e422de4c","observation_id":"cd37d08d-cc3e-430e-9226-c59979728f02","resolution":{"observed_at":"2026-08-05T20:38:40.022379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-05T10:30:23.538701Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04063","last_updated":"2025-09-04T09:48:43Z","snapshot_observed_at":"2026-08-06T19:50:15.003871Z","submitted_at":"2025-09-04T09:48:43Z","title":"Balancing Signal and Variance: Adaptive Offline RL Post-Training for VLA Flow Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T10:30:23.538701Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2509.04063"},"observation_digest":"sha256:344d679afb9aa320f7ee601b9c87468a858bae2bb9cfdcf59a01270ddb8a9c7e","observation_id":"35ba3196-ca77-4c1e-8e83-1549cb75e2ac","resolution":{"observed_at":"2026-08-05T10:30:23.538701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-04T23:11:31.875241Z","title":"Improving vision-language-action model with online reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06759","last_updated":"2025-09-08T14:47:57Z","snapshot_observed_at":"2026-08-08T01:24:21.409658Z","submitted_at":"2025-09-08T14:47:57Z","title":"Aligning Large Vision-Language Models by Deep Reinforcement Learning and Direct Preference Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T23:11:31.875241Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2509.06759"},"observation_digest":"sha256:13e4428ee17643bd69d5e7c67f4adff58f09a1c15133e17b374f066d8f778d57","observation_id":"2725aca8-5c7c-48f3-8fbf-57cd903c3e8f","resolution":{"observed_at":"2026-08-04T23:11:31.875241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2509.09674","last_updated":"2025-09-11T17:59:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-11T17:59:17Z","title":"SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-15T08:02:11.189795Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2509.09674"},"observation_digest":"sha256:b4be7e8b08dd1d21261ec09110248ac23a82df501ed0e7921d9b8dacdb515507","observation_id":"0bfe0573-d8ee-4686-9445-2942dda656c4","resolution":{"observed_at":"2026-05-15T08:02:11.482284Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-04T10:24:56.027069Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.09976","last_updated":"2026-06-25T14:25:12Z","snapshot_observed_at":"2026-08-04T10:24:54.103532Z","submitted_at":"2025-10-11T03:11:18Z","title":"Reinforcement Fine-Tuning of Flow-Matching Policies for Vision-Language-Action Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T10:24:56.027069Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2510.09976"},"observation_digest":"sha256:228cf14d418ac0bbe8f51b7c7b1e6b3e5c5e17aea52918c405bf22462f7f4fbf","observation_id":"1ab1b8f3-bc2c-4628-bbb2-d0007fb19793","resolution":{"observed_at":"2026-08-04T10:24:56.027069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2510.10125","last_updated":"2026-03-01T08:24:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-11T09:13:10Z","title":"Ctrl-World: A Controllable Generative World Model for Robot Manipulation","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T01:14:10.174044Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2510.10125"},"observation_digest":"sha256:007be608747e02836cc1da796240f0f49e55d8646942a3186507a8d26c6281c4","observation_id":"98b2c27e-2eaa-4d5d-bc6d-f8c540b37840","resolution":{"observed_at":"2026-05-16T01:14:10.368029Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2510.12710","last_updated":"2026-04-09T08:55:45Z","snapshot_observed_at":"2026-07-06T22:32:37.311210Z","submitted_at":"2025-10-14T16:44:39Z","title":"Reflection-Based Task Adaptation for Self-Improving VLA","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-18T07:28:11.187479Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2510.12710"},"observation_digest":"sha256:d9d7a7f0e8b50a6117dd860ebf6525d72d3672fa91b72872d9e64562f1b056d0","observation_id":"90b52234-e401-4d30-be29-95df048fed96","resolution":{"observed_at":"2026-05-18T07:31:02.913540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:137e2d8596996f7ed22f8ce0c2d4ba37a063523c64c01c077b37ab3898f3ff4e","observation_id":"96f1fb71-e18f-481e-972d-a1fafab88cf6","resolution":{"observed_at":"2026-05-12T10:34:59.347237Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-03T13:53:24.794126Z","title":"Improving vision- language-action model with online reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.22539","last_updated":"2026-07-02T08:55:28Z","snapshot_observed_at":"2026-08-06T03:03:38.906157Z","submitted_at":"2025-12-27T09:40:54Z","title":"VLA-Arena: An Open-Source Framework for Benchmarking Vision-Language-Action Models","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T13:53:24.794126Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2512.22539"},"observation_digest":"sha256:5a8f1f7decbf224e7e79aad3096f068e97667881f0b44336acd7c007e2e295ff","observation_id":"1ab87388-22a1-49df-b0e9-e41fa555e3f4","resolution":{"observed_at":"2026-08-03T13:53:24.794126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-03T12:30:33.790260Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.03309","last_updated":"2026-05-30T09:29:28Z","snapshot_observed_at":"2026-08-03T12:30:32.952137Z","submitted_at":"2026-01-06T09:58:24Z","title":"VLM4VLA: Revisiting Vision-Language-Models in Vision-Language-Action Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T12:30:33.790260Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2601.03309"},"observation_digest":"sha256:faf1d4392eea97ffa13828f4b70f687a274314a6375ac927ebefb793c380696a","observation_id":"50f1e294-9b47-479e-a108-da46695ada15","resolution":{"observed_at":"2026-08-03T12:30:33.790260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2602.07399","last_updated":"2026-05-22T10:22:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-07T06:31:53Z","title":"VGAS: Value-Guided Action-Chunk Selection for Few-Shot Vision-Language-Action Adaptation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-25T07:00:01.741166Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2602.07399"},"observation_digest":"sha256:dcb75edb3d10999c76222f6972708da71eb847acc8eb5b00b57131b50b981e8c","observation_id":"58ea4866-2491-401c-8be1-2517f1eb356e","resolution":{"observed_at":"2026-05-25T07:00:25.994640Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2602.09023","last_updated":"2026-05-19T02:18:04Z","snapshot_observed_at":"2026-08-02T13:36:40.045905Z","submitted_at":"2026-02-09T18:59:52Z","title":"TwinRL: Digital Twin-Driven Reinforcement Learning for Real-World Robotic Manipulation","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-21T13:13:53.818915Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2602.09023"},"observation_digest":"sha256:b5e2742d23688214cb5f05b74ec429e5b8507db627757c0c75101d7d55f15366","observation_id":"a8596dfc-c014-4905-aa7b-adc13a2adb55","resolution":{"observed_at":"2026-05-21T13:14:10.897478Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2602.10503","last_updated":"2026-05-16T03:35:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-11T04:05:03Z","title":"Towards Long-Lived Robots: Continual Learning VLA Models via Reinforcement Fine-Tuning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-21T14:07:10.387869Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2602.10503"},"observation_digest":"sha256:59cc28b868653ee0f103b12551c0636ba9c7f1420533ad9f353f410c0419a0f2","observation_id":"0d17fbb1-bf9e-414c-b44b-a41290644b48","resolution":{"observed_at":"2026-05-21T14:10:13.288701Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2603.22844","last_updated":"2026-05-05T16:08:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-24T06:32:12Z","title":"PhySe-RPO: Physics and Semantics Guided Relative Policy Optimization for Diffusion-Based Surgical Smoke Removal","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T01:22:42.691009Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2603.22844"},"observation_digest":"sha256:cf6bddecbaa7afafa8ae4267533675854f4107c11521038ba565175a978386ac","observation_id":"694260c5-fe28-4f0e-baf9-87fcd39c434c","resolution":{"observed_at":"2026-05-15T01:23:26.867422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2604.04502","last_updated":"2026-04-06T07:57:52Z","snapshot_observed_at":"2026-07-06T22:53:29.118925Z","submitted_at":"2026-04-06T07:57:52Z","title":"Veo-Act: How Far Can Frontier Video Models Advance Generalizable Robot Manipulation?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:54.362107Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2604.04502"},"observation_digest":"sha256:8e4721c26691c08069ac35a8adc4335d46464943b63316eaa922e9925cc493a7","observation_id":"bbc803a6-8cfe-467b-9d40-981a1f8da0fa","resolution":{"observed_at":"2026-05-10T22:10:49.569291Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2604.04834","last_updated":"2026-06-30T15:42:53Z","snapshot_observed_at":"2026-07-13T09:40:35.215938Z","submitted_at":"2026-04-06T16:35:57Z","title":"E-VLA: Event-Augmented Vision-Language-Action Model for Dark and Blurred Scenes","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T20:21:45.365156Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2604.04834"},"observation_digest":"sha256:81629655a58d2ff681265653b0e93e38969f9da74f50d7551a3008a2a95afdb8","observation_id":"f1ace14f-8eea-428c-b697-830e5a049e2a","resolution":{"observed_at":"2026-05-10T22:00:48.347579Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2605.16154","last_updated":"2026-05-15T16:33:59Z","snapshot_observed_at":"2026-07-06T23:27:20.429737Z","submitted_at":"2026-05-15T16:33:59Z","title":"Learn Where Outcomes Diverge: Efficient VLA RL via Probabilistic Chunk Masking","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T21:05:45.024226Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2605.16154"},"observation_digest":"sha256:0bd4ee21b931bc0b12e5bcc263a0f3522329d745f6052c0ef72754d2c4367a21","observation_id":"44d8d85a-3225-42b0-bb30-1eb410e04121","resolution":{"observed_at":"2026-05-20T21:09:02.659480Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2605.17486","last_updated":"2026-05-17T14:55:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-17T14:55:32Z","title":"DyGRO-VLA: Cross-Task Scaling of Vision-Language-Action Models via Dynamic Grouped Residual Optimization","version":1},"reference_index":133,"source":"arxiv_source","source_observed_at":"2026-05-20T12:39:50.004269Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2605.17486"},"observation_digest":"sha256:9629ec0c68da83fea94bb0ff54ebff6f4613e5a2fd1bd82628e8b426c5ceb112","observation_id":"56c18ea0-13ad-4965-98ff-870fb0e1512d","resolution":{"observed_at":"2026-05-20T12:43:17.257279Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2605.22896","last_updated":"2026-05-21T15:24:21Z","snapshot_observed_at":"2026-08-08T03:40:53.017951Z","submitted_at":"2026-05-21T15:24:21Z","title":"Agentic-VLA: Efficient Online Adaptation for Vision-Language-Action Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-25T05:49:15.137844Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2605.22896"},"observation_digest":"sha256:b86d54b8b86ff796e945ce0d841539dec20f1e8ddaf6da6af43de82ad080f960","observation_id":"510528f5-e4b1-4196-8011-37b2e07639e6","resolution":{"observed_at":"2026-05-25T05:50:23.617278Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2606.10927","last_updated":"2026-06-09T14:35:53Z","snapshot_observed_at":"2026-08-01T15:29:53.973770Z","submitted_at":"2026-06-09T14:35:53Z","title":"AllDayNav: Lifelong Navigation via Real-World Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T13:25:59.194721Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2606.10927"},"observation_digest":"sha256:f8dadea7b5ae1971e85118742ff2cf9c74b4595dc97a05e91477d38e6f81dd43","observation_id":"bbde08bf-32e7-433b-9ce7-afe9dc3ef770","resolution":{"observed_at":"2026-07-03T05:07:39.001497Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2606.23640","last_updated":"2026-06-22T17:30:24Z","snapshot_observed_at":"2026-08-02T09:22:48.099895Z","submitted_at":"2026-06-22T17:30:24Z","title":"Learning Process Rewards via Success Visitation Matching for Efficient RL","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T09:20:35.062060Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2606.23640"},"observation_digest":"sha256:9f253321dd928573d18804295f80894bad6ded558ca31db1ff0b3607ebdb09f9","observation_id":"69d21ad9-a07a-4301-af0e-5d08773fa56a","resolution":{"observed_at":"2026-07-04T09:59:44.550081Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2606.31958","last_updated":"2026-06-30T17:00:33Z","snapshot_observed_at":"2026-07-07T00:05:37.068846Z","submitted_at":"2026-06-30T17:00:33Z","title":"Adapting Generalist Robot Policies with Semantic Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-01T05:09:29.625066Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2606.31958"},"observation_digest":"sha256:b948af06a97f49a7d15f66ddddb49909d5f7574af3f8a884a53d298d580dc3d8","observation_id":"5a0155eb-bdf8-4494-bf6d-5b47aabf7ef9","resolution":{"observed_at":"2026-07-01T10:45:42.654679Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-06T00:37:40.214321Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01013","last_updated":"2026-08-02T05:33:36Z","snapshot_observed_at":"2026-08-08T00:04:41.595637Z","submitted_at":"2026-08-02T05:33:36Z","title":"RL Bootstrapping of OpenVLA-OFT for a Novel Robot Embodiment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:37:40.214321Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2608.01013"},"observation_digest":"sha256:48ea809d8850c776eee41fe1d6690effa38ed5d62a0f46f059ee8a08605e98fc","observation_id":"844fe8d3-167e-4ef6-a8df-f31242600c73","resolution":{"observed_at":"2026-08-06T00:37:40.214321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.16664/citation-record","integrity":"/paper/2501.16664/integrity","json":"/paper/2501.16664/citation-record.json","paper":"/paper/2501.16664"},"outbound":[],"paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 31 inbound Pith citation observations for arXiv:2501.16664."}