{"as_of":"2026-08-16T03:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3bc84ead0467cebd0d4416f36e183cfb056643a5668eea4af0bb5373dc499daf","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:23:38.463002Z","state":"measured"},{"denominator":74,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":74,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":18,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:21:33.850650Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T10:58:02.450585Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07395","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-07-03T10:58:02.450585Z","title":"Reinbot: Amplifying robot visual-language manipulation with reinforcement learning","venue":null,"work_id":"f234624b-7579-4ff5-afd3-3c04f1f74959","year":2025},"citing_paper":{"arxiv_id":"2507.04447","last_updated":"2025-08-26T08:23:50Z","snapshot_observed_at":"2026-08-05T16:56:52.400110Z","submitted_at":"2025-07-06T16:14:29Z","title":"DreamVLA: A Vision-Language-Action Model Dreamed with Comprehensive World Knowledge","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-16T15:42:41.363422Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2507.04447"},"observation_digest":"sha256:c08acd1709eea322dd398784fbea101b51c0406eb44f42de71160a0b86fcffa7","observation_id":"f8242117-8a14-46ff-ae95-392ce66d0a13","resolution":{"observed_at":"2026-05-16T15:42:41.537376Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-08-05T10:30:23.670740Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04063","last_updated":"2025-09-04T09:48:43Z","snapshot_observed_at":"2026-08-14T09:41:04.189727Z","submitted_at":"2025-09-04T09:48:43Z","title":"Balancing Signal and Variance: Adaptive Offline RL Post-Training for VLA Flow Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T10:30:23.670740Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2509.04063"},"observation_digest":"sha256:0611281327b7e521d379ce603b8791b06bd9b2ea008280a4594c1dc0212fe386","observation_id":"c66a75f6-4f55-462d-b786-087c9b8bb200","resolution":{"observed_at":"2026-08-05T10:30:23.670740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07395","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-07-03T10:58:02.450585Z","title":"Reinbot: Amplifying robot visual-language manipulation with reinforcement learning","venue":null,"work_id":"f234624b-7579-4ff5-afd3-3c04f1f74959","year":2025},"citing_paper":{"arxiv_id":"2509.09674","last_updated":"2025-09-11T17:59:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-11T17:59:17Z","title":"SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-15T08:02:11.189795Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2509.09674"},"observation_digest":"sha256:1ab6e03db373743cdcc3e1431aec0046c51df629c9cd33a77d482de7b73480e9","observation_id":"b238a55e-34d0-4fb5-95dd-100149216de7","resolution":{"observed_at":"2026-05-15T08:02:11.476545Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07395","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-07-03T10:58:02.450585Z","title":"Reinbot: Amplifying robot visual-language manipulation with reinforcement learning","venue":null,"work_id":"f234624b-7579-4ff5-afd3-3c04f1f74959","year":2025},"citing_paper":{"arxiv_id":"2510.12710","last_updated":"2026-04-09T08:55:45Z","snapshot_observed_at":"2026-07-06T22:32:37.311210Z","submitted_at":"2025-10-14T16:44:39Z","title":"Reflection-Based Task Adaptation for Self-Improving VLA","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T07:28:11.187479Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2510.12710"},"observation_digest":"sha256:34cd10d477006480ec323faf32e0c5734c9857cad54204eb2311b4853bf67a1f","observation_id":"d08cfec4-c1cb-4bae-bf72-fc7ef786730d","resolution":{"observed_at":"2026-05-18T07:31:03.004105Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07395","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-07-03T10:58:02.450585Z","title":"Reinbot: Amplifying robot visual-language manipulation with reinforcement learning","venue":null,"work_id":"f234624b-7579-4ff5-afd3-3c04f1f74959","year":2025},"citing_paper":{"arxiv_id":"2510.17640","last_updated":"2026-08-05T02:51:23Z","snapshot_observed_at":"2026-08-08T23:09:05.210442Z","submitted_at":"2025-10-20T15:21:12Z","title":"RESample: A Robust Data Augmentation Framework via Exploratory Sampling for Robotic Manipulation","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T06:10:47.309028Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2510.17640"},"observation_digest":"sha256:7cc596ca4553f0fb67c2591c92f0156af8d18054ef9fae7f81674e474cd897fe","observation_id":"6d5112d9-a223-45d5-b35a-5d646bf21542","resolution":{"observed_at":"2026-05-18T06:10:57.885080Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07395","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-07-03T10:58:02.450585Z","title":"Reinbot: Amplifying robot visual-language manipulation with reinforcement learning","venue":null,"work_id":"f234624b-7579-4ff5-afd3-3c04f1f74959","year":2025},"citing_paper":{"arxiv_id":"2601.07060","last_updated":"2026-04-04T05:08:38Z","snapshot_observed_at":"2026-08-11T15:47:37.451369Z","submitted_at":"2026-01-11T21:00:58Z","title":"PALM: Progress-Aware Policy Learning via Affordance Reasoning for Long-Horizon Robotic Manipulation","version":2},"reference_index":140,"source":"pdf_text","source_observed_at":"2026-05-16T15:05:21.907878Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2601.07060"},"observation_digest":"sha256:fa73b891932c3ec4c461341c92e39b18292ae74dae7535dd29760ceab9217047","observation_id":"37ede198-ccbb-4e82-8840-ba52aa4f84de","resolution":{"observed_at":"2026-05-16T15:08:02.066009Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07395","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-07-03T10:58:02.450585Z","title":"Reinbot: Amplifying robot visual-language manipulation with reinforcement learning","venue":null,"work_id":"f234624b-7579-4ff5-afd3-3c04f1f74959","year":2025},"citing_paper":{"arxiv_id":"2602.09023","last_updated":"2026-05-19T02:18:04Z","snapshot_observed_at":"2026-08-14T02:45:38.507002Z","submitted_at":"2026-02-09T18:59:52Z","title":"TwinRL: Digital Twin-Driven Reinforcement Learning for Real-World Robotic Manipulation","version":4},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-21T13:13:53.818915Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2602.09023"},"observation_digest":"sha256:cff6b94065442c60729eaca7b0cb8d765e93fddd940e8070140e0cca7e4a469c","observation_id":"1c4f0099-2dba-4ff9-9d32-ec0d63228022","resolution":{"observed_at":"2026-05-21T13:14:10.855213Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-08-02T20:18:04.979225Z","title":"Reinbot: Amplifyin g robot visual -language manipulation with reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23721","last_updated":"2026-06-30T14:23:11Z","snapshot_observed_at":"2026-08-14T10:58:23.824960Z","submitted_at":"2026-02-27T06:43:37Z","title":"StemVLA:An Open-Source Vision-Language-Action Model with Future 3D Spatial Geometry Knowledge and 4D Historical Representation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T20:18:04.979225Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2602.23721"},"observation_digest":"sha256:ffc21c55d749b7e91c32ed957b27c97c79c61ddcc0328a3dbfcd93cbab3f4daf","observation_id":"321b86d1-5eed-46f6-a098-d73b5d0b554c","resolution":{"observed_at":"2026-08-02T20:18:04.979225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07395","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-07-03T10:58:02.450585Z","title":"Reinbot: Amplifying robot visual-language manipulation with reinforcement learning","venue":null,"work_id":"f234624b-7579-4ff5-afd3-3c04f1f74959","year":2025},"citing_paper":{"arxiv_id":"2604.28192","last_updated":"2026-05-07T14:00:44Z","snapshot_observed_at":"2026-08-11T13:04:08.180508Z","submitted_at":"2026-04-30T17:59:52Z","title":"LaST-R1: Reinforcing Robotic Manipulation via Adaptive Physical Latent Reasoning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-07T05:47:17.494531Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2604.28192"},"observation_digest":"sha256:55b37dad634343b98790e526210c626c73c301bb7065d7b9e76fb6b059c107ad","observation_id":"6ba3c3cd-4b12-4fc0-8d13-ee1f6e1ad928","resolution":{"observed_at":"2026-05-12T10:31:30.096541Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07395","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-07-03T10:58:02.450585Z","title":"Reinbot: Amplifying robot visual-language manipulation with reinforcement learning","venue":null,"work_id":"f234624b-7579-4ff5-afd3-3c04f1f74959","year":2025},"citing_paper":{"arxiv_id":"2604.28192","last_updated":"2026-05-07T14:00:44Z","snapshot_observed_at":"2026-08-11T13:04:08.180508Z","submitted_at":"2026-04-30T17:59:52Z","title":"LaST-R1: Reinforcing Robotic Manipulation via Adaptive Physical Latent Reasoning","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-08T03:00:26.352130Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2604.28192"},"observation_digest":"sha256:47d45c7c17d8dfbb4d8e55bb9d28d8e1115b53d67646d82cae801c713b5c0408","observation_id":"b2b82c7c-070e-4ca8-8e1d-f45cf95e2a49","resolution":{"observed_at":"2026-05-11T22:17:02.198797Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07395","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-07-03T10:58:02.450585Z","title":"Reinbot: Amplifying robot visual-language manipulation with reinforcement learning","venue":null,"work_id":"f234624b-7579-4ff5-afd3-3c04f1f74959","year":2025},"citing_paper":{"arxiv_id":"2605.10821","last_updated":"2026-07-16T12:45:34Z","snapshot_observed_at":"2026-08-12T23:04:14.451687Z","submitted_at":"2026-05-11T16:37:34Z","title":"UniSteer: Unified Noise Steering for Efficient Human-Guided VLA Adaptation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T04:08:43.222818Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2605.10821"},"observation_digest":"sha256:bfa4e54527798081d3b5205062d674913ba6c42a7e0ce1ece8ab3e4b42679fe1","observation_id":"5819ec13-c2ef-458d-8f86-5893c18ef4ba","resolution":{"observed_at":"2026-05-12T06:36:25.578290Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-08-02T14:26:01.304251Z","title":"Reinbot: Amplifying robot visual-language manipulation with reinforcement learning.arXiv preprint arXiv:2505.07395, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.10821","last_updated":"2026-07-16T12:45:34Z","snapshot_observed_at":"2026-08-12T23:04:14.451687Z","submitted_at":"2026-05-11T16:37:34Z","title":"UniSteer: Unified Noise Steering for Efficient Human-Guided VLA Adaptation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T14:26:01.304251Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2605.10821"},"observation_digest":"sha256:2d135e1906bb17b0eb9a61ba28f95755ef0f0aa8a0bca1622867993381bd89d5","observation_id":"e3e5fe0a-73e0-4428-bc64-70cf4365a2fa","resolution":{"observed_at":"2026-08-02T14:26:01.304251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07395","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-07-03T10:58:02.450585Z","title":"Reinbot: Amplifying robot visual-language manipulation with reinforcement learning","venue":null,"work_id":"f234624b-7579-4ff5-afd3-3c04f1f74959","year":2025},"citing_paper":{"arxiv_id":"2605.17486","last_updated":"2026-05-17T14:55:32Z","snapshot_observed_at":"2026-08-15T18:22:20.754813Z","submitted_at":"2026-05-17T14:55:32Z","title":"DyGRO-VLA: Cross-Task Scaling of Vision-Language-Action Models via Dynamic Grouped Residual Optimization","version":1},"reference_index":128,"source":"arxiv_source","source_observed_at":"2026-05-20T12:39:50.004269Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2605.17486"},"observation_digest":"sha256:aeb541703f7d8911b5ab82f5adb8f1bbb72f9eb193adc35e929653fae10a37ab","observation_id":"77b418a6-9f82-4068-b1f8-85f3cae0753a","resolution":{"observed_at":"2026-05-20T12:43:17.169177Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07395","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-07-03T10:58:02.450585Z","title":"Reinbot: Amplifying robot visual-language manipulation with reinforcement learning","venue":null,"work_id":"f234624b-7579-4ff5-afd3-3c04f1f74959","year":2025},"citing_paper":{"arxiv_id":"2606.02313","last_updated":"2026-06-01T14:31:35Z","snapshot_observed_at":"2026-08-06T08:39:50.187649Z","submitted_at":"2026-06-01T14:31:35Z","title":"Towards Precise Intent-Aligned VLA Aerial Navigation via Expert-Guided GRPO","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T14:28:23.759920Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2606.02313"},"observation_digest":"sha256:7ac69706a1450af56472a434623f08f0a77a730e3499da67e6ec610709b664d1","observation_id":"2aba851c-7989-457d-b80a-8791c46b43f3","resolution":{"observed_at":"2026-07-01T23:16:24.693966Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07395","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-07-03T10:58:02.450585Z","title":"Reinbot: Amplifying robot visual-language manipulation with reinforcement learning","venue":null,"work_id":"f234624b-7579-4ff5-afd3-3c04f1f74959","year":2025},"citing_paper":{"arxiv_id":"2606.06155","last_updated":"2026-06-04T13:28:51Z","snapshot_observed_at":"2026-07-29T15:22:02.359291Z","submitted_at":"2026-06-04T13:28:51Z","title":"AffordanceVLA: A Vision-Language-Action Model Empowering Action Generation through Affordance-Aware Understanding","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-28T01:23:02.576098Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2606.06155"},"observation_digest":"sha256:f85d27d837ed3fe207db64a63ae49dd41f7d5a26172bf5412668d98609ce0091","observation_id":"f61402ca-53f0-424d-bf3d-0a3cb94b4151","resolution":{"observed_at":"2026-07-02T13:16:59.232666Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07395","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-07-03T10:58:02.450585Z","title":"Reinbot: Amplifying robot visual-language manipulation with reinforcement learning","venue":null,"work_id":"f234624b-7579-4ff5-afd3-3c04f1f74959","year":2025},"citing_paper":{"arxiv_id":"2606.29892","last_updated":"2026-06-29T07:31:41Z","snapshot_observed_at":"2026-08-02T16:37:27.749603Z","submitted_at":"2026-06-29T07:31:41Z","title":"Trust Your Instincts: Confidence-Driven Test-Time RL for Vision-Language-Action Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-30T06:02:15.781538Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2606.29892"},"observation_digest":"sha256:12269f61349b26a9721e3aba66a287418ab51d10903ab2d9e2c33ddcb53fd72e","observation_id":"cc05ce28-d0e3-4d64-b7e0-b6f3e8a8021d","resolution":{"observed_at":"2026-06-30T06:04:21.133975Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.07395","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-07-03T10:58:02.450585Z","title":"Reinbot: Amplifying robot visual-language manipulation with reinforcement learning","venue":null,"work_id":"f234624b-7579-4ff5-afd3-3c04f1f74959","year":2025},"citing_paper":{"arxiv_id":"2607.02431","last_updated":"2026-07-02T17:00:37Z","snapshot_observed_at":"2026-08-15T17:59:19.515738Z","submitted_at":"2026-07-02T17:00:37Z","title":"WorldSample: Closed-loop Real-robot RL with World Modelling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-03T10:57:40.128651Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2607.02431"},"observation_digest":"sha256:967a2bdd85afa7a07a60dd63a0a86099c298940584d93475f6ea98147acd9da4","observation_id":"2f875ee7-edc0-4df3-91ac-47724e5736f8","resolution":{"observed_at":"2026-07-03T10:58:02.452017Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-08-15T18:21:33.850650Z","title":"arXiv preprint arXiv:2505.07395 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-16T02:10:51.374639Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.850650Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:d7fedc0d74b6f7cbe56d1744e8e05e04229c0f9da3ce04db7572e20e6793c652","observation_id":"899c45df-f990-45da-8988-4ce91fb96a9d","resolution":{"observed_at":"2026-08-15T18:21:33.850650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.07395/citation-record","integrity":"/paper/2505.07395/integrity","json":"/paper/2505.07395/citation-record.json","paper":"/paper/2505.07395"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:39.965718Z","title":"J., Amemiya, T., and Poirier, D","venue":null,"work_id":"40486113-966b-44ef-a40a-b01b1d185c58","year":1976},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:37.745369Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:8b5f0f85a98ae1293f8bc3aa58be3dec008b2c563f47149f63ab114b9966496b","observation_id":"d81b2626-a632-4ee6-a981-1489cd754d60","resolution":{"observed_at":"2026-08-15T22:23:39.969406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02853","last_updated":"2025-05-13T03:02:42Z","snapshot_observed_at":"2026-08-13T12:26:50.058188Z","submitted_at":"2025-02-05T03:13:04Z","title":"Rethinking Latent Redundancy in Behavior Cloning: An Information Bottleneck Approach for Robot Manipulation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02853","snapshot_observed_at":"2026-08-15T22:23:37.749656Z","title":"Rethinking latent representations in behavior cloning: An information bottleneck approach for robot manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:37.749656Z"},"links":{"cited_paper":"/paper/2502.02853","citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:452a25d656eba778d880e88887d9278f934fa42d98a0c0a4644ee11eade71ef0","observation_id":"fd73e060-d0a8-410b-936a-fea886400619","resolution":{"observed_at":"2026-08-15T22:23:37.749656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:39.807829Z","title":"R., Finn, C., Kumar, A., and Levine, S","venue":null,"work_id":"1d3dd741-75e6-46c5-82d9-bd83e5b75376","year":null},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:37.778341Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:fadece49a09f4a407ccbfdfb4e977603915a83d9603104286d17b2b9f793e480","observation_id":"cee91eb9-00a6-4604-ade8-cfba22ad0e49","resolution":{"observed_at":"2026-08-15T22:23:39.870056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-15T22:23:37.797543Z","title":"Rt-1: Robotics transformer for real-world control at scale","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:37.797543Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:aaf1282cc99e17df62152b40c9177ab7633d6549a8536bcc42f5e91f57440be1","observation_id":"22de4c42-be00-43e3-9526-3916918db4d5","resolution":{"observed_at":"2026-08-15T22:23:37.797543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-15T22:23:37.837945Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:37.837945Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:cd764a640448f783164cb11eb9141a6fde57a6215c453c0bef014c817742e8c8","observation_id":"5338c3d7-9f90-4e5c-87c5-42412f3b8525","resolution":{"observed_at":"2026-08-15T22:23:37.837945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:39.768833Z","title":"Q-transformer: Scalable offline reinforcement learning via autoregressive q-functions","venue":null,"work_id":"b2bc32ea-3294-4632-85c7-b529778578dc","year":2023},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:37.895650Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:02ace63ef81187903c37c5688822205f6cfa4bd8214189f0c3b1d4d3fa2f4fbc","observation_id":"d6d85117-8429-44de-836a-150fe82db081","resolution":{"observed_at":"2026-08-15T22:23:39.772598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:37.949361Z","title":"Decision transformer: Reinforcement learning via sequence modeling","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:37.949361Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:4540ef869f31d496992e620a610f96526a905bb0752dc393d84679228c7cf4b7","observation_id":"6bd0aed9-ae5d-43a9-8f6f-874f6d073425","resolution":{"observed_at":"2026-08-15T22:23:37.949361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08259","last_updated":"2025-01-14T17:15:27Z","snapshot_observed_at":"2026-08-14T04:50:09.547451Z","submitted_at":"2025-01-14T17:15:27Z","title":"FDPP: Fine-tune Diffusion Policy with Human Preference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08259","snapshot_observed_at":"2026-08-15T22:23:37.965550Z","title":"K., Tomizuka, M., and Romeres, D","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:37.965550Z"},"links":{"cited_paper":"/paper/2501.08259","citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:5bb05ae4e5555e27e3550b9a929f87e61c7f80e5dedfdae3f58b6cb8db9b515c","observation_id":"4568e7e5-9cba-41da-81e8-7abe40e3a510","resolution":{"observed_at":"2026-08-15T22:23:37.965550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:39.749687Z","title":"Q., Gu, A., Choromanski, K., Dao, T., Re, C., Finn, C., and Liang, P","venue":null,"work_id":"c1cd3fc8-16be-48a3-995b-dd71fd9fbd04","year":2021},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:37.969748Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:fe1b808d4bb009d8ecdc1788a8a72d2e295e468f5df2dec399c143930fab075e","observation_id":"1850ce8f-8b57-4595-a364-4b9ad69d9722","resolution":{"observed_at":"2026-08-15T22:23:39.754197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:37.973282Z","title":"Quar-vla: Vision-language-action model for quadruped robots","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:37.973282Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:8a06bf36361f6a7891b5afcf7df2b7f8c46635b019d2b4e6a32a3cf1cbd06eac","observation_id":"7cc7e529-5615-4229-9b7e-a7f8a5f69470","resolution":{"observed_at":"2026-08-15T22:23:37.973282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:37.977042Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:37.977042Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:589739653ffdcbc7eabd8e505273d4475b7c8ef03c61417f171a88bf3c397020","observation_id":"186741f2-48c2-4770-9d55-8f4254443ab8","resolution":{"observed_at":"2026-08-15T22:23:37.977042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:37.981284Z","title":"Ego4d: Around the world in 3,000 hours of egocentric video","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:37.981284Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:f9a63646ad5e5d6f3817e0bd439631f073b76147aa00082b8d3889791ff08ed5","observation_id":"297986fe-ab5d-4cae-b7be-185dbdf1e4d0","resolution":{"observed_at":"2026-08-15T22:23:37.981284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-15T21:48:56.393467Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-15T22:23:37.985151Z","title":"Improving vision-language-action model with online reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:37.985151Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:3aab6c953493f6320caca19cced864066fb6dcae7206933c1a8621ec08b09809","observation_id":"ed18330e-329b-432b-bc7a-086823ea5350","resolution":{"observed_at":"2026-08-15T22:23:37.985151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:37.990388Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:37.990388Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:096b1f20246b3ef7777191114493f216361fcec9f40932dbaf66355ec5894b6f","observation_id":"b05ed69a-c89e-4f6d-95e6-f7390d254461","resolution":{"observed_at":"2026-08-15T22:23:37.990388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:39.711369Z","title":"A., Jiang, Y., Pertsch, K., and Sadigh, D","venue":null,"work_id":"4b2c0bc4-347d-4c98-8df4-641d02065ef8","year":null},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:37.993330Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:ffa40a91388c9f7106e89c6824cabc31f412f9e0293c2200d3a77bac9c9004b1","observation_id":"c7bf6da5-ae29-40b1-80ae-004226c94dd9","resolution":{"observed_at":"2026-08-15T22:23:39.714982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:39.699174Z","title":"On transforming reinforcement learning with transformers: The development trajectory","venue":null,"work_id":"13914ea8-5765-4bf7-b223-347867acd313","year":2024},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:37.997134Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:2f7e637112923efba09499b28c4faeaa345d73148893972b99c849378e40bd8b","observation_id":"b79dc45a-b6ae-4bf7-9dc8-6e93060813df","resolution":{"observed_at":"2026-08-15T22:23:39.703417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.000975Z","title":"Perceiver: General perception with iterative attention","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.000975Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:c9af69f0383b021caf958dc22c0ab0aa2c8ed09b904edeed368396f2318af7fc","observation_id":"ab7830e5-5d99-44e0-a3e7-73381ebc7019","resolution":{"observed_at":"2026-08-15T22:23:38.000975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:39.680620Z","title":"and Davison, A","venue":null,"work_id":"20df8704-f2d0-496a-a01f-86fdfb883993","year":2022},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.004551Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:220dafb837cc2a5bf1540326b533f8f11850d99fc3a4a0f21d829d95be9ad29d","observation_id":"a5a6e0a6-f75a-46a5-ab05-1e1b7a54aa14","resolution":{"observed_at":"2026-08-15T22:23:39.684449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:39.669295Z","title":"Offline reinforcement learning as one big sequence modeling problem","venue":null,"work_id":"6f1f9f55-8c40-4909-aafa-d889bc0f196b","year":2021},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.068205Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:41ff220b55817271d909e9e6838193ac88e8c2ed9ba13f23cddb12f966ae5ac4","observation_id":"07812978-ab09-4749-b9bf-26be67d5a157","resolution":{"observed_at":"2026-08-15T22:23:39.673238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-15T22:23:38.140840Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.140840Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:ede2f0ea83d4d8e2eb94a461fa98a014c147122988369f918d09154d16b036f4","observation_id":"d4b44a5a-7104-4565-bbe5-8f0a7a2b8082","resolution":{"observed_at":"2026-08-15T22:23:38.140840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-14T18:51:16.666127Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-15T22:23:38.188510Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.188510Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:ba2be9e7506d5ee95f6f24920ae23cb36a32768575699a1c0d98d15f79322136","observation_id":"2a61a712-eb1b-4a30-911d-ba3c2a8d171b","resolution":{"observed_at":"2026-08-15T22:23:38.188510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-15T22:23:38.192698Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.192698Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:a08ba775a1a684d73ed8699297609c7b4afe045dfc0baeb9405f6e07fd1710fa","observation_id":"17169bb9-a7e8-4fa7-b7c0-191e50c5425d","resolution":{"observed_at":"2026-08-15T22:23:38.192698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:39.657020Z","title":"Gr-mg: Leveraging partially-annotated data via multi-modal goal-conditioned policy","venue":null,"work_id":"2141dd3f-7fcb-4e9e-a567-97d267b0ef1b","year":2025},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.196772Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:8c726baf64140b6df9cbae6cc4f149d22839ad7f42942fdeb06d7d1c5531b415","observation_id":"5990459f-89cd-4a25-8453-17e750c00f5f","resolution":{"observed_at":"2026-08-15T22:23:39.662279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:39.431921Z","title":"R., Fu, C., Lunawat, I., Sieh, I., Kirmani, S., et al","venue":null,"work_id":"7b19af71-879f-4637-a264-5d7cffe1d0f1","year":null},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.199976Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:e510973f42e5a25412b3a90e12b927871983ac65d2679d46dc6d4bbe32c5b32a","observation_id":"cdae8d1b-3243-4ff9-963c-99559f3e166f","resolution":{"observed_at":"2026-08-15T22:23:39.535262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:39.420173Z","title":"Vision-language foundation models as effective robot imitators","venue":null,"work_id":"5b2d28c1-94b2-435f-a0e6-a57b6e7389cc","year":null},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.203608Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:69e8bc87ded017a81b56da49732a3e83236295d75457aff39597bc18e4d4587f","observation_id":"f744bb64-5601-4561-bdfd-fe795f22c7ea","resolution":{"observed_at":"2026-08-15T22:23:39.424345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06685","last_updated":"2024-12-09T17:28:03Z","snapshot_observed_at":"2026-08-13T05:32:21.574534Z","submitted_at":"2024-12-09T17:28:03Z","title":"Policy Agnostic RL: Offline RL and Online RL Fine-Tuning of Any Class and Backbone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06685","snapshot_observed_at":"2026-08-15T22:23:38.206985Z","title":"S., Gao, T., Sampaio, G","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.206985Z"},"links":{"cited_paper":"/paper/2412.06685","citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:f7d8c7987a282ea73165df9775f223d4cdb853a6d2a59bf9766f8a3621aecb65","observation_id":"0ad9fb00-7442-47ff-b970-fb7420bd510e","resolution":{"observed_at":"2026-08-15T22:23:38.206985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.211175Z","title":"Calvin: A benchmark for language-conditioned policy learning for long-horizon robot manipulation tasks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.211175Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:d4f4ab324b3dc707fdcbf0840c22daea63c448299b5b099124786e5b9d239069","observation_id":"451049cb-c848-4169-b4bf-8b87cba425d3","resolution":{"observed_at":"2026-08-15T22:23:38.211175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:39.401616Z","title":"A simple neural attentive meta-learner","venue":null,"work_id":"4615097a-2fbf-4497-9634-710a4fe3a08e","year":2018},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.215114Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:0b1b90e8d31cdb22a36c3189878e13198c49826d81bf1581e18ac58a49213b83","observation_id":"05c383f0-ab81-452b-a3cf-efad489908dd","resolution":{"observed_at":"2026-08-15T22:23:39.405812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:39.390292Z","title":"Steering your generalists: Improving robotic foundation models via value guidance","venue":null,"work_id":"c5c6df9c-6fac-4469-aeeb-9a372d3c8940","year":null},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.218652Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:959ba010893094c0b6ff52d72a1f052fdeae02dc5c97522799afda42e520831b","observation_id":"b253ed35-446c-4824-a4c7-2341dafdcc1f","resolution":{"observed_at":"2026-08-15T22:23:39.394537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:39.378637Z","title":"L., Clark, A., Noury, S., et al","venue":null,"work_id":"d7f43b84-3e15-4723-b2ec-2164aa2180bb","year":2020},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.222421Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:fdf42af67300fc0eed0d08c8862ed20f56dc882488c2a5ade6bddd0d9a7b136a","observation_id":"1efde025-831a-45bd-8245-9768eb8a688f","resolution":{"observed_at":"2026-08-15T22:23:39.383102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.225966Z","title":"and Schaal, S","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.225966Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:cc488aac519f5414d4fd016250fca774425e9588d3242f72a33508659db5f2fa","observation_id":"81b91287-c48b-4997-9144-7e048a0fe5cd","resolution":{"observed_at":"2026-08-15T22:23:38.225966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.229073Z","title":"Improving language understanding by generative pre-training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.229073Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:bdfa54f0af7c48b5ac88a14009d8d09ace350c5ad797d5f811c742388f087b8a","observation_id":"8742837b-93c6-4d15-9811-4a3eb38cb507","resolution":{"observed_at":"2026-08-15T22:23:38.229073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.232324Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.232324Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:5cecd9e8e688522df938f70aafd9847d15339a9f78f983b62198c7eff73dab06","observation_id":"a30d7c9c-cf44-4991-bdfb-4067232be9a2","resolution":{"observed_at":"2026-08-15T22:23:38.232324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.235695Z","title":"W., Hallacy, C., Ramesh, A., Goh, G., Agarwal, S., Sastry, G., Askell, A., Mishkin, P., Clark, J., et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.235695Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:23a4539ccb08e2042294f687f1b587ec099cdfd123fb0a223b1528fa7e452789","observation_id":"c1b57cc3-da02-4844-beed-e479ff063404","resolution":{"observed_at":"2026-08-15T22:23:38.235695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:39.346271Z","title":"Orb: An efficient alternative to sift or surf","venue":null,"work_id":"c490c11c-1506-4772-8f5f-182659c490dd","year":2011},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.239350Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:dfb5a32e4fb7660e4d6a47698e43a0b3200ca857156357128ff9e31c4fd8e6b3","observation_id":"77dc155b-84f1-41b7-8516-37cf37cd9390","resolution":{"observed_at":"2026-08-15T22:23:39.350331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:39.232978Z","title":"M., Cui, Z., Altanzaya, A","venue":null,"work_id":"5165ccea-e99c-4eda-9e8e-a796ed4d7815","year":2022},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.243807Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:abeaffa3fc78044096515e6a2c95262f0e1a41a3cf9a310f6819f3255f9ba47a","observation_id":"b0ce40dd-6fef-4418-b0d1-cd0804617b54","resolution":{"observed_at":"2026-08-15T22:23:39.338347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.247237Z","title":"Perceiver-actor: A multi-task transformer for robotic manipulation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.247237Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:e04b8a722df002191da430f8bf22d962d5d9a0c7e0d87e5abd403e3277ffad69","observation_id":"fdd4f643-4afc-4ef9-b99a-259c5ba10c8a","resolution":{"observed_at":"2026-08-15T22:23:38.247237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:39.073919Z","title":"and Kneib, T","venue":null,"work_id":"d4ff53aa-ca27-47ff-ad17-a235fe4cc6f6","year":2012},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.250564Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:3124c3f5e08b1c55f8b874a3be5bca33b94d6e69f05d1e70dceb56b63c5e8d4b","observation_id":"3dbbeca3-8008-41f9-8f1a-5948f6d64914","resolution":{"observed_at":"2026-08-15T22:23:39.133951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.254101Z","title":"Learning structured output representation using deep conditional generative models","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.254101Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:5454c9e9aa2d40963bb2e8d3c53078ebcfb386a1cb8315f8bf29c4b4d9e2096a","observation_id":"65826f7f-3d34-4db5-becb-c96f4aaa5d80","resolution":{"observed_at":"2026-08-15T22:23:38.254101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.946678Z","title":null,"venue":null,"work_id":"2f90d849-2fc4-4a8c-b252-caae38a69d2a","year":1984},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.295465Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:8ba0e8a4e3007c3963d12e1ae6477cbab92e5b89223ef739596281808997c50f","observation_id":"65aa9955-7dd0-46db-b852-404cf73296f4","resolution":{"observed_at":"2026-08-15T22:23:39.023499Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15109","last_updated":"2024-12-19T17:52:50Z","snapshot_observed_at":"2026-07-06T20:10:19.704368Z","submitted_at":"2024-12-19T17:52:50Z","title":"Predictive Inverse Dynamics Models are Scalable Learners for Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15109","snapshot_observed_at":"2026-08-15T22:23:38.315536Z","title":"Predictive inverse dynamics models are scalable learners for robotic manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.315536Z"},"links":{"cited_paper":"/paper/2412.15109","citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:2246533cbb545df1d40de47e268a871b92d8eb9fdecdc6b9893117fa36888917","observation_id":"dadbe7ad-ce4b-4092-9964-c13c547b17d4","resolution":{"observed_at":"2026-08-15T22:23:38.315536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.869073Z","title":"M., Parmar, N., Uszkoreit, J., Jones, L., Gomez, A","venue":null,"work_id":"2fcb7ad1-06c6-4410-b844-b55bb8b723f4","year":2017},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.378906Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:65d1078eee05583441154662d01016fdd67069528c272669ceba10562f37f95c","observation_id":"56f101f6-912c-4880-b8d4-9837233e5677","resolution":{"observed_at":"2026-08-15T22:23:38.900759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.856528Z","title":"R., Pertsch, K., Singh, A., Doshi, R., Xu, C., Luo, J., Tan, L., Shah, D., et al","venue":null,"work_id":"ac48c5f6-b1f5-491c-9462-d810210775da","year":2023},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.410519Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:d4f5468724283701162bfe7225cf724526a707591b19d9e79653ac6543a2b04c","observation_id":"340ce97f-93b4-437c-9021-51311338ee3d","resolution":{"observed_at":"2026-08-15T22:23:38.861289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.845774Z","title":"Unleashing large-scale video generative pre-training for visual robot manipulation","venue":null,"work_id":"727c1b0d-0c8f-4da2-9316-42dd2be3a253","year":null},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.414843Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:3d2dfb4011c2bcdfb552602a51ae2054d79becc5f279797440d0afe8f14656d3","observation_id":"68b44bdc-7ea0-482b-8413-45e5d10e718d","resolution":{"observed_at":"2026-08-15T22:23:38.849427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.835036Z","title":"Q-learning decision transformer: Leveraging dynamic programming for conditional sequence modelling in offline rl","venue":null,"work_id":"dc89508d-16b8-447c-98cb-eedb337592ea","year":2022},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.418958Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:260d67cd4156d010ea062275947e221dd7c869357b58cc16020d7933a12f669e","observation_id":"c039ea65-eaef-41f6-8540-6a145170f9f8","resolution":{"observed_at":"2026-08-15T22:23:38.838948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.822810Z","title":null,"venue":null,"work_id":"47808e66-b8b0-4c0a-9784-d2e284238026","year":null},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.422628Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:9829a8b6168e67a50d54dd61ea6ca1419540d9827c20783ba356c755ccac6d88","observation_id":"73d218b7-20c0-4c61-ad9b-7cf07b3e2fd0","resolution":{"observed_at":"2026-08-15T22:23:38.826789Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.810285Z","title":"Fine-tuning large vision-language models as decision-making agents via reinforcement learning","venue":null,"work_id":"0d386efb-fc05-4486-97ed-571162fd5b49","year":2024},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.426416Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:e56e21ad017c04c7fa6ca0dee5b0849edb867bbf7dad2e5862636fd275f5351f","observation_id":"2dc5dfed-b607-4cf7-bb71-cf4063a0dfd3","resolution":{"observed_at":"2026-08-15T22:23:38.814517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.798407Z","title":"Gevrm: Goal-expressive video generation model for robust visual manipulation","venue":null,"work_id":"38b80448-720f-4d16-b992-1707b7c34d8d","year":2025},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.430298Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:efadcae857d3049e28a530edeb3fe29ff979374bcf58ccc3fef27d1d32ab6f00","observation_id":"13734806-420b-45af-acfd-e746d3e70417","resolution":{"observed_at":"2026-08-15T22:23:38.802473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01219","last_updated":"2025-09-14T09:34:46Z","snapshot_observed_at":"2026-07-06T16:13:46.112815Z","submitted_at":"2023-09-03T16:56:48Z","title":"Siren's Song in the AI Ocean: A Survey on Hallucination in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01219","snapshot_observed_at":"2026-08-15T22:23:38.434395Z","title":"Siren's song in the ai ocean: a survey on hallucination in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.434395Z"},"links":{"cited_paper":"/paper/2309.01219","citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:35b05c3f13bc9295031f6b21a2b7c5b28d598f7d1fd181db2613eab8b6178d18","observation_id":"db90d032-b74d-4557-96c4-0af617f3c082","resolution":{"observed_at":"2026-08-15T22:23:38.434395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19309","last_updated":"2025-02-04T08:49:11Z","snapshot_observed_at":"2026-08-15T01:47:42.243585Z","submitted_at":"2024-11-28T18:30:10Z","title":"GRAPE: Generalizing Robot Policy via Preference Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19309","snapshot_observed_at":"2026-08-15T22:23:38.438531Z","title":"Grape: Generalizing robot policy via preference alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.438531Z"},"links":{"cited_paper":"/paper/2411.19309","citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:f600eb4432f86b109ae10a97f5780ffd5303dd104f1bd3615fcb0b301eb70f8f","observation_id":"4ceef094-366f-4dae-9702-bf4d1d10f1ca","resolution":{"observed_at":"2026-08-15T22:23:38.438531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08007","last_updated":"2025-03-11T03:13:45Z","snapshot_observed_at":"2026-08-12T16:59:16.472556Z","submitted_at":"2025-03-11T03:13:45Z","title":"MoRE: Unlocking Scalability in Reinforcement Learning for Quadruped Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08007","snapshot_observed_at":"2026-08-15T22:23:38.441923Z","title":"More: Unlocking scalability in reinforcement learning for quadruped vision-language-action models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.441923Z"},"links":{"cited_paper":"/paper/2503.08007","citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:6597d8ce875fc9b8b6b069d5902ee4fa718cb0d397a2f6e316d2ad9fd76a9f58","observation_id":"135fac01-8abb-490b-af3b-e28fefcff537","resolution":{"observed_at":"2026-08-15T22:23:38.441923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.786415Z","title":"Cobra: Extending mamba to multi-modal large language model for efficient inference","venue":null,"work_id":"ce5f66a0-a5aa-4b4e-82c8-53ce0cea5c90","year":2025},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.446200Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:f20ee2eed3a2039eb9a2ff19f0d5a18cc5dbf31611fa6a6474e99c8f448d6bdb","observation_id":"ca0991dc-f767-4045-b7b2-9ed6407bc61f","resolution":{"observed_at":"2026-08-15T22:23:38.790473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.775135Z","title":"Z., Kumar, V., Levine, S., and Finn, C","venue":null,"work_id":"b50f370f-89ef-4cf7-b678-41114ad1dd43","year":null},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.450135Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:e75563f3baff41a9d6dd47a1f5d3f1ff252210c8cd9a6dbb11dc069d844e8df7","observation_id":"03d041fd-08f0-4ee3-b0a5-06595dc8bdf2","resolution":{"observed_at":"2026-08-15T22:23:38.778807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09829","last_updated":"2024-07-13T09:42:02Z","snapshot_observed_at":"2026-08-12T23:22:55.591980Z","submitted_at":"2024-07-13T09:42:02Z","title":"VLMPC: Vision-Language Model Predictive Control for Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.09829","snapshot_observed_at":"2026-08-15T22:23:38.454169Z","title":"Vlmpc: Vision-language model predictive control for robotic manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.454169Z"},"links":{"cited_paper":"/paper/2407.09829","citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:d77c2f561529d32cb29e1c1a4d0dae99b5254d2339f9702922089157c5e4279e","observation_id":"f2830b1b-9a35-43be-a180-a67405add26c","resolution":{"observed_at":"2026-08-15T22:23:38.454169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.726676Z","title":"Reinformer: Max-return sequence modeling for offline rl","venue":null,"work_id":"3ed4376f-9952-42e6-8eb7-3ba23e90e3bf","year":2024},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.458680Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:3afd03ccb507b29947c4d018b12d57990c477c30db074757b21a862472411fc2","observation_id":"16252e3b-0a58-48ff-81eb-f18ce7d9c8d4","resolution":{"observed_at":"2026-08-15T22:23:38.765137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:23:38.463002Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T22:23:38.463002Z"},"links":{"citing_paper":"/paper/2505.07395"},"observation_digest":"sha256:c1af9e4aadf19ea2236f9dc8503a8d2c68a945cbfb11fd1395e2c67b28155019","observation_id":"1e2868eb-c493-46c3-a766-9567903f8102","resolution":{"observed_at":"2026-08-15T22:23:38.463002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-15T22:15:28.068774Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 18 inbound Pith citation observations for arXiv:2505.07395."}