{"as_of":"2026-08-16T00:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3cb59a0076a8a57249400370d5aa29717783e4b0244e81bcfe7f6436473ed7ff","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:24:48.618223Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:03:56.677639Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-17T20:28:16.362582Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10826","snapshot_observed_at":"2026-08-15T20:03:56.677639Z","title":"Rationalvla: A rational vision-language-action model with dual system,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13725","last_updated":"2025-06-16T17:31:16Z","snapshot_observed_at":"2026-08-15T19:54:39.077178Z","submitted_at":"2025-06-16T17:31:16Z","title":"CEED-VLA: Consistency Vision-Language-Action Model with Early-Exit Decoding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:56.677639Z"},"links":{"cited_paper":"/paper/2506.10826","citing_paper":"/paper/2506.13725"},"observation_digest":"sha256:39bbb9cc002ce4f3896cf221032be634670098f16e72a49b534f7dae3152dcba","observation_id":"663a58cd-4f79-4962-ad9a-8e0d91a5afde","resolution":{"observed_at":"2026-08-15T20:03:56.677639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10826","snapshot_observed_at":"2026-08-05T20:32:46.126998Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10333","last_updated":"2025-08-14T04:20:19Z","snapshot_observed_at":"2026-08-05T20:32:29.550851Z","submitted_at":"2025-08-14T04:20:19Z","title":"ReconVLA: Reconstructive Vision-Language-Action Model as Effective Robot Perceiver","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T20:32:46.126998Z"},"links":{"cited_paper":"/paper/2506.10826","citing_paper":"/paper/2508.10333"},"observation_digest":"sha256:238b58b2d6d579b01d7dfb3de524c3af15375b1bb04f52597eab6b7de492b8ec","observation_id":"aa00de08-9610-42d6-9bd4-d8f86cb31bc2","resolution":{"observed_at":"2026-08-05T20:32:46.126998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"cited_work":{"arxiv_id":"2506.10826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.10826","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rationalvla: a rational vision-language- action model with dual system","venue":null,"work_id":"5c377680-43d9-46c8-a9c0-dc5089e6ab43","year":2025},"citing_paper":{"arxiv_id":"2508.13073","last_updated":"2025-09-01T08:10:01Z","snapshot_observed_at":"2026-08-07T15:40:31.068428Z","submitted_at":"2025-08-18T16:45:48Z","title":"Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey","version":2},"reference_index":135,"source":"pdf_text","source_observed_at":"2026-05-17T20:28:15.818016Z"},"links":{"cited_paper":"/paper/2506.10826","citing_paper":"/paper/2508.13073"},"observation_digest":"sha256:cd8506f48d9fc62d1dbd13c5443fc5298bb0e08021b695ae7e90a64a6fb012fb","observation_id":"393d89ca-2901-43e6-b271-35aaeadcf5f6","resolution":{"observed_at":"2026-05-17T20:28:16.364814Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"cited_work":{"arxiv_id":"2506.10826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.10826","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rationalvla: a rational vision-language- action model with dual system","venue":null,"work_id":"5c377680-43d9-46c8-a9c0-dc5089e6ab43","year":2025},"citing_paper":{"arxiv_id":"2605.10921","last_updated":"2026-05-11T17:54:49Z","snapshot_observed_at":"2026-07-06T23:22:47.781940Z","submitted_at":"2026-05-11T17:54:49Z","title":"RoboMemArena: A Comprehensive and Challenging Robotic Memory Benchmark","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-12T03:50:18.706396Z"},"links":{"cited_paper":"/paper/2506.10826","citing_paper":"/paper/2605.10921"},"observation_digest":"sha256:2587af0b551ede095ae9793d3680fd6a7f8eb3d80a1002033840de6b4ca52a9d","observation_id":"790f1a97-6d41-44c6-ad6f-6be6bc7ff1da","resolution":{"observed_at":"2026-05-12T06:56:26.744197Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10826","snapshot_observed_at":"2026-07-14T10:23:25.158961Z","title":"Rationalvla: A rational vision-language- action model with dual system.arXiv preprint arXiv:2506.10826, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10625","last_updated":"2026-07-12T07:38:53Z","snapshot_observed_at":"2026-08-14T15:15:44.581133Z","submitted_at":"2026-07-12T07:38:53Z","title":"Dual-Process Atomic Skill Learning: Decoupling Semantic Reasoning and Real-Time Control","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-14T10:23:25.158961Z"},"links":{"cited_paper":"/paper/2506.10826","citing_paper":"/paper/2607.10625"},"observation_digest":"sha256:115f02c097788eef090cb002588dab729aad53c8390a958eb061444dc79dbbbe","observation_id":"88b85e26-b952-4e1d-b7d9-cadf72149d98","resolution":{"observed_at":"2026-07-14T10:23:25.158961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10826","snapshot_observed_at":"2026-08-01T19:56:57.341989Z","title":"RationalVLA: A rational vision-language-action model with dual system,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16806","last_updated":"2026-07-18T12:55:40Z","snapshot_observed_at":"2026-08-13T05:32:33.695279Z","submitted_at":"2026-07-18T12:55:40Z","title":"Token-Wise Latent Streaming from Slow Reasoners to Fast Planners for Dynamic Vision Language Navigation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T19:56:57.341989Z"},"links":{"cited_paper":"/paper/2506.10826","citing_paper":"/paper/2607.16806"},"observation_digest":"sha256:35b422ca2e4e8b83171fcd0c47f34bccd1dc289ea45cfc2bb8aa633bc279caf8","observation_id":"6512388d-82c6-4906-865d-8e13e2cf7f6e","resolution":{"observed_at":"2026-08-01T19:56:57.341989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.10826/citation-record","integrity":"/paper/2506.10826/integrity","json":"/paper/2506.10826/citation-record.json","paper":"/paper/2506.10826"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:54.869513Z","title":"Embodied intelligence toward future smart manufacturing in the era of ai foundation model,","venue":null,"work_id":"4f3a9618-b162-45f4-a390-7ce1b5062c6f","year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:44.868625Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:6408859e3375418f9b588b54c833d17ae8fc91a5cef587a26c2ebf29e4131d90","observation_id":"387c9046-046c-4967-8cae-7428aa95c4dd","resolution":{"observed_at":"2026-08-07T04:24:54.872776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:54.859469Z","title":"Rt-2: Vision-language-action models transfer web knowl- edge to robotic control,","venue":null,"work_id":"96b78a59-a430-487e-a895-1ea8dd944c42","year":2023},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:44.912237Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:41f678a2063c5eb80572ced28b776741f409fd8303ed7e5387612314c1184122","observation_id":"d685da79-2213-4a04-a6c2-1c8e28914acf","resolution":{"observed_at":"2026-08-07T04:24:54.862585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:54.850185Z","title":"Vision-language foundation models as effective robot imitators,","venue":null,"work_id":"2438b40d-e182-43c8-9c0d-8d845f03b7be","year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:44.970763Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:0990f83d1cb47ee60caa143d118a238c5ea58bdcf5860cac85960c526199a50d","observation_id":"49c92e94-8b8a-4f63-8383-505cad7793eb","resolution":{"observed_at":"2026-08-07T04:24:54.853354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:54.840122Z","title":"Quar-vla: Vision-language-action model for quadruped robots,","venue":null,"work_id":"f40f76ec-f664-49ed-89e3-f9f749833073","year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:45.022103Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:78f225e6896407d6d78574a421580265080ff94e4be2ee6ad59ecf674a2baea2","observation_id":"191dc47f-f927-4e3e-b15b-08cb5dbe399d","resolution":{"observed_at":"2026-08-07T04:24:54.843683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:45.113110Z","title":"Visual instruction tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:45.113110Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:259a900f9ed7b7784e3201085da4f1c27b3b98e4f5f000aa5febc1627da51852","observation_id":"119901bc-e5c1-484e-a364-42d78c87e8ae","resolution":{"observed_at":"2026-08-07T04:24:45.113110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T04:24:45.193155Z","title":"Gpt-4o system card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:45.193155Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:f96086bdcf6cf0ce8aa478518b23912afc9cb70b399b8f47c6bdf31a0388f786","observation_id":"a2de6888-5f24-43f8-92d0-79d4ea827f92","resolution":{"observed_at":"2026-08-07T04:24:45.193155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:54.824026Z","title":"Lisa: Reasoning segmentation via large language model,","venue":null,"work_id":"f8b28e60-707a-4303-95b9-766f248cae45","year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:45.265895Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:e425bb06811ae20af0e31475a44fc4549662e322d230ec32a202cb7f6bf2d0df","observation_id":"d6b8a8dc-f977-48bc-99ab-4b9d9a293255","resolution":{"observed_at":"2026-08-07T04:24:54.827431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:54.813535Z","title":"Deepseek-vl: Towards real-world vision-language understanding,","venue":null,"work_id":"f338c6f2-f93b-4948-9dce-b3056f1dde46","year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:45.321252Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:792393ed046e8c02aee2e27b26d255c25d89ed0d03f14cde3665fe03efa5f883","observation_id":"ae4f1e19-fdd8-4370-ad1e-98d726ddfd71","resolution":{"observed_at":"2026-08-07T04:24:54.816933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:54.803706Z","title":"Cobra: Extending mamba to multi-modal large language model for efficient inference,","venue":null,"work_id":"b55b4c53-6cf6-4191-afc0-45bf81ad45af","year":2025},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:45.403055Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:f7562be9c6e1856e303c397231cf2faf44767d6060aeee0f112ea9851ab94f30","observation_id":"1033c4e6-fda2-44ac-98e2-541e5b8a0e55","resolution":{"observed_at":"2026-08-07T04:24:54.806802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:54.793865Z","title":"Seeing far and clearly: Mitigating hallucina- tions in mllms with attention causal decoding,","venue":null,"work_id":"c4fa21f4-6cb8-4a5c-b507-5a4726126bae","year":2025},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:45.487310Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:21c2a06a853a3742c9e54e8f0af440d6a726906bcbdc8695d84e0dc069ac3041","observation_id":"4f1d83fe-9482-4a2c-9ac0-6dc25704c33f","resolution":{"observed_at":"2026-08-07T04:24:54.796964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:54.783784Z","title":"Rt-1: 11 Robotics transformer for real-world control at scale,","venue":null,"work_id":"c9c3fea7-94b2-4ab9-b130-c69a444f39fd","year":2023},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:45.554345Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:5d58621491a775a48c4b97facc246d33ed82c96e1d456db845ccd62a98fd9992","observation_id":"b5ac0b5a-9979-48d6-a27e-d01bb338344f","resolution":{"observed_at":"2026-08-07T04:24:54.787391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:54.773455Z","title":"Germ: A generalist robotic model with mixture-of-experts for quadruped robot,","venue":null,"work_id":"59d95300-d386-4b02-b3b4-593f27ca4bfc","year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:45.590200Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:cea9ded625764aadcc9877bec15b7a017a266829c4bfbc8c2e8224a3a4038f18","observation_id":"ebbe92f7-785d-4da9-a2d8-949e31587153","resolution":{"observed_at":"2026-08-07T04:24:54.777271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:54.763563Z","title":"Octo: An open- source generalist robot policy,","venue":null,"work_id":"5e02e68c-1f68-4aee-8e11-500f06d660a4","year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:45.667528Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:1e7156782cb28f0f17247c8b4d2855795d2c817b680b0b6c469abae9c938570e","observation_id":"ea117410-28f8-4ea0-a23c-64f356e1d9d4","resolution":{"observed_at":"2026-08-07T04:24:54.766987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08007","last_updated":"2025-03-11T03:13:45Z","snapshot_observed_at":"2026-08-12T16:59:16.472556Z","submitted_at":"2025-03-11T03:13:45Z","title":"MoRE: Unlocking Scalability in Reinforcement Learning for Quadruped Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08007","snapshot_observed_at":"2026-08-07T04:24:45.741915Z","title":"More: Unlocking scalability in reinforcement learning for quadruped vision-language-action models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:45.741915Z"},"links":{"cited_paper":"/paper/2503.08007","citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:46c047b061b2a8ae0b2be480218fca3328b558028ba013496dc5dccd22112eed","observation_id":"80517fcf-175f-4148-b169-177e2975468e","resolution":{"observed_at":"2026-08-07T04:24:45.741915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:45.805186Z","title":"Accelerating vision-language-action model inte- grated with action chunking via parallel decoding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:45.805186Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:dd3d8b1c11a4d90f1b1f6beaed931da92315ff9089253a0ab800f3acd719e0c5","observation_id":"f131b99b-d0ac-40ac-8297-7f1dd8473089","resolution":{"observed_at":"2026-08-07T04:24:45.805186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:54.753956Z","title":"3d diffuser actor: Policy diffusion with 3d scene representations,","venue":null,"work_id":"5e800e55-fb0e-4f3f-81c0-96f61c4b3feb","year":null},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:45.882089Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:f0cdff2f74bcf3087b464d9e5abbf8c04d83cf6877efe3794a0c759bb423e9e6","observation_id":"c4f4ca83-a28a-4d09-ada4-2c9cff80f355","resolution":{"observed_at":"2026-08-07T04:24:54.757176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:45.970657Z","title":"Calvin: A benchmark for language-conditioned policy learning for long-horizon robot manipulation tasks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:45.970657Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:ece3276c0a14020b8bdea7e81195ce744aaac11a27944588e350160fc79f274b","observation_id":"21c901ab-49cf-4d2e-9f55-8085eff1325c","resolution":{"observed_at":"2026-08-07T04:24:45.970657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21906","last_updated":"2025-05-29T23:34:24Z","snapshot_observed_at":"2026-08-14T14:47:44.698063Z","submitted_at":"2025-05-28T02:48:42Z","title":"ChatVLA-2: Vision-Language-Action Model with Open-World Embodied Reasoning from Pretrained Knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21906","snapshot_observed_at":"2026-08-07T04:24:46.040172Z","title":"Vision-language- action model with open-world embodied reasoning from pretrained knowledge,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:46.040172Z"},"links":{"cited_paper":"/paper/2505.21906","citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:7ad106e3ab68098dcc3de583aa42984373e3445792795317e7fd9640fd65707f","observation_id":"3d798a09-016e-4b4a-badf-e51fd4ed9225","resolution":{"observed_at":"2026-08-07T04:24:46.040172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:54.666350Z","title":"Dynamic neural networks: A survey,","venue":null,"work_id":"77d32c37-55af-4eae-a833-c4ac80e8f5ab","year":2021},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:46.112873Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:b05a7e6576d06f4d67b28a0ed76d90e5722173f6e184eb4950fb24c829e3359b","observation_id":"ca1709af-eec4-4714-a99f-1d3a1b4158ec","resolution":{"observed_at":"2026-08-07T04:24:54.692542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:54.392042Z","title":"Gsva: Generalized segmentation via multimodal large language models,","venue":null,"work_id":"deddfa80-9088-4c73-bcff-55b55a8e94e6","year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:46.188389Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:88724d16b85f36d7efe1ce34b17068287bafa43c6093e6863883a5a314fb7f45","observation_id":"c75630a4-3e9e-442c-ba4b-4c2fa5580d78","resolution":{"observed_at":"2026-08-07T04:24:54.510967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:54.307458Z","title":"A multimodal robust recognition method for grasping objects with robot flexible grippers,","venue":null,"work_id":"d2b4530e-f757-456d-a505-6ba04716c5ca","year":2025},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:46.242550Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:b8090da6c04e2a289ba55f956b57305b56acbab7d994795f56a70d68c646c2c2","observation_id":"c8133683-a472-459c-9c0b-c0c7c3506d3d","resolution":{"observed_at":"2026-08-07T04:24:54.380767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:54.089163Z","title":"Learning generalizable vision-tactile robotic grasping strategy for deformable objects via transformer,","venue":null,"work_id":"d748d5da-429e-4bfc-adbb-108de8e3c99d","year":2025},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:46.320504Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:aa33018e0191fc7967034a5efbf70d95dd1a78cc45b3677f56a606eb80e7306b","observation_id":"8dea092c-2df3-4ec7-8a5e-43745a7c72a0","resolution":{"observed_at":"2026-08-07T04:24:54.187612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:53.818160Z","title":"Dih-tele: Dexterous in-hand teleoperation framework for learning mul- tiobjects manipulation with tactile sensing,","venue":null,"work_id":"6da1e44f-9e2b-4ce5-aad5-8a7c3bd50c8b","year":2025},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:46.408258Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:be03701ce848bc6923cabf658457d2b908564024bcefff4655a1cdd9a0abb108","observation_id":"2e35c844-d577-4243-837b-9dfdf08756db","resolution":{"observed_at":"2026-08-07T04:24:53.968689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:46.486156Z","title":"Efficient grasp detection network with gaussian-based grasp representation for robotic manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:46.486156Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:a8ffb4c0fc9293b86ac58918ad1e36fc56d9ee9eaa350bf3eadbc93c2e7d5671","observation_id":"c2a83e1e-9fc5-4800-a7dc-7957fb7ebd44","resolution":{"observed_at":"2026-08-07T04:24:46.486156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:53.552062Z","title":"Language conditioned imitation learning over unstructured data,","venue":null,"work_id":"40a02982-044b-4ee5-826b-b01412d8315b","year":2021},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:46.561868Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:9903925308f3cd8bd1f4fb8836c8370496a831eef1b15094b3c2074487388135","observation_id":"1d67e1e7-5647-4986-99a7-78a4812fb4b2","resolution":{"observed_at":"2026-08-07T04:24:53.685780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:46.649628Z","title":"What matters in language conditioned robotic imitation learning over unstructured data,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:46.649628Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:860ac57ca7afb7f487dab9374818201a38b1f55456b9ce94611f2d4058a75ac7","observation_id":"ea9e6e9d-3174-467e-a56a-82cd197b0bf3","resolution":{"observed_at":"2026-08-07T04:24:46.649628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:46.728769Z","title":"Diffusion policy: Visuomotor policy learning via ac- tion diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:46.728769Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:874906b0f0169a6ff086e932536abd9abefc23f1f447f496f7763a8e09a98627","observation_id":"b4de731c-37d6-46ed-a747-53b8704be40b","resolution":{"observed_at":"2026-08-07T04:24:46.728769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:53.342502Z","title":"3d diffusion policy,","venue":null,"work_id":"659d6638-43f5-44a9-9b2c-c21b9f95d548","year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:46.790181Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:0e174ca776be9a407787d76b338fab3feaec76cf237a7cb3f5ed3d9a73831974","observation_id":"286f726c-5063-499a-80de-a221ea9ee758","resolution":{"observed_at":"2026-08-07T04:24:53.460891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:53.142656Z","title":"Consistency policy: Accelerated visuomotor policies via consistency distillation,","venue":null,"work_id":"e98b67cc-4ba5-45db-9d7a-119bb96f8911","year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:46.844026Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:f2e7b6f416a870bbe055268c0114bafbd45407f2f8d8888b9c8b1b1220f7b2cf","observation_id":"d3216e62-bf3c-4d88-a14c-33c0df62c9bc","resolution":{"observed_at":"2026-08-07T04:24:53.259184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:52.974756Z","title":"RT-trajectory: Robotic task generalization via hindsight trajectory sketches,","venue":null,"work_id":"ce234421-4da6-498c-a25a-470b2e6e54dd","year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:46.898184Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:57aa9c261ef78442613cabc7d819c23fbddbb4ce3f3eb3b36c6dafcc64eb5822","observation_id":"b0c7a529-c8b4-4042-90cb-ee5bdb5e4d72","resolution":{"observed_at":"2026-08-07T04:24:53.060753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:52.794306Z","title":"Sara-rt: Scaling up robotics transformers with self-adaptive robust attention,","venue":null,"work_id":"1f97db50-60f7-4233-907f-a703e75e7622","year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:46.957774Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:c585f8059a336124c3280c9b23f9228f8a3250d2fe4d8d0d5448515da3d46557","observation_id":"b8533a63-2a44-4ea7-8caf-241a80272b5d","resolution":{"observed_at":"2026-08-07T04:24:52.862970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:52.564650Z","title":"Inner monologue: Em- bodied reasoning through planning with language models,","venue":null,"work_id":"43c0f9d7-d32a-48b3-ba23-83c568ed2547","year":2023},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:47.022196Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:715f8e51eee92c8161a1344d6234607dd25fb26994d2b7445d374608a937ad30","observation_id":"50e6b248-cc1c-436b-81e9-660457f5e1dc","resolution":{"observed_at":"2026-08-07T04:24:52.691441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:52.313196Z","title":"Unleashing large-scale video generative pre-training for visual robot manipulation,","venue":null,"work_id":"352794d2-d251-4b81-9e59-9bdca2f548a2","year":null},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:47.082933Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:f39b3c3d43974c5677c4cb149582b45a213bcc2a0953c9b6bb80bdcd735194f6","observation_id":"f9abede6-c0b4-4513-b0cb-c0f4cf76bf20","resolution":{"observed_at":"2026-08-07T04:24:52.427299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:52.092144Z","title":"Video language planning,","venue":null,"work_id":"6ce49e5e-ed71-431e-8d47-50bdfefd0dbe","year":null},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:47.145939Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:62436330dd2422339a77f6834c30e4712600ff3262760e9acd9621faa78b55a4","observation_id":"2eda2f3a-330a-4827-826a-0b95e2ac8715","resolution":{"observed_at":"2026-08-07T04:24:52.151150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:51.983980Z","title":"Robomamba: Efficient vision-language-action model for robotic reasoning and manipulation,","venue":null,"work_id":"224a3087-7ea5-4155-b2be-c86fb0f14456","year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:47.193783Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:d1897c47b89809adb524ef3c5223eab0de902598614a70b65ba4bbd625bcb8dc","observation_id":"9c3534bc-6442-43b5-a17d-b74bc742c8bd","resolution":{"observed_at":"2026-08-07T04:24:52.039687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:51.795226Z","title":"Vlas: Vision-language-action model with speech instructions for customized robot manipulation,","venue":null,"work_id":"d0e22391-30c5-490c-8bac-a21d7936d508","year":null},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:47.248717Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:8eb46167d03fa50ef2240c3666f877e30531f0ce77289bcec5934ef2b4818092","observation_id":"2a951cf5-e9f0-4ce4-bf9b-c545e4f26e67","resolution":{"observed_at":"2026-08-07T04:24:51.882889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:51.615053Z","title":"Dual-arm robotic fabric manipulation with quasi-static and dynamic primitives for rapid garment flattening,","venue":null,"work_id":"5209507a-28da-44ea-be3f-35f65b4eb16d","year":2025},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:47.317109Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:3379483941cab7f29c479a02e781186333c2fc9c08e29c32932219d5321b34f7","observation_id":"cd995e3c-fb3a-43e7-a78a-355efaaefe90","resolution":{"observed_at":"2026-08-07T04:24:51.696294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:51.413424Z","title":"From llms to actions: Latent codes as bridges in hierarchical robot control,","venue":null,"work_id":"5e14f54d-0408-415d-96df-e876e007bd08","year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:47.373690Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:50aac9560065ea104fca01c127fda556b204c43806f2c5e47fc61adb9b5cd33f","observation_id":"cf663e19-9a37-4eee-b411-84fde9e53b8c","resolution":{"observed_at":"2026-08-07T04:24:51.511411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:51.214322Z","title":"Hirt: Enhancing robotic control with hierarchical robot transformers,","venue":null,"work_id":"64a482e9-90f9-44eb-abce-6e595d6986e2","year":null},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:47.438243Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:1259307618873ba07ea858c387e2144f001e393893e1f1719ff64b94ff556a7d","observation_id":"0c424af0-ad07-4135-855e-f574d34dd158","resolution":{"observed_at":"2026-08-07T04:24:51.318105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:51.034274Z","title":"Towards synergistic, generalized, and efficient dual-system for robotic manipulation,","venue":null,"work_id":"4e9dead7-b884-4605-9ab2-82f4b5bab31c","year":2025},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:47.485857Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:8ae1611ef0cfe8568c84921aadf350a63d1fd88d5c2da8f576a9cd494984db42","observation_id":"de8c6ffc-a6fe-4607-b527-41a9ad8022d9","resolution":{"observed_at":"2026-08-07T04:24:51.113011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15549","last_updated":"2024-10-21T00:36:02Z","snapshot_observed_at":"2026-08-12T22:19:04.315700Z","submitted_at":"2024-10-21T00:36:02Z","title":"A Dual Process VLA: Efficient Robotic Manipulation Leveraging VLM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15549","snapshot_observed_at":"2026-08-07T04:24:47.538512Z","title":"A dual process vla: Efficient robotic manipulation leveraging vlm,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:47.538512Z"},"links":{"cited_paper":"/paper/2410.15549","citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:b3d3b697a4a4b7d5c0493f6e30dc2dc0b642c88053aaf7178dca613f378e5372","observation_id":"095963b2-6f1c-4e10-bcb7-0c9684fb567d","resolution":{"observed_at":"2026-08-07T04:24:47.538512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:50.850583Z","title":"Openvla: An open-source vision-language-action model,","venue":null,"work_id":"93ca07f5-6813-49d7-a744-b2652ec918f5","year":null},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:47.589923Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:eabb7ee35e5809cf1c5fd252a02c6c77dfce5be68962c6eccc924ca6c8b2ba38","observation_id":"8132137a-43a1-49da-b5f8-88d0bfcb8855","resolution":{"observed_at":"2026-08-07T04:24:50.939829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:50.615849Z","title":"Gr00t n1: An open foundation model for generalist humanoid robots,","venue":null,"work_id":"2a8db571-928d-4731-a796-3ae0089e3bf0","year":2025},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:47.631099Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:41c7ac7d6ce99b28788f95e88ddf17aa54006797f11fae784120f09068b2b1ff","observation_id":"6d5ba01f-60b7-4566-a5f4-f9693fc67b41","resolution":{"observed_at":"2026-08-07T04:24:50.721443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03912","last_updated":"2025-05-06T18:35:07Z","snapshot_observed_at":"2026-08-15T23:40:23.773295Z","submitted_at":"2025-05-06T18:35:07Z","title":"OpenHelix: A Short Survey, Empirical Analysis, and Open-Source Dual-System VLA Model for Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03912","snapshot_observed_at":"2026-08-07T04:24:47.684400Z","title":"Openhelix: A short survey, empirical analysis, and open-source dual-system vla model for robotic manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:47.684400Z"},"links":{"cited_paper":"/paper/2505.03912","citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:73f6f8e9bc7c7eb6f4a5253f4d6449734e4be5171a0d360039b34acbccbfb865","observation_id":"7ac11666-e4db-4399-898c-10e4ab4007ec","resolution":{"observed_at":"2026-08-07T04:24:47.684400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:50.349967Z","title":"Hierarchical reinforcement learning with model guidance for mobile manipulation,","venue":null,"work_id":"c3e6ae5c-23f0-46be-82d4-4407bed84ef3","year":2025},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:47.745003Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:2171701767dd2315f9bc8256d0138801f270e24356848172016fbfd20b026e49","observation_id":"55622c64-f47f-4ad1-8a5a-7fecc9d9c88b","resolution":{"observed_at":"2026-08-07T04:24:50.469853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:50.118291Z","title":"Interactive imitation learning of bimanual movement primitives,","venue":null,"work_id":"a411f3f4-0d4f-4cc6-ad52-46ef8dc5280c","year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:47.802533Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:fe88cff4015f884737adb84b873e847b802034821d69cc97af34d1530cd58147","observation_id":"797b14a9-7840-4dba-ace9-80fa9de8d5a5","resolution":{"observed_at":"2026-08-07T04:24:50.246959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:49.941389Z","title":"Navigating beyond in- structions: Vision-and-language navigation in obstructed environments,","venue":null,"work_id":"6d55fe2a-0880-4626-beb5-202ed0750877","year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:47.872273Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:b85d6f34c515d1fc821a436f9fb899d836de7d4b0beee30399502f5577a3380e","observation_id":"75f51d1f-f10b-4d7d-a507-1f7565cbca43","resolution":{"observed_at":"2026-08-07T04:24:50.037859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12443","last_updated":"2025-05-18T14:33:17Z","snapshot_observed_at":"2026-08-15T20:31:30.141066Z","submitted_at":"2025-05-18T14:33:17Z","title":"BadNAVer: Exploring Jailbreak Attacks On Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12443","snapshot_observed_at":"2026-08-07T04:24:47.924165Z","title":"Badnaver: Exploring jail- break attacks on vision-and-language navigation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:47.924165Z"},"links":{"cited_paper":"/paper/2505.12443","citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:7c354eb32d28a81f99590fc8f19c7a1468d29acf34d2e1bce1c8e43b6d8c5f53","observation_id":"dd672fc8-f90e-4b37-a440-925b000f4f7f","resolution":{"observed_at":"2026-08-07T04:24:47.924165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:49.713924Z","title":"Safety bounds in human robot interaction: A survey,","venue":null,"work_id":"4a274c79-5b2b-470b-a6aa-28b28a13a45c","year":2020},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:47.963015Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:3e8e70fd37c8f7219a181459ebcf2c407e8fea8c841f9212269f67df5def1d36","observation_id":"23b0c067-e096-479b-8d13-fe55ba550797","resolution":{"observed_at":"2026-08-07T04:24:49.819340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:48.002210Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:48.002210Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:10112a2d95114956bbd16ae4562e363b5ac9810bbdb5965ca104fa7f5bc53f5b","observation_id":"3d25a37a-ca7d-463e-953a-df8b123260e3","resolution":{"observed_at":"2026-08-07T04:24:48.002210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:49.497346Z","title":"Pybullet, a python module for physics simulation for games, robotics and machine learning,","venue":null,"work_id":"82486387-4f7e-4b75-a340-21bffa2232fd","year":2016},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:48.076903Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:3725d1f615644e54196c839b78cc1b88f39fdd05e5f2c9def692f14968535a4a","observation_id":"c5238311-00ae-44b5-a152-7a29b06dce08","resolution":{"observed_at":"2026-08-07T04:24:49.607146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:48.225606Z","title":"LoRA: Low-rank adaptation of large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:48.225606Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:450918ff017f475cccc993c23dfd04dacb571d911abb02a6721f29eef896b242","observation_id":"2f4c3a85-1148-411e-a693-e5cf933c4902","resolution":{"observed_at":"2026-08-07T04:24:48.225606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:48.386974Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:48.386974Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:29f96308afaff3b04ad3fa0296f48f6907eb07aa656a263afdd9453f3131a100","observation_id":"d08f8b2b-a536-4225-9c91-cd89043e73a5","resolution":{"observed_at":"2026-08-07T04:24:48.386974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:49.270747Z","title":"Investigating the catastrophic forgetting in multimodal large language models,","venue":null,"work_id":"ece440f3-147a-4514-9194-0655789cb78e","year":2023},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:48.482359Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:4c15642bb41513c37019c1a2b99d6abfbea83e409b36300da25779bcbead83db","observation_id":"b6a9d7b3-7121-4f33-80c7-924bcbd4d6ea","resolution":{"observed_at":"2026-08-07T04:24:49.387945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:49.044988Z","title":"Allava: Harnessing gpt4v-synthesized data for lite vision-language models,","venue":null,"work_id":"a8c13ab4-6207-4a18-91cd-a07395dfde7a","year":2024},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:48.559986Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:62d99ac6a42075fc06735470af765d707f9a112b72937f639419b1d9c746f51f","observation_id":"7bfc2d50-168d-4edf-9806-fad476749dbf","resolution":{"observed_at":"2026-08-07T04:24:49.134933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:24:48.899900Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":"d424d6b7-dbeb-4f2f-af43-5357818b92ac","year":2023},"citing_paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T04:24:48.618223Z"},"links":{"citing_paper":"/paper/2506.10826"},"observation_digest":"sha256:2991c9b23996f291bb33b50e2ccdfe683c1333d3e255f2f3b9df7b8c1f2caaac","observation_id":"87327f2a-f89b-43fb-814e-4764dd3287a2","resolution":{"observed_at":"2026-08-07T04:24:48.954179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.10826","last_updated":"2025-06-13T12:14:44Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-15T12:12:43.799681Z","submitted_at":"2025-06-12T15:44:51Z","title":"RationalVLA: A Rational Vision-Language-Action Model with Dual System"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":41},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 6 inbound Pith citation observations for arXiv:2506.10826."}