{"as_of":"2026-08-20T06:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8cd2c337aac025629fff5e9a0bae3bf46208891e4e86398a63760cd0dc70df4f","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T04:30:57.186538Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06434/citation-record","integrity":"/paper/2608.06434/integrity","json":"/paper/2608.06434/citation-record.json","paper":"/paper/2608.06434"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-08-16T17:53:54.636855Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-10T04:30:57.080523Z","title":"pi_0: A vision-language-action flow model for general robot control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.080523Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:068cfec13a2eb2773f72cf85ec99a5daa4f5ad0f1a5670529322d252c898bb34","observation_id":"6b8ac8e5-5e60-4646-8e2c-062c225d304a","resolution":{"observed_at":"2026-08-10T04:30:57.080523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.590825Z","title":"OpenVLA: An open-source vision-language-action model,","venue":null,"work_id":"860aab1d-dc06-4957-a9cb-8bda968eaeed","year":2024},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.085322Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:9374d8a277a0e5e3718b09ce8b913fcfe037638cf88c8f4f979b2e15eb4b0e73","observation_id":"24055610-e097-462d-a20c-46113355c0d3","resolution":{"observed_at":"2026-08-10T04:30:57.594979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-08T07:16:45.596308Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-08-10T04:30:57.089119Z","title":"Paligemma: A versatile 3b vlm for transfer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.089119Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:94c91377536423ed32f265f9182321e3221e16a76e7677dd30cc3388729535df","observation_id":"c2182ab2-d6f4-4e01-9c90-5ed195faa706","resolution":{"observed_at":"2026-08-10T04:30:57.089119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.577292Z","title":"Prismatic vlms: Investigating the design space of visually- conditioned language models,","venue":null,"work_id":"1f3c9c6c-3954-4c77-b225-edb914337621","year":2024},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.093149Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:3a71a3f9de17bd3564d3ad924838c82746bb912dd33d3aa17a5714caa3b2e250","observation_id":"a462fb4b-e5f4-429e-8836-e63470a39be9","resolution":{"observed_at":"2026-08-10T04:30:57.581553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.564814Z","title":"Bridgedata v2: A dataset for robot learning at scale,","venue":null,"work_id":"6afb98c0-b75d-41e5-99d4-b12e1f14135b","year":2023},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.097586Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:4c2267ecf4459c08a898963f0ec7d18aca135bec683ab70debc544506a66268b","observation_id":"25b9f60c-9ba2-4b52-b42e-b34d1ca85204","resolution":{"observed_at":"2026-08-10T04:30:57.568479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.552926Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models: Open x-embodiment collaboration 0,","venue":null,"work_id":"0e373851-3ddf-4e20-8a4f-4537b28d0156","year":2024},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.101400Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:73539025c5dede50a8b9077dbb99405b36514aa6b9525f0abae2c68468ff951c","observation_id":"1b88a691-8446-4cdd-a1f0-b78a74d3d435","resolution":{"observed_at":"2026-08-10T04:30:57.557007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.540412Z","title":"Rt-2: Vision- language-action models transfer web knowledge to robotic control,","venue":null,"work_id":"24b827fa-b187-44df-b95d-2243f28bd0ba","year":2023},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.105640Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:d43e13cde3ce661569b3cb986862c8b1c6794ebd951d8cb1dd924ce691152438","observation_id":"1b6610d1-92f5-46a6-be29-b52cdfd96d34","resolution":{"observed_at":"2026-08-10T04:30:57.545411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.528735Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion,","venue":null,"work_id":"932f0c55-38cc-4444-8f76-97e85f435ac8","year":2025},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.109431Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:dcd1806256ca5bb8b0b460554dc3edcab5b220fcb583ba28fbaaf5be1f547464","observation_id":"2eaac3e3-da97-4d58-ba98-6624712c61fe","resolution":{"observed_at":"2026-08-10T04:30:57.533020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.517028Z","title":"Tinyvla: Towards fast, data-efficient vision-language-action models for robotic manipulation,","venue":null,"work_id":"2157ecd4-5538-4e0a-b909-c7830c9254f9","year":2025},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.113080Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:a9efbcfdc32f995a604b0ccd6d0c9882afd7d2cf11906f3e4dd7d512f16a6929","observation_id":"6dacd164-f493-4fdc-91e4-dbc1b309435f","resolution":{"observed_at":"2026-08-10T04:30:57.520807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01844","last_updated":"2025-06-02T16:30:19Z","snapshot_observed_at":"2026-08-18T04:25:30.115862Z","submitted_at":"2025-06-02T16:30:19Z","title":"SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01844","snapshot_observed_at":"2026-08-10T04:30:57.116802Z","title":"Smolvla: A vision-language-action model for affordable and efficient robotics,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.116802Z"},"links":{"cited_paper":"/paper/2506.01844","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:640fa6661cbe9fa8850d2018ea3f1b1a3280145b4951bcb3e0e1dac43e1a0c05","observation_id":"f61b9e85-b26b-442e-9355-bd06ae258ecb","resolution":{"observed_at":"2026-08-10T04:30:57.116802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.03298","last_updated":"2021-09-25T00:37:01Z","snapshot_observed_at":"2026-08-14T11:25:08.505775Z","submitted_at":"2021-08-06T20:48:30Z","title":"What Matters in Learning from Offline Human Demonstrations for Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.03298","snapshot_observed_at":"2026-08-10T04:30:57.121014Z","title":"What matters in learning from offline human demonstrations for robot manipulation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.121014Z"},"links":{"cited_paper":"/paper/2108.03298","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:1010bc5394f4a60cf124169dc16d5d98c0d87d9d411553689240c4ec6b8f4e5e","observation_id":"c6565fd2-ef0d-4c45-b94d-83217c37625a","resolution":{"observed_at":"2026-08-10T04:30:57.121014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13705","last_updated":"2023-04-23T19:10:53Z","snapshot_observed_at":"2026-08-03T01:22:01.078078Z","submitted_at":"2023-04-23T19:10:53Z","title":"Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13705","snapshot_observed_at":"2026-08-10T04:30:57.124809Z","title":"Learning fine-grained bimanual manipulation with low-cost hardware,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.124809Z"},"links":{"cited_paper":"/paper/2304.13705","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:c536e5f4d1eb0f0046b1bd6440e3c1bc6c4465b87b408dd8d16553aead27bd88","observation_id":"2d03f803-7772-4f22-9479-70c941ca7341","resolution":{"observed_at":"2026-08-10T04:30:57.124809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.129041Z","title":"Kahneman,Thinking, fast and slow","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.129041Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:84081e67fd3dfa96f4b2059f981917c437d2d6649e6d003801c85ac59befed69","observation_id":"57d8cb51-68c2-4772-93d9-b693fa24c531","resolution":{"observed_at":"2026-08-10T04:30:57.129041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15549","last_updated":"2024-10-21T00:36:02Z","snapshot_observed_at":"2026-08-19T23:50:57.934159Z","submitted_at":"2024-10-21T00:36:02Z","title":"A Dual Process VLA: Efficient Robotic Manipulation Leveraging VLM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15549","snapshot_observed_at":"2026-08-10T04:30:57.132522Z","title":"A dual process vla: Efficient robotic manipulation leveraging vlm,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.132522Z"},"links":{"cited_paper":"/paper/2410.15549","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:22caf9ff13001e0ab11fe55a3ba6e7f61e27d1d89af62e993d76a02fc1f04f65","observation_id":"8096977d-b0d7-4679-a0a5-b0014658544a","resolution":{"observed_at":"2026-08-10T04:30:57.132522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01953","last_updated":"2025-06-02T17:59:51Z","snapshot_observed_at":"2026-08-13T09:54:33.556478Z","submitted_at":"2025-06-02T17:59:51Z","title":"Fast-in-Slow: A Dual-System Foundation Model Unifying Fast Manipulation within Slow Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01953","snapshot_observed_at":"2026-08-10T04:30:57.136303Z","title":"Fast-in-slow: A dual-system foundation model unifying fast manipulation within slow reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.136303Z"},"links":{"cited_paper":"/paper/2506.01953","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:d0d993e2fba9803571159cd4c0de109c17c4e2ceec61c271f20bdd8019df5a48","observation_id":"4fb6c10c-3c9e-45cf-b318-137f3e3c6e90","resolution":{"observed_at":"2026-08-10T04:30:57.136303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.497046Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"bd614453-30e2-4ce6-ae09-d9255fbd3d9b","year":2021},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.139819Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:f88876068f792eaa485a2637df915bd278f9a6cecb20a22e03491f39aa170f17","observation_id":"91935d68-daed-4bb7-ab58-d627383df95d","resolution":{"observed_at":"2026-08-10T04:30:57.500823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12601","last_updated":"2022-11-18T05:57:09Z","snapshot_observed_at":"2026-08-11T08:36:53.636356Z","submitted_at":"2022-03-23T17:55:09Z","title":"R3M: A Universal Visual Representation for Robot Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.12601","snapshot_observed_at":"2026-08-10T04:30:57.143068Z","title":"R3m: A universal visual representation for robot manipulation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.143068Z"},"links":{"cited_paper":"/paper/2203.12601","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:65c8e7b9d290008390b8eaed20d9d7c066ba4bbc5b9c6882138f58f31cca6de3","observation_id":"f3827a3e-8029-49c2-9071-fdbd3e27b16d","resolution":{"observed_at":"2026-08-10T04:30:57.143068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.485479Z","title":"Where are we in the search for an artificial visual cortex for embodied intelligence?","venue":null,"work_id":"9ec6a043-9aa8-4ed8-b3b2-6d8e22d8472f","year":2023},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.146256Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:d0c20da59b8d43b3fa5402578987f2bd8afd8b201c5249e61b666320c1ae93d7","observation_id":"f960f311-c1a1-485e-bd4f-f0bcccadd1b1","resolution":{"observed_at":"2026-08-10T04:30:57.489164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.474081Z","title":"Cliport: What and where pathways for robotic manipulation,","venue":null,"work_id":"1f7ae2b1-93a5-4d66-ac56-6cad73540d3d","year":2022},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.149233Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:67b52fba6d70a706e9c91432cf364f1e5376f763fe8214523b940ef34103fe19","observation_id":"2bb9d833-b174-4363-870f-37d0d5bd6e88","resolution":{"observed_at":"2026-08-10T04:30:57.478315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-10T04:30:57.152575Z","title":"Gr00t n1: An open foundation model for generalist humanoid robots,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.152575Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:c9d14625b9510239d4d265f25a4c0679af598018c30c87bdabb2088ca0457258","observation_id":"ba061c9c-76b1-4759-9010-afc74091f8da","resolution":{"observed_at":"2026-08-10T04:30:57.152575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19650","last_updated":"2024-11-29T12:06:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-29T12:06:03Z","title":"CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19650","snapshot_observed_at":"2026-08-10T04:30:57.157342Z","title":"Cogact: A foundational vision-language-action model for synergizing cognition and action in robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.157342Z"},"links":{"cited_paper":"/paper/2411.19650","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:f87bff069a10d31dce5477a177910cd1ee89a741ce78af9b0aa598c7f082a253","observation_id":"9dee8705-7a7f-4a47-8077-0bda59ee13a2","resolution":{"observed_at":"2026-08-10T04:30:57.157342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05273","last_updated":"2025-02-03T04:07:37Z","snapshot_observed_at":"2026-08-17T01:02:48.636154Z","submitted_at":"2024-09-12T09:18:09Z","title":"HiRT: Enhancing Robotic Control with Hierarchical Robot Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05273","snapshot_observed_at":"2026-08-10T04:30:57.162285Z","title":"Hirt: Enhancing robotic control with hierarchical robot transformers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.162285Z"},"links":{"cited_paper":"/paper/2410.05273","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:6e1a6d3b0e1b52f4acf6bb7a3c1878771f54d5fc764b625ac5b370137e89ddd1","observation_id":"af75476d-c011-4073-89e0-bc6234596be2","resolution":{"observed_at":"2026-08-10T04:30:57.162285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08001","last_updated":"2025-02-06T12:37:15Z","snapshot_observed_at":"2026-08-16T18:26:33.270093Z","submitted_at":"2024-10-10T14:57:51Z","title":"Towards Synergistic, Generalized, and Efficient Dual-System for Robotic Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08001","snapshot_observed_at":"2026-08-10T04:30:57.167058Z","title":"Towards synergistic, generalized, and efficient dual-system for robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.167058Z"},"links":{"cited_paper":"/paper/2410.08001","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:fe53cafae1f37077139ec2e94f007cc6e99bec4d055980174f23dbce35237393","observation_id":"ebec5335-ad6c-4ee5-9463-f08b3e5a345d","resolution":{"observed_at":"2026-08-10T04:30:57.167058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.170903Z","title":"Trivla: A triple-system-based unified vision-language-action model with episodic world modeling for general robot control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.170903Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:79cd275bee1b7587f472bdebb6ffefa5a8bb4b3a0dcc4c2476508afd5b673cde","observation_id":"8f680ca6-4195-4ee6-9e03-f551c3fc6cff","resolution":{"observed_at":"2026-08-10T04:30:57.170903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21432","last_updated":"2025-07-08T15:03:11Z","snapshot_observed_at":"2026-08-16T20:20:00.967462Z","submitted_at":"2025-05-27T17:04:21Z","title":"Hume: Introducing System-2 Thinking in Visual-Language-Action Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21432","snapshot_observed_at":"2026-08-10T04:30:57.174397Z","title":"Hume: Introducing system-2 thinking in visual-language-action model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.174397Z"},"links":{"cited_paper":"/paper/2505.21432","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:eda7356e83bd74a09c4aa8117d23d41924d2d994e42013a7ce780aa3b7ea6f2a","observation_id":"c3761f79-4d71-4820-b142-ab1456f4d407","resolution":{"observed_at":"2026-08-10T04:30:57.174397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.462283Z","title":"Rainbow: Combining improvements in deep reinforce- ment learning,","venue":null,"work_id":"a36753dc-39bd-451f-87ed-d59318d34be0","year":2018},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.178319Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:0e1c09eb7d186713677009c942c736f590a6a0da33ed36eb41686207b7f15a34","observation_id":"436b722d-1bd8-4bef-bd13-9e8f428bcc77","resolution":{"observed_at":"2026-08-10T04:30:57.467006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.183119Z","title":"Offline reinforcement learning with implicit q-learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.183119Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:541dd726199caf0a0e932f3e06b211d5d4fcb49879324edb18b306eac219aab3","observation_id":"3f466f49-7e8c-4f9e-88e8-9f34a4dc8964","resolution":{"observed_at":"2026-08-10T04:30:57.183119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.440786Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learning,","venue":null,"work_id":"f73ed89d-38a3-4877-b043-3ac2a40adf54","year":2023},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.186538Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:9df92c16105094455a6993d19d54ff4f170cb854d7be69d8f9a5225ca454f4c9","observation_id":"81b1b522-eb53-4a6e-b538-6ecb8ad37dcf","resolution":{"observed_at":"2026-08-10T04:30:57.447073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-18T01:54:01.328512Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2608.06434."}