{"as_of":"2026-08-10T12:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3e2f517969a20d9cc0c6f2d70e3aa077a6e35e5029ec8a5f5025f398b5116c70","coverage":[{"denominator":91,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":91,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:02:25.661211Z","state":"measured"},{"denominator":103,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":103,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T11:38:55.769264Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"cited_work":{"arxiv_id":"2507.17049","doi":"10.48550/arxiv.2507.17049","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.17049","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Homer Rich Walke, Kevin Black, Tony Z Zhao, Quan Vuong, Chongyi Zheng, Philippe Hansen- Estruch, Andre Wang He, Vivek Myers, Moo Jin Kim, Max Du, et al","venue":"ArXiv.org","work_id":"42b02538-974c-424a-8eb8-6dd828749340","year":2025},"citing_paper":{"arxiv_id":"2510.03827","last_updated":"2026-05-25T08:44:07Z","snapshot_observed_at":"2026-08-07T03:52:23.114381Z","submitted_at":"2025-10-04T14:56:40Z","title":"LIBERO-PRO: Towards Robust and Fair Evaluation of Vision-Language-Action Models Beyond Memorization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-17T06:20:01.885711Z"},"links":{"cited_paper":"/paper/2507.17049","citing_paper":"/paper/2510.03827"},"observation_digest":"sha256:30f49e2a989cec06d05f26527595cc29ef3f44fd2e65764ca630936581f0be0d","observation_id":"def5ad51-90be-40fb-8c07-f7db2bf18df8","resolution":{"observed_at":"2026-07-22T01:22:12.438932Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.17049","snapshot_observed_at":"2026-08-04T11:38:55.769264Z","title":"Homer Rich Walke, Kevin Black, Tony Z Zhao, Quan Vuong, Chongyi Zheng, Philippe Hansen- Estruch, Andre Wang He, Vivek Myers, Moo Jin Kim, Max Du, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.03827","last_updated":"2026-05-25T08:44:07Z","snapshot_observed_at":"2026-08-07T03:52:23.114381Z","submitted_at":"2025-10-04T14:56:40Z","title":"LIBERO-PRO: Towards Robust and Fair Evaluation of Vision-Language-Action Models Beyond Memorization","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T11:38:55.769264Z"},"links":{"cited_paper":"/paper/2507.17049","citing_paper":"/paper/2510.03827"},"observation_digest":"sha256:a61313caf69e2de3ca1e6b2066d57a4c8018ee868f7d179abd0880cbb96c06c0","observation_id":"652202ca-64f5-4722-82cc-7216c2281463","resolution":{"observed_at":"2026-08-04T11:38:55.769264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.17049","snapshot_observed_at":"2026-08-02T22:07:48.284765Z","title":"Evaluating un- certainty and quality of visual language action-enabled robots.arXiv preprint arXiv:2507.17049,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.18020","last_updated":"2026-06-06T17:01:08Z","snapshot_observed_at":"2026-08-02T22:07:45.299955Z","submitted_at":"2026-02-20T06:22:21Z","title":"UAOR: Uncertainty-aware Observation Reinjection for Vision-Language-Action Models","version":2},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-02T22:07:48.284765Z"},"links":{"cited_paper":"/paper/2507.17049","citing_paper":"/paper/2602.18020"},"observation_digest":"sha256:fd4a46f86690be668c2a2b02b01814bfceb67fa317e76436bc17a62a7b92a78e","observation_id":"60253026-a6e8-472c-9935-70f7f66ce39d","resolution":{"observed_at":"2026-08-02T22:07:48.284765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"cited_work":{"arxiv_id":"2507.17049","doi":"10.48550/arxiv.2507.17049","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.17049","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Homer Rich Walke, Kevin Black, Tony Z Zhao, Quan Vuong, Chongyi Zheng, Philippe Hansen- Estruch, Andre Wang He, Vivek Myers, Moo Jin Kim, Max Du, et al","venue":"ArXiv.org","work_id":"42b02538-974c-424a-8eb8-6dd828749340","year":2025},"citing_paper":{"arxiv_id":"2602.22474","last_updated":"2026-05-12T19:47:13Z","snapshot_observed_at":"2026-07-06T22:47:06.893212Z","submitted_at":"2026-02-25T23:23:22Z","title":"When to Act, Ask, or Learn: Uncertainty-Aware Policy Steering","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T19:00:12.595469Z"},"links":{"cited_paper":"/paper/2507.17049","citing_paper":"/paper/2602.22474"},"observation_digest":"sha256:7b4da16dc10a1ea9839cd9191b1a3ea46ef25d1a2b930b17ea3d34b4423a59f0","observation_id":"611b0480-276b-413f-9311-71113bd3fcef","resolution":{"observed_at":"2026-07-22T01:22:12.438932Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"cited_work":{"arxiv_id":"2507.17049","doi":"10.48550/arxiv.2507.17049","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.17049","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Homer Rich Walke, Kevin Black, Tony Z Zhao, Quan Vuong, Chongyi Zheng, Philippe Hansen- Estruch, Andre Wang He, Vivek Myers, Moo Jin Kim, Max Du, et al","venue":"ArXiv.org","work_id":"42b02538-974c-424a-8eb8-6dd828749340","year":2025},"citing_paper":{"arxiv_id":"2604.16677","last_updated":"2026-04-17T20:20:43Z","snapshot_observed_at":"2026-07-29T16:09:44.291182Z","submitted_at":"2026-04-17T20:20:43Z","title":"ReconVLA: An Uncertainty-Guided and Failure-Aware Vision-Language-Action Framework for Robotic Control","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T07:59:21.696226Z"},"links":{"cited_paper":"/paper/2507.17049","citing_paper":"/paper/2604.16677"},"observation_digest":"sha256:10e8460616d9cf5603312b4446f0db91ee22224de874ef96c34b5d6c070b38a6","observation_id":"e9796029-57a9-4e24-a584-ab87f242aaba","resolution":{"observed_at":"2026-07-22T01:22:12.438932Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"cited_work":{"arxiv_id":"2507.17049","doi":"10.48550/arxiv.2507.17049","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.17049","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Homer Rich Walke, Kevin Black, Tony Z Zhao, Quan Vuong, Chongyi Zheng, Philippe Hansen- Estruch, Andre Wang He, Vivek Myers, Moo Jin Kim, Max Du, et al","venue":"ArXiv.org","work_id":"42b02538-974c-424a-8eb8-6dd828749340","year":2025},"citing_paper":{"arxiv_id":"2604.23775","last_updated":"2026-04-26T15:58:19Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T15:58:19Z","title":"Vision-Language-Action Safety: Threats, Challenges, Evaluations, and Mechanisms","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-08T05:56:13.913710Z"},"links":{"cited_paper":"/paper/2507.17049","citing_paper":"/paper/2604.23775"},"observation_digest":"sha256:d36ea81a63bdd9d9baf595e2d679e0b3e77415777284fc57a1e4a91da3accbf1","observation_id":"07745c56-f1e2-4864-8acf-649d9f925095","resolution":{"observed_at":"2026-07-22T01:22:12.438932Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"cited_work":{"arxiv_id":"2507.17049","doi":"10.48550/arxiv.2507.17049","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.17049","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Homer Rich Walke, Kevin Black, Tony Z Zhao, Quan Vuong, Chongyi Zheng, Philippe Hansen- Estruch, Andre Wang He, Vivek Myers, Moo Jin Kim, Max Du, et al","venue":"ArXiv.org","work_id":"42b02538-974c-424a-8eb8-6dd828749340","year":2025},"citing_paper":{"arxiv_id":"2604.25161","last_updated":"2026-04-28T03:08:48Z","snapshot_observed_at":"2026-07-06T23:11:02.043135Z","submitted_at":"2026-04-28T03:08:48Z","title":"Where Did It Go Wrong? Capability-Oriented Failure Attribution for Vision-and-Language Navigation Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-07T14:14:27.497251Z"},"links":{"cited_paper":"/paper/2507.17049","citing_paper":"/paper/2604.25161"},"observation_digest":"sha256:8c1b7792accb909489e624619a097e3564b5e1a68d823d4639c9af320a5de479","observation_id":"8faddda7-af00-4e83-9e3e-3a9f02f87088","resolution":{"observed_at":"2026-07-22T01:22:12.438932Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"cited_work":{"arxiv_id":"2507.17049","doi":"10.48550/arxiv.2507.17049","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.17049","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Homer Rich Walke, Kevin Black, Tony Z Zhao, Quan Vuong, Chongyi Zheng, Philippe Hansen- Estruch, Andre Wang He, Vivek Myers, Moo Jin Kim, Max Du, et al","venue":"ArXiv.org","work_id":"42b02538-974c-424a-8eb8-6dd828749340","year":2025},"citing_paper":{"arxiv_id":"2605.10408","last_updated":"2026-05-16T05:46:37Z","snapshot_observed_at":"2026-08-02T20:39:01.404914Z","submitted_at":"2026-05-11T11:46:57Z","title":"VISOR: A Vision-Language Model-based Test Oracle for Testing Robots","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-12T05:17:03.803350Z"},"links":{"cited_paper":"/paper/2507.17049","citing_paper":"/paper/2605.10408"},"observation_digest":"sha256:0bfd71e6ed2477112d04c53c8129b4903b04296b16cb8aec3a424a220e633833","observation_id":"350c0deb-b586-4bfb-b836-95dc77e55612","resolution":{"observed_at":"2026-07-22T01:22:12.438932Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"cited_work":{"arxiv_id":"2507.17049","doi":"10.48550/arxiv.2507.17049","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.17049","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Homer Rich Walke, Kevin Black, Tony Z Zhao, Quan Vuong, Chongyi Zheng, Philippe Hansen- Estruch, Andre Wang He, Vivek Myers, Moo Jin Kim, Max Du, et al","venue":"ArXiv.org","work_id":"42b02538-974c-424a-8eb8-6dd828749340","year":2025},"citing_paper":{"arxiv_id":"2605.10408","last_updated":"2026-05-16T05:46:37Z","snapshot_observed_at":"2026-08-02T20:39:01.404914Z","submitted_at":"2026-05-11T11:46:57Z","title":"VISOR: A Vision-Language Model-based Test Oracle for Testing Robots","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:25.871817Z"},"links":{"cited_paper":"/paper/2507.17049","citing_paper":"/paper/2605.10408"},"observation_digest":"sha256:d7881b7264fda111472696ff21c9fd713a51720ff18a298c0145265358772a3a","observation_id":"75f3ca59-5464-47c7-bcdc-436d25a921e8","resolution":{"observed_at":"2026-07-22T01:22:12.438932Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"cited_work":{"arxiv_id":"2507.17049","doi":"10.48550/arxiv.2507.17049","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.17049","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Homer Rich Walke, Kevin Black, Tony Z Zhao, Quan Vuong, Chongyi Zheng, Philippe Hansen- Estruch, Andre Wang He, Vivek Myers, Moo Jin Kim, Max Du, et al","venue":"ArXiv.org","work_id":"42b02538-974c-424a-8eb8-6dd828749340","year":2025},"citing_paper":{"arxiv_id":"2606.00053","last_updated":"2026-05-16T08:52:32Z","snapshot_observed_at":"2026-08-09T15:25:10.703437Z","submitted_at":"2026-05-16T08:52:32Z","title":"VLAMotor: Test-Guided Enhancement of Vision-Language-Action Models via Agent-BasedData Synthesis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T19:18:54.458849Z"},"links":{"cited_paper":"/paper/2507.17049","citing_paper":"/paper/2606.00053"},"observation_digest":"sha256:dc946a32bf91f38fb56ac99408a24798c7bccc8650d729eff00b15df8648b63c","observation_id":"629e1668-b984-471f-a964-c54734cb6d19","resolution":{"observed_at":"2026-07-22T01:22:12.438932Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"cited_work":{"arxiv_id":"2507.17049","doi":"10.48550/arxiv.2507.17049","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.17049","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Homer Rich Walke, Kevin Black, Tony Z Zhao, Quan Vuong, Chongyi Zheng, Philippe Hansen- Estruch, Andre Wang He, Vivek Myers, Moo Jin Kim, Max Du, et al","venue":"ArXiv.org","work_id":"42b02538-974c-424a-8eb8-6dd828749340","year":2025},"citing_paper":{"arxiv_id":"2606.02307","last_updated":"2026-06-01T14:27:13Z","snapshot_observed_at":"2026-08-09T21:16:28.068737Z","submitted_at":"2026-06-01T14:27:13Z","title":"FATE-VLA:Failue-aware test generation for vision-language-action models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T14:30:47.899387Z"},"links":{"cited_paper":"/paper/2507.17049","citing_paper":"/paper/2606.02307"},"observation_digest":"sha256:4de0c0ee8cdf46c409796617a5af62301cc5fa124aaf450555065a93076f0a2a","observation_id":"2cfdfdea-da6f-455b-a9c9-c6aca8308690","resolution":{"observed_at":"2026-07-22T01:22:12.438932Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"cited_work":{"arxiv_id":"2507.17049","doi":"10.48550/arxiv.2507.17049","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.17049","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Homer Rich Walke, Kevin Black, Tony Z Zhao, Quan Vuong, Chongyi Zheng, Philippe Hansen- Estruch, Andre Wang He, Vivek Myers, Moo Jin Kim, Max Du, et al","venue":"ArXiv.org","work_id":"42b02538-974c-424a-8eb8-6dd828749340","year":2025},"citing_paper":{"arxiv_id":"2606.24815","last_updated":"2026-06-23T17:00:06Z","snapshot_observed_at":"2026-08-05T15:55:37.300817Z","submitted_at":"2026-06-23T17:00:06Z","title":"MANGO: Automated Multi-Agent Test Oracle Generation for Vision-Language-Action Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-25T23:07:27.176553Z"},"links":{"cited_paper":"/paper/2507.17049","citing_paper":"/paper/2606.24815"},"observation_digest":"sha256:51ec5a4ba42e5b6814de9b7297cf28b3f3e01dad666451535df75b5daa226c49","observation_id":"cfc9ef6c-37b1-411c-9c53-4bcd6c99de85","resolution":{"observed_at":"2026-07-22T01:22:12.438932Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.17049/citation-record","integrity":"/paper/2507.17049/integrity","json":"/paper/2507.17049/citation-record.json","paper":"/paper/2507.17049"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.176126Z","title":"Human–robot interaction review and challenges on task planning and programming,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.176126Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:72b0560ac48f87d488625239e0d5f0a735e6b78d95bd7e77a116c7b09f6bffae","observation_id":"62a01c5d-0f65-4c3c-ac9c-409ba06f1ec5","resolution":{"observed_at":"2026-08-06T15:02:25.176126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.181881Z","title":"Artificial intelligence, machine learning and deep learning in advanced robotics, a review,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.181881Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:b7b80c58550ae05b9b393db2c4b8ff129a3c07984e56036d0228ad6576c6db0c","observation_id":"b84ed2fa-c095-46d7-a37b-f2c9b537752b","resolution":{"observed_at":"2026-08-06T15:02:25.181881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.187154Z","title":"Large language models for robotics: Opportunities, challenges, and perspectives,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.187154Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:99166dde45e1c493e51e5a5bd276e4de83c91e0815f2514c1a4c4d1517e0d2fa","observation_id":"69d28052-5156-417b-aba0-e62374566d13","resolution":{"observed_at":"2026-08-06T15:02:25.187154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.193919Z","title":"Gr00t n1: An open foundation model for generalist humanoid robots,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.193919Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:f91b6a4f8534c63d1d7b45c217667cf0e3d705220e3a1ef3e8b277697c70e326","observation_id":"287c2e46-8c59-402d-b319-2d201d4141d9","resolution":{"observed_at":"2026-08-06T15:02:25.193919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.199316Z","title":"π0: A vision-language-action flow model for general robot control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.199316Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:19e178a1de2563822482ecbb77037290611b8d6eb98260b50cc4bc47a2fb97c3","observation_id":"a4fafbbe-8cd5-4292-9788-18875a098e31","resolution":{"observed_at":"2026-08-06T15:02:25.199316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-06T15:02:25.206541Z","title":"Openvla: An open- source vision-language-action model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.206541Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:7d56a06ebf5b88add6f87e6767038268a435765a1aafc48d4006ff47d5e99ac1","observation_id":"db14b95d-05fb-4c56-a9bd-eeaed8337b76","resolution":{"observed_at":"2026-08-06T15:02:25.206541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-07-06T20:26:31.558337Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-06T15:02:25.211893Z","title":"Spatialvla: Exploring spatial representations for visual-language-action model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.211893Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:3652a85adf0824ac9d92a5005a9ea5c108d470d6de2ed99e1130ae7620c9c617","observation_id":"8001f525-7ca5-4371-9cc1-6f7e403c67fb","resolution":{"observed_at":"2026-08-06T15:02:25.211893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.216633Z","title":"Vlatest: Testing and evaluating vision-language-action models for robotic manip- ulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.216633Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:79613df59b839e07cc42bb2002b9b929df3f8d53db958126be43654a33881a3c","observation_id":"8c72165d-d90c-48f7-9886-6dcd64ee698d","resolution":{"observed_at":"2026-08-06T15:02:25.216633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.222418Z","title":"Valle, C","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.222418Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:c56eda7ada2751ca422324bbdb3faf4967be263e81950682765968f8ed2ddf12","observation_id":"6b2c2110-243f-444d-96e1-caa321ad3464","resolution":{"observed_at":"2026-08-06T15:02:25.222418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.227405Z","title":"Results of evaluating uncertainty and quality of visual language action-enabled robots","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.227405Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:52dd53245b0000cfe9c72cc58819b110a4a3c324291498e5d99280b39957ee5d","observation_id":"5fb152d8-51cc-48f4-9894-8ca8c9ab2426","resolution":{"observed_at":"2026-08-06T15:02:25.227405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.237870Z","title":"Gradient-based learning applied to document recognition,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.237870Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:301bf468150cc21ac256a53e5bd67ec21117b4f844c5452fb2367601be893ce4","observation_id":"c13af6c4-1305-48bd-bc4b-fa6edd95f1aa","resolution":{"observed_at":"2026-08-06T15:02:25.237870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.243730Z","title":"Imagenet classification with deep convolutional neural networks,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.243730Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:d1480495b88cb184ecae9e9df57d14f6d0f68d817c0c2a08453e542d13544d38","observation_id":"91793c17-da96-41a9-8fb4-73f9d63ea916","resolution":{"observed_at":"2026-08-06T15:02:25.243730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-06T15:02:25.249159Z","title":"Very deep convolutional networks for large-scale image recognition,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.249159Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:12fd0c20ada7a7718f1fa0918436854e65288e64d322b2661c002db42e2a683c","observation_id":"4b7574a6-a028-42aa-b202-64eecbc9a041","resolution":{"observed_at":"2026-08-06T15:02:25.249159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.254651Z","title":"Going deeper with convolutions,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.254651Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:657d6c8fb54183c147a6fe92de1d9cf2cc210eeda53c71d2dd9acb6ef19435c1","observation_id":"022a89f5-73b0-458d-85f6-9307be5c6b6e","resolution":{"observed_at":"2026-08-06T15:02:25.254651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.259847Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.259847Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:1051abcdf173872e3310419a93ba4aca7db7bccc589c39bf523b02edb92f5589","observation_id":"44a7e6d8-8f36-4cfd-830f-61052ccb050f","resolution":{"observed_at":"2026-08-06T15:02:25.259847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T15:02:25.264932Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.264932Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:78b994a3508cbb49a7964e67493ee820b3e6630b6ef731916abe6fcaeae47e18","observation_id":"def7c009-753e-4a5d-aed3-441c3fe50959","resolution":{"observed_at":"2026-08-06T15:02:25.264932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:27.325478Z","title":"Models overview - anthropic","venue":null,"work_id":"4e536b13-d265-46c3-9310-17e7210b7e43","year":2025},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.271220Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:7f0ae0e1d9f5a0e358c982945458a674bd288656f8cd9f13fdf23be28edd9a1d","observation_id":"91cdf957-9994-41d4-a638-306c7626a028","resolution":{"observed_at":"2026-08-06T15:02:27.333135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T15:02:25.275760Z","title":"Gemini: a family of highly capable multimodal models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.275760Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:f6fd10c915861506a349d74bc811ed2270995f8edba2dd6cc7a5ac3c43437977","observation_id":"44b04c97-a6ac-4c3f-bee5-01a94ede29f0","resolution":{"observed_at":"2026-08-06T15:02:25.275760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T15:02:25.280426Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.280426Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:2a4ff5b073c0c8c5fc621cfde963b766beb99f50a59b3df663f0dfe10003ab08","observation_id":"7b87cfbf-0d05-4946-921a-85355880c042","resolution":{"observed_at":"2026-08-06T15:02:25.280426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.285263Z","title":"Mistral 7b,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.285263Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:277bed1dcf8887a3a53e1b58bd282bf300b952a86f0bd9044b6df465c4187285","observation_id":"71dee6c4-9e64-4efa-8450-ec7ec82d3031","resolution":{"observed_at":"2026-08-06T15:02:25.285263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13705","last_updated":"2023-04-23T19:10:53Z","snapshot_observed_at":"2026-08-03T01:22:01.078078Z","submitted_at":"2023-04-23T19:10:53Z","title":"Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13705","snapshot_observed_at":"2026-08-06T15:02:25.289905Z","title":"Learning fine- grained bimanual manipulation with low-cost hardware,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.289905Z"},"links":{"cited_paper":"/paper/2304.13705","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:72333195dd5d41a7d04a7967b17e1deb77d7d580546034f2713ecdaddc50b4bb","observation_id":"23855042-7eec-42b6-a3d7-8d484356a1c6","resolution":{"observed_at":"2026-08-06T15:02:25.289905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-07-06T18:16:51.116432Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12213","snapshot_observed_at":"2026-08-06T15:02:25.294548Z","title":"Octo: An open-source generalist robot policy,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.294548Z"},"links":{"cited_paper":"/paper/2405.12213","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:1b95cb0b303ab1a926149bd4b4941a3a89684b2fd888c7b6da822e413b55a89c","observation_id":"90ce2579-9bac-4ed9-b9f8-59464fdbd11b","resolution":{"observed_at":"2026-08-06T15:02:25.294548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-06T15:02:25.300210Z","title":"Rt-1: Robotics transformer for real-world control at scale,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.300210Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:91f361087697767940bc2a087687347fac8079341cac45a51f383f289d98386a","observation_id":"e6d6e487-e6a4-4cc1-b060-371fb5e23c7b","resolution":{"observed_at":"2026-08-06T15:02:25.300210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:27.280192Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models: Open x-embodiment collab- oration 0,","venue":null,"work_id":"c12e0f7b-5e40-48fa-819e-a0b3fc945049","year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.305674Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:652878df8901a5599932c1308ca97fde590d6e99d6b82a0addeede2cab755663","observation_id":"d6f3d68d-7ed4-4a38-a7dc-3f3ce63c7e93","resolution":{"observed_at":"2026-08-06T15:02:27.288747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:27.250701Z","title":"Automated testing of hybrid simulink/stateflow controllers: industrial case studies,","venue":null,"work_id":"c3f78d91-5004-48ac-9f4d-df5f5098e36b","year":2017},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.310087Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:1ad6d67868f9e09291918a78bef00b73fb499bdbeabc10810e8e3707f25e6ecb","observation_id":"80aa85e2-b88b-4083-9112-0e4649389916","resolution":{"observed_at":"2026-08-06T15:02:27.262977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.314570Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.314570Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:0a80beed4eae8b546e12372d59c4aa41b766c1b7ac1c6e23ed4c0d767a2f02db","observation_id":"a60bac7a-3ded-4e5d-8962-53e0926e2182","resolution":{"observed_at":"2026-08-06T15:02:25.314570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14411","last_updated":"2024-11-14T11:59:09Z","snapshot_observed_at":"2026-07-06T19:19:24.759288Z","submitted_at":"2024-09-22T12:14:16Z","title":"Scaling Diffusion Policy in Transformer to 1 Billion Parameters for Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14411","snapshot_observed_at":"2026-08-06T15:02:25.319019Z","title":"Scaling diffusion policy in transformer to 1 billion parameters for robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.319019Z"},"links":{"cited_paper":"/paper/2409.14411","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:3043cef7a4d4f6c9ee70b5f295e1e83e9d3e4fb6f8e31b21157004dc78e86665","observation_id":"cca3b686-82b5-4148-a12f-31b1e9c9f512","resolution":{"observed_at":"2026-08-06T15:02:25.319019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:27.201424Z","title":"Sensitivity of smoothness measures to movement duration, amplitude, and arrests,","venue":null,"work_id":"05d12270-cf7e-43a0-9eb4-f07cb58e9847","year":2009},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.324070Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:45d68a9058b91052a981925000b448effc260193cd8ab4d8299bf96a3b905908","observation_id":"4a5d8a24-80b4-48e3-8b77-6561bee6d19d","resolution":{"observed_at":"2026-08-06T15:02:27.207386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:27.157408Z","title":"Systems design and implementation with jerk-optimized trajectory generation for uav calligraphy,","venue":null,"work_id":"aab5bb5a-f93a-4cb8-bc6e-c6ccac74c283","year":2015},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.329093Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:7202b6bce1fabf96579cb49416178c941cb8d543d8cf928678c6b976d18bd335","observation_id":"dda9cfe2-8329-42ed-9863-489eaab3bd42","resolution":{"observed_at":"2026-08-06T15:02:27.177224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:27.138387Z","title":"The coordination of arm movements: an ex- perimentally confirmed mathematical model,","venue":null,"work_id":"b055a257-4f16-4134-a111-10fa963ef749","year":1985},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.333794Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:a1bea3997e5eaecca96610fbe72e6d2bf3d3074970e23e333355acac819c64d8","observation_id":"413f522f-7e3c-497f-8dcd-ddaf2531e896","resolution":{"observed_at":"2026-08-06T15:02:27.144684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:27.113258Z","title":"openvla/openvla-7b · hugging face","venue":null,"work_id":"d1b5e336-1387-4c32-948f-d93c5f5e77e3","year":null},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.339295Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:39b17beaaee8b72dcf3764240dc6af51ce6b1aed446edbc86591b1f6af8ec285","observation_id":"010edda1-99be-4698-aeda-7fec291e80b9","resolution":{"observed_at":"2026-08-06T15:02:27.118436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:27.095224Z","title":"Haomingsong/lerobot-pi0-fractal · hugging face","venue":null,"work_id":"d8a6727d-b5a3-4c1d-bba0-1b272b6298a7","year":2025},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.344281Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:f0f1b2cfd6b1d931a2ca46f31885fc57ae29ee3cbdce4a6f0686117d84508ef3","observation_id":"47a8c087-f421-4fa2-8454-deacf8e72e29","resolution":{"observed_at":"2026-08-06T15:02:27.102407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:27.072052Z","title":"Haomingsong/lerobot-pi0-bridge · hugging face","venue":null,"work_id":"cbcd10a2-3f1d-4b1b-a05f-0435e052c947","year":2025},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.349095Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:9e39be657cfeb15bb20d431a7ce59b7e3ac572ec807fddc9f0de2a87def0a0dc","observation_id":"d41b1a63-d702-4b5f-8b4c-008c55ee1681","resolution":{"observed_at":"2026-08-06T15:02:27.082639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:27.049159Z","title":"Ipec-community/spatialvla-4b-mix-224- pt · hugging face","venue":null,"work_id":"1e3a5681-917e-4611-881b-8915e94cda44","year":2025},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.353540Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:cabfdad24a49bbd06907dfd960a855db456ed54dad2ceddc5f9c88d150f4e529","observation_id":"a83aa811-1686-4b37-8a34-4bb5f388d36e","resolution":{"observed_at":"2026-08-06T15:02:27.055904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05941","last_updated":"2024-05-09T17:30:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-09T17:30:16Z","title":"Evaluating Real-World Robot Manipulation Policies in Simulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05941","snapshot_observed_at":"2026-08-06T15:02:25.359107Z","title":"Evaluating real-world robot manipulation policies in simulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.359107Z"},"links":{"cited_paper":"/paper/2405.05941","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:503721f0bc3a67da6c0032c8aea56db60caaf1bd50f36514a1c784a3d4ba162a","observation_id":"8df21d1a-1ab2-477b-82cb-ff2435ce21ca","resolution":{"observed_at":"2026-08-06T15:02:25.359107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:27.032263Z","title":"Bridgedata v2: A dataset for robot learning at scale,","venue":null,"work_id":"ead0a1b3-ed67-4109-9b3a-00bdd6093a88","year":2023},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.364773Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:01e519d3d002e5e3ca740bdae308a4c7560aa7c088ff4e2bbdc1dcb96d66f00c","observation_id":"68010882-3390-4850-9a60-ea7be56d715b","resolution":{"observed_at":"2026-08-06T15:02:27.037500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:27.009415Z","title":"Cohen, Statistical power analysis for the behavioral sciences","venue":null,"work_id":"720da68e-baf9-4709-ad8d-9a7e1ae04ca5","year":2013},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.371777Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:9903218d8f5438a7bb3452dcaf87267a09b09700e782924f8ac2171f99f95e03","observation_id":"24f49ee5-ceff-47ba-a80e-32d3c79b45de","resolution":{"observed_at":"2026-08-06T15:02:27.017760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.987952Z","title":"Exploring methods for evaluating group differences on the nsse and other surveys: Are the t-test and cohen’sd indices the most appropriate choices,","venue":null,"work_id":"cf113a32-d375-4e60-8fed-488677313e9e","year":2006},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.377632Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:b03994b3981ed6c6f7e4d70ded74333dd393756b6383d5963da3c81b3c552aff","observation_id":"f4c8f997-6370-4248-ad49-8dcaf80fc1ff","resolution":{"observed_at":"2026-08-06T15:02:26.993588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.966985Z","title":"A review of uncertainty quantification in deep learning: Techniques, applications and challenges,","venue":null,"work_id":"ccdbfed6-e246-4bc0-b5a8-2f015f324be0","year":2021},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.382795Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:7527439f501e6d3b51b2ab7a56ee59828857772af95aa4d34ed4dd446fe65702","observation_id":"dc317892-969e-4f27-b138-0315662a801f","resolution":{"observed_at":"2026-08-06T15:02:26.972353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.946388Z","title":"Bayesian layers: A module for neural network uncertainty,","venue":null,"work_id":"3c004ca7-321e-4026-a288-57d8b3253726","year":2019},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.387353Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:31bdc26fefae167d7aff00364906863ab4767764c112c7e4a6eceef2b8a45a34","observation_id":"d6a2a71a-6bdd-43af-8b2a-58155900fec5","resolution":{"observed_at":"2026-08-06T15:02:26.951539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.928365Z","title":"Dropout as a bayesian approximation: Representing model uncertainty in deep learning,","venue":null,"work_id":"299f392f-e2f4-4c62-8252-e00932ac7f50","year":2016},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.392456Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:bc57a9429438cdaa8d63e4b34c109edafa097551856a3261c7be6ab716a12c4b","observation_id":"c5548e41-2626-4389-be72-e49410f074a0","resolution":{"observed_at":"2026-08-06T15:02:26.934401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.903245Z","title":"Monte carlo dropblock for mod- eling uncertainty in object detection,","venue":null,"work_id":"08628756-4161-4ae4-8917-a04e8a3f6f8a","year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.397539Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:92bd0ba2fb725ded6979a320b8e2c1a418f60fdfacd54d7351ffa8b27d6bf8a7","observation_id":"6539aa58-dff4-4b36-abe0-18c899781523","resolution":{"observed_at":"2026-08-06T15:02:26.909232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.885078Z","title":"Simple and scalable predictive uncertainty estimation using deep ensembles,","venue":null,"work_id":"533e8e06-7ced-4a58-8776-03875e0c8db6","year":2017},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.401846Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:1f3e8d7f269483f758685ebeff404fb0eaf39c4953195e57f320dd1e2aced0e4","observation_id":"bfd4ccd4-55fb-4ed2-a87f-e4d68d00adbf","resolution":{"observed_at":"2026-08-06T15:02:26.889971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.861949Z","title":"Pretrain, prompt, and transfer: Evolving digital twins for time-to-event analysis in cyber-physical systems,","venue":null,"work_id":"fb5f1057-0be1-4be6-a286-8a1d65b06356","year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.406599Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:aba892e4ea9820f5eeaeab07881972f295a38adc93380f7293f4acb010c60821","observation_id":"a9ec7641-450e-40c2-8978-9cd286ff7b0c","resolution":{"observed_at":"2026-08-06T15:02:26.868935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.844084Z","title":"Uncertainty-aware prediction validator in deep learning models for cyber-physical system data,","venue":null,"work_id":"eacf520d-2c74-401a-8486-6253bf035748","year":2022},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.411230Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:62e35f07c0dec51a4f6367ba6883bd1c6ed18830e889f50b48a3db13e5bfb3e5","observation_id":"f5cbc360-7c1e-4d12-811f-4fa3af5edabf","resolution":{"observed_at":"2026-08-06T15:02:26.850261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.815234Z","title":"Towards safe autonomous driving: Capture uncertainty in the deep neural network for lidar 3d vehicle detection,","venue":null,"work_id":"45d59806-4a56-4814-9eb3-b5487d255cb6","year":2018},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.418547Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:740973e74041005a100b60af47b837818ce2131b859f6ecf95e7c54e7b653bbe","observation_id":"e4bdcd55-2750-498d-9f74-9e016a82cbe7","resolution":{"observed_at":"2026-08-06T15:02:26.820780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.795509Z","title":"What uncertainties do we need in bayesian deep learning for computer vision?,","venue":null,"work_id":"cca69645-1826-46a7-9ef7-ace54681d981","year":2017},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.423723Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:7dd1276b46c52c9f40c2ca12ccb8254295584e9aa25d5ffa884678d9538a363b","observation_id":"7345feeb-d7e5-475b-a609-23ed42ee12c8","resolution":{"observed_at":"2026-08-06T15:02:26.803134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.775267Z","title":"Assessing the uncertainty and robustness of the laptop refurbishing software,","venue":null,"work_id":"6f9182a4-2de9-42b4-8e24-eda0bed29477","year":2025},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.428685Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:f949cfa5ed7eb42bacfc6dd7a372ef498f781a863b55578d5d10cfee5a42033e","observation_id":"cf020fe1-aba3-4664-882a-cf561b0140b1","resolution":{"observed_at":"2026-08-06T15:02:26.781253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.757168Z","title":"A survey on uncertainty quantification of large language models: Taxonomy, open research challenges, and future directions,","venue":null,"work_id":"11fedf12-1f1e-4bb2-88f5-9b1c46b2f6c7","year":2025},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.433750Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:084895027208843e2a2abb8546f5654c980a3605eee8663876f9b9b413cc6733","observation_id":"30b49a3a-d946-41e3-adb8-5a48d73c8a55","resolution":{"observed_at":"2026-08-06T15:02:26.762436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10236","last_updated":"2025-01-05T06:15:04Z","snapshot_observed_at":"2026-08-10T02:33:11.935041Z","submitted_at":"2023-07-16T08:28:04Z","title":"Look Before You Leap: An Exploratory Study of Uncertainty Measurement for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10236","snapshot_observed_at":"2026-08-06T15:02:25.438745Z","title":"Look before you leap: An exploratory study of uncertainty mea- surement for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.438745Z"},"links":{"cited_paper":"/paper/2307.10236","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:b7fc22b3ad499207f73ee1006b4df7cf880e8b315bca3ea77113e5a283c18562","observation_id":"4627834b-dcba-4186-bdec-8c6f045205fe","resolution":{"observed_at":"2026-08-06T15:02:25.438745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.734664Z","title":"A survey on evaluation of large language models,","venue":null,"work_id":"850ca71b-f1d2-4f24-a580-5f5f65979450","year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.444011Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:f5f4dfc8658f05e81c192476f77f3e8ef95b6d2fa5c9fd8f7cc7369b7b135ef5","observation_id":"b83cec83-4b58-4655-b46a-a92af58c73bb","resolution":{"observed_at":"2026-08-06T15:02:26.742086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.712098Z","title":"Larger and more instructable language models become less reliable,","venue":null,"work_id":"92573eca-4332-47a0-af0d-70635d80337c","year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.450183Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:1988a1b2b403ad70b9bd1391164fa47f99b4f485b1ed40ccf95d9d2ce3813472","observation_id":"6b45026a-6744-4906-9617-f87dc3ad9362","resolution":{"observed_at":"2026-08-06T15:02:26.718559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02649","last_updated":"2024-07-14T02:20:59Z","snapshot_observed_at":"2026-08-10T05:05:48.261230Z","submitted_at":"2024-04-03T11:21:23Z","title":"On the Importance of Uncertainty in Decision-Making with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02649","snapshot_observed_at":"2026-08-06T15:02:25.455522Z","title":"On the impor- tance of uncertainty in decision-making with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.455522Z"},"links":{"cited_paper":"/paper/2404.02649","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:e3bb72b4413ac05860ff3e637a777274b39a34782a1906115264798d03707ef6","observation_id":"659e01f3-3982-4e01-af55-67b7c7572f49","resolution":{"observed_at":"2026-08-06T15:02:25.455522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04714","last_updated":"2022-10-14T07:17:10Z","snapshot_observed_at":"2026-08-07T22:26:19.951857Z","submitted_at":"2022-10-10T14:16:01Z","title":"Uncertainty Quantification with Pre-trained Language Models: A Large-Scale Empirical Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04714","snapshot_observed_at":"2026-08-06T15:02:25.464560Z","title":"Uncertainty quantification with pre-trained language mod- els: A large-scale empirical analysis,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.464560Z"},"links":{"cited_paper":"/paper/2210.04714","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:1eb9448f9f70f63ed4fba05151a32cf38de3b34406c7b3ecdbef6bad87e225bd","observation_id":"fa64768f-9800-4881-b69c-b6db9c0639ca","resolution":{"observed_at":"2026-08-06T15:02:25.464560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.693850Z","title":"Uncertainty quantification in large language models through convex hull analysis,","venue":null,"work_id":"13c08a9a-6626-47dd-a970-bd464d60bc38","year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.469638Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:daa8c36bf4159c7c8061ea52063e7c555e033372969cb757a9b6c4b3c7c5ef77","observation_id":"dd20c6e5-96e5-4917-baaf-44493c67beef","resolution":{"observed_at":"2026-08-06T15:02:26.700167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.676900Z","title":"Generating with confidence: Uncertainty quantification for black-box large language models,","venue":null,"work_id":"dd144edc-352a-411e-a798-dc074cb85873","year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.474460Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:44617d565aa406c6ec3fd00b7c1b6adadde19afbd0ef44c00b93db7e01084269","observation_id":"e48b02cc-6705-444e-b5bd-9271b2e7b69b","resolution":{"observed_at":"2026-08-06T15:02:26.681626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.652764Z","title":"Map: Multimodal uncertainty-aware vision-language pre-training model,","venue":null,"work_id":"540b96cf-a82a-4ad3-bc8b-1c2daef31aa0","year":2023},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.479353Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:ea1c2fbb02c158a9dea71262052a7d7fcccac09271f9fdedaa608d416646cc3a","observation_id":"97b331c4-8999-4ba4-a86f-883e9ea0c42a","resolution":{"observed_at":"2026-08-06T15:02:26.658653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14660","last_updated":"2024-12-25T06:05:36Z","snapshot_observed_at":"2026-08-09T23:50:01.387063Z","submitted_at":"2024-12-19T09:10:07Z","title":"Unveiling Uncertainty: A Deep Dive into Calibration and Performance of Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":"2412.14660","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.14660","snapshot_observed_at":"2026-08-06T15:02:26.039640Z","title":"Unveiling Uncertainty: A Deep Dive into Calibration and Performance of Multimodal Large Language Models","venue":"cs.CV","work_id":"3a5b5aff-c646-41e6-a57b-77fb1e663696","year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.484624Z"},"links":{"cited_paper":"/paper/2412.14660","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:05a5b3f4fb116326db3ca596e634a7f467ca48ab7151f926b23fba2d2a4d4d43","observation_id":"abb38b43-6f4f-4061-a3fb-3923a135e040","resolution":{"observed_at":"2026-08-06T15:02:26.045778Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.634272Z","title":"Data-driven grasp synthesis—a survey,","venue":null,"work_id":"949e9197-d594-41d0-abf4-bb51221932ee","year":2013},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.490170Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:18cd380a22c3983ae3f1110346d6d869e8b62b7849c90b3af0a4aeb775a5d487","observation_id":"03a0ef53-c1b9-42a5-9b41-22358b40d29f","resolution":{"observed_at":"2026-08-06T15:02:26.639870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.09312","last_updated":"2017-08-08T21:46:24Z","snapshot_observed_at":"2026-07-06T05:35:24.598806Z","submitted_at":"2017-03-27T21:16:30Z","title":"Dex-Net 2.0: Deep Learning to Plan Robust Grasps with Synthetic Point Clouds and Analytic Grasp Metrics","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.09312","snapshot_observed_at":"2026-08-06T15:02:25.495616Z","title":"Dex-net 2.0: Deep learning to plan robust grasps with synthetic point clouds and analytic grasp metrics,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.495616Z"},"links":{"cited_paper":"/paper/1703.09312","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:acb4bcb78fb416666b7dde4cab45d6bd88a0daf5100ebfb3cd6a9552c2d84cc9","observation_id":"8d8f4100-f15e-4c05-be68-c963e8ffdc75","resolution":{"observed_at":"2026-08-06T15:02:25.495616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.503208Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.503208Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:8a8152274dc3fb05d5d84c7368def8a3333fa0ca5e52808d3af9fce2e96899fb","observation_id":"e5e53a73-289d-4d6c-b23c-c1347c0deab7","resolution":{"observed_at":"2026-08-06T15:02:25.503208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.603291Z","title":"Prob- abilistic roadmaps for path planning in high-dimensional configuration spaces,","venue":null,"work_id":"e3a59b33-2976-41a2-87e8-e46f580d6c89","year":2002},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.509185Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:1de36be70ada624dda19cc40f3d8c940cf531bf55171f9cee012a5d5265a01e1","observation_id":"a294b9ea-74e9-4b11-9323-fec0a8fceb21","resolution":{"observed_at":"2026-08-06T15:02:26.610508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.513889Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.513889Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:a8a9dc73bcbc226ac0c1dac13de9201c7451907ecf04e32d828d2fd0aac1e939","observation_id":"963506c3-c467-47e2-b81b-0fa228e8d1e3","resolution":{"observed_at":"2026-08-06T15:02:25.513889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.518311Z","title":"Microsoft coco: Common objects in context,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.518311Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:5f352db0d967184f2b787269319f760f29a7584bdd0e1630019bdbf02024b3c0","observation_id":"c78514b7-79cd-4c2b-8ae8-82e088ce71f6","resolution":{"observed_at":"2026-08-06T15:02:25.518311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.523897Z","title":"Bleu: a method for automatic evaluation of machine translation,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.523897Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:56fb2ef5f54cc1804ababdbd97f110c03379e9ba449891c288ea3ef809c07364","observation_id":"f5f2879e-1502-4010-9566-7f10c23f5180","resolution":{"observed_at":"2026-08-06T15:02:25.523897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.545980Z","title":"Rouge: A package for automatic evaluation of summaries,","venue":null,"work_id":"bde0fff6-7b0b-480a-86f4-81013407043a","year":2004},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.528616Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:b4a0512dd2b22e09892a5cafdcd0a99223e58d108b8c5ab9d67474cc2cc3be80","observation_id":"fab95913-072f-4744-b80d-8de221de90e3","resolution":{"observed_at":"2026-08-06T15:02:26.551397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05191","last_updated":"2024-10-07T16:49:16Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T16:49:16Z","title":"LADEV: A Language-Driven Testing and Evaluation Platform for Vision-Language-Action Models in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05191","snapshot_observed_at":"2026-08-06T15:02:25.533861Z","title":"Ladev: A language-driven testing and evaluation platform for vision- language-action models in robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.533861Z"},"links":{"cited_paper":"/paper/2410.05191","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:c3d7518cf0ce963dd8d1d4cd5d17095343da4a4c1f0f48fcdd094a27b471a2fb","observation_id":"69bcd1d0-9ec8-42ec-99c8-48e485ba26c2","resolution":{"observed_at":"2026-08-06T15:02:25.533861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.527641Z","title":"Arnold: A benchmark for language- grounded task learning with continuous states in realistic 3d scenes,","venue":null,"work_id":"fc898bcc-23ba-41bc-83a7-cd0f1bbe0e44","year":2023},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.539892Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:2093c214d32c8a3dcdd5a396eac2def14d476170aa10b83a5b995f6d2b9488a5","observation_id":"83fbdef2-1821-49d3-97ca-85f7c6325a90","resolution":{"observed_at":"2026-08-06T15:02:26.532558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04659","last_updated":"2023-02-09T14:24:01Z","snapshot_observed_at":"2026-08-08T14:45:35.755677Z","submitted_at":"2023-02-09T14:24:01Z","title":"ManiSkill2: A Unified Benchmark for Generalizable Manipulation Skills","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04659","snapshot_observed_at":"2026-08-06T15:02:25.546131Z","title":"Maniskill2: A unified benchmark for generalizable manipulation skills,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.546131Z"},"links":{"cited_paper":"/paper/2302.04659","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:f6e9be740d5ccda403bd87f8ca74b500334bf4cb51dfd0708e5fa91aa794f1d8","observation_id":"38139a50-5b10-46d4-8c15-cd820a5905ac","resolution":{"observed_at":"2026-08-06T15:02:25.546131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.506804Z","title":"Behavior-1k: A benchmark for embodied ai with 1,000 everyday activities and realistic simulation,","venue":null,"work_id":"dd68c2f2-d14a-4183-bebb-9a1f6888c840","year":2023},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.551530Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:e1a05050be1eddd84e12db52ce4d2fab01b03b2d647c01ec94db4f349555254b","observation_id":"5f793a18-dafb-4c6e-b3df-450f7a73f9cc","resolution":{"observed_at":"2026-08-06T15:02:26.512065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.10470","last_updated":"2021-08-25T23:42:59Z","snapshot_observed_at":"2026-07-06T11:40:56.544714Z","submitted_at":"2021-08-24T01:38:11Z","title":"Isaac Gym: High Performance GPU-Based Physics Simulation For Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.10470","snapshot_observed_at":"2026-08-06T15:02:25.556031Z","title":"Isaac gym: High performance gpu-based physics simulation for robot learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.556031Z"},"links":{"cited_paper":"/paper/2108.10470","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:0a64cee4e284f4db7da568abc8cf05854510785fe9a7a100682fce9251ef9ebe","observation_id":"f7492068-8d3c-4abf-bf32-996de8b9da0e","resolution":{"observed_at":"2026-08-06T15:02:25.556031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.484899Z","title":"Calvin: A benchmark for language-conditioned policy learning for long-horizon robot manipulation tasks,","venue":null,"work_id":"603783eb-be0d-4a4a-be3d-f472352dae2e","year":2022},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.560617Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:c17754efd4d5033c509d837dfd72824eff86a5668796a7877d63b1c8e287fde3","observation_id":"83e7bdcb-61bb-4ed2-af63-f79f26b1078e","resolution":{"observed_at":"2026-08-06T15:02:26.491096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.12293","last_updated":"2025-01-18T02:57:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-25T15:32:31Z","title":"robosuite: A Modular Simulation Framework and Benchmark for Robot Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.12293","snapshot_observed_at":"2026-08-06T15:02:25.565607Z","title":"robosuite: A modular simulation framework and benchmark for robot learning,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.565607Z"},"links":{"cited_paper":"/paper/2009.12293","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:6a27030ae72f005ac1e01ab8ff33bb75562fdf21f950ec71a2f5ef7f829e3a94","observation_id":"aea79483-0b37-4a84-84eb-6f2fd9a31b38","resolution":{"observed_at":"2026-08-06T15:02:25.565607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.462567Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learning,","venue":null,"work_id":"4f8f9660-d069-46fa-8b78-051b3388f3e5","year":2023},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.570694Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:2ca57e63925922b2723902a65d563e00ad0589f82c1b8d9e6ab8bf8ade2a9fcf","observation_id":"724c8d24-3ccb-4e60-93c0-6f3b5ff53ab5","resolution":{"observed_at":"2026-08-06T15:02:26.468077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.442823Z","title":"Palm-e: An embodied multimodal language model,","venue":null,"work_id":"82eb7d5f-0081-4e62-b609-737262b06c71","year":2023},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.575552Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:a8669a07da2d5be4e13f0f951777befd2be38f3345398939ba6f2e36665912a0","observation_id":"ec956c3c-5033-4545-bc50-0cc061e1c29e","resolution":{"observed_at":"2026-08-06T15:02:26.447829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.415325Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control,","venue":null,"work_id":"2486d144-7a9e-4f62-9360-b1f516607237","year":2023},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.582124Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:b023893e1f6d0b6047b1185cf7071c37cac47e82a3b2768939448a7be552d98f","observation_id":"f9ea9a30-c6d5-453d-b1e4-2bd6933d823a","resolution":{"observed_at":"2026-08-06T15:02:26.421977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.398605Z","title":"Prismatic vlms: Investigating the design space of visually- conditioned language models,","venue":null,"work_id":"30c07670-6244-4089-969a-43c045333654","year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.589034Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:8cb9381daa973636abd5f2bd2bacfff640b9b177ea2cafd596339bc0ddd51c46","observation_id":"6cebd2f9-62d4-4a74-ae39-ade0f2c1389e","resolution":{"observed_at":"2026-08-06T15:02:26.403903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T15:02:25.594872Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.594872Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:c29615968f17377ed420cbdaa2050748cce4fea2ba664598a4624d22b3a59ba9","observation_id":"f301ae7c-1dc6-4758-af00-5a087d3a81dd","resolution":{"observed_at":"2026-08-06T15:02:25.594872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.381653Z","title":"Sigmoid loss for language image pre-training,","venue":null,"work_id":"a13323ac-e9d3-417f-8f4a-c7716b4e7435","year":2023},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.599995Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:1e760a162e30b9e7d6ff2e963cf1864ef70228c9e6c64a451043a00a79d38a79","observation_id":"e9ccff99-1c31-45a7-ba44-5705bf5b94d0","resolution":{"observed_at":"2026-08-06T15:02:26.387257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-09T18:02:17.307812Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T15:02:25.604489Z","title":"Dinov2: Learning robust visual features without supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.604489Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:fdfcca3ce3f5f074430705b5fc8124f7d5cc972b000630ea3b80f4b4a9980762","observation_id":"7ac898b7-c2f2-42fc-9b65-3ac3fb165c3d","resolution":{"observed_at":"2026-08-06T15:02:25.604489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-06T15:02:25.609467Z","title":"Flow matching for generative modeling,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.609467Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:5443f1786d6a355670f8702dfb9d36acac2b26e24d916da20ecf1df835a7ff83","observation_id":"74f575d7-3c59-4890-b0f7-0d7a6b36b49d","resolution":{"observed_at":"2026-08-06T15:02:25.609467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14577","last_updated":"2022-09-29T06:37:26Z","snapshot_observed_at":"2026-08-07T23:47:17.083775Z","submitted_at":"2022-09-29T06:37:26Z","title":"Rectified Flow: A Marginal Preserving Approach to Optimal Transport","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14577","snapshot_observed_at":"2026-08-06T15:02:25.614268Z","title":"Rectified flow: A marginal preserving approach to optimal transport,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.614268Z"},"links":{"cited_paper":"/paper/2209.14577","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:8d1e9463c5d325576ddf2c26e249bbf0efff096269fecea701f816cc50831a82","observation_id":"a8285881-43a4-4cfa-8230-0c497656c65e","resolution":{"observed_at":"2026-08-06T15:02:25.614268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12945","last_updated":"2025-04-22T17:57:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-19T17:48:38Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12945","snapshot_observed_at":"2026-08-06T15:02:25.619175Z","title":"Droid: A large-scale in-the-wild robot manipulation dataset,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.619175Z"},"links":{"cited_paper":"/paper/2403.12945","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:fb520ecd149532eddb8ba86f35ede06ae5401dfdd2c4e14af884d57799793932","observation_id":"f62f28b3-2910-44f5-a921-a7e0a844e3ec","resolution":{"observed_at":"2026-08-06T15:02:25.619175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-08T07:16:45.596308Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-08-06T15:02:25.623802Z","title":"Paligemma: A versatile 3b vlm for transfer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.623802Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:412761d8dbe4d237144b77d46ad0608640337ba1511da293ff661702c56effdc","observation_id":"b0a168a1-466c-43a5-b767-12a9486b088c","resolution":{"observed_at":"2026-08-06T15:02:25.623802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-07-06T05:27:13.416519Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-06T15:02:25.629023Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.629023Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:fb5810a3ccfdb7b91031bf9497ab72280ce113add8c03e975d3e186ee1052fb7","observation_id":"b6b90125-5fe4-4a33-bc1a-ec7cd56a7c6d","resolution":{"observed_at":"2026-08-06T15:02:25.629023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.16668","last_updated":"2020-06-30T10:42:02Z","snapshot_observed_at":"2026-08-07T09:27:36.420559Z","submitted_at":"2020-06-30T10:42:02Z","title":"GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.16668","snapshot_observed_at":"2026-08-06T15:02:25.634608Z","title":"Gshard: Scaling giant models with conditional computation and automatic sharding,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.634608Z"},"links":{"cited_paper":"/paper/2006.16668","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:4b39b4c7f44bba1e34a76f7245ba81c9d13d5360a197a8f1d1d185974cbd2b81","observation_id":"6f471a63-a84f-4d3c-bbf5-c347a3640c16","resolution":{"observed_at":"2026-08-06T15:02:25.634608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10695","last_updated":"2024-10-21T20:01:13Z","snapshot_observed_at":"2026-07-06T19:16:23.103921Z","submitted_at":"2024-09-16T19:52:24Z","title":"Playground v3: Improving Text-to-Image Alignment with Deep-Fusion Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10695","snapshot_observed_at":"2026-08-06T15:02:25.641058Z","title":"Playground v3: Improving text-to-image alignment with deep-fusion large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.641058Z"},"links":{"cited_paper":"/paper/2409.10695","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:d419ac94abcc594efee7f1bcb5340a190650ec2ed2efa7b33bc362c4f82e917d","observation_id":"6dfb72e3-ca11-4f38-bf33-48afc8e80cc3","resolution":{"observed_at":"2026-08-06T15:02:25.641058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.365597Z","title":"Rh20t: A comprehensive robotic dataset for learning diverse 18 skills in one-shot,","venue":null,"work_id":"f7491e6b-8c2c-4a57-a62f-8a86dba9a795","year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.646305Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:1bfbd249eba88203a4b7f7e5c933bb8283d9d8cd468fac4a55c420f7afc58185","observation_id":"7469e00a-0d51-44ff-badd-f95a4a0a3b1e","resolution":{"observed_at":"2026-08-06T15:02:26.370775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03555","last_updated":"2024-12-04T18:50:42Z","snapshot_observed_at":"2026-07-06T20:01:45.826971Z","submitted_at":"2024-12-04T18:50:42Z","title":"PaliGemma 2: A Family of Versatile VLMs for Transfer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03555","snapshot_observed_at":"2026-08-06T15:02:25.653077Z","title":"Paligemma 2: A family of versatile vlms for transfer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.653077Z"},"links":{"cited_paper":"/paper/2412.03555","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:b97f839b5055f63f1d2ff1e674c2d4a6ade8fda9cab079112a7842f7cc88807a","observation_id":"85fb8032-c5e1-46e5-b637-57aa91beb341","resolution":{"observed_at":"2026-08-06T15:02:25.653077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12288","last_updated":"2023-02-23T19:13:10Z","snapshot_observed_at":"2026-07-06T14:55:15.719380Z","submitted_at":"2023-02-23T19:13:10Z","title":"ZoeDepth: Zero-shot Transfer by Combining Relative and Metric Depth","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12288","snapshot_observed_at":"2026-08-06T15:02:25.661211Z","title":"Zoedepth: Zero-shot transfer by combining relative and metric depth,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.661211Z"},"links":{"cited_paper":"/paper/2302.12288","citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:b80523e3926181a02ae7cbb3bf13c3391787a1957809dff8d882e4e3c81c3aa4","observation_id":"d6a4ea0c-90eb-44d2-a42d-96a3ffd783e9","resolution":{"observed_at":"2026-08-06T15:02:25.661211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.16315133","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:25.697138Z","title":null,"venue":null,"work_id":"8b7686ab-45c4-47b4-9da0-ec6b99adbf95","year":null},"citing_paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:25.232747Z"},"links":{"citing_paper":"/paper/2507.17049"},"observation_digest":"sha256:fc503f4fac9aaa3a2a20f8f6746fa0c8629773d48e5d3dfdf575983c990cd002","observation_id":"c0a83a41-0c70-4f0d-a03a-2263b194c9f7","resolution":{"observed_at":"2026-08-06T15:02:25.704251Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.17049","last_updated":"2026-07-21T08:27:18Z","latest_version":3,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-08T10:16:29.282120Z","submitted_at":"2025-07-22T22:15:59Z","title":"Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots"},"reference_resolution":{"displayed":91,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":2,"verified_fuzzy":41},"total_outbound_references":91},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 91 of 91 outbound references and 12 inbound Pith citation observations for arXiv:2507.17049."}