{"as_of":"2026-08-10T08:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:251a24d957ac5a7464a0862ad613643ded5b5e03756ac229e5e93c696639d848","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":37,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T00:10:44.901421Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T10:39:44.761069Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2412.02818","last_updated":"2026-05-18T18:24:46Z","snapshot_observed_at":"2026-07-06T20:01:14.493111Z","submitted_at":"2024-12-03T20:34:51Z","title":"RoboMD: Uncovering Robot Vulnerabilities through Semantic Potential Fields","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-23T07:49:37.878395Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2412.02818"},"observation_digest":"sha256:589c1c0cab31dbd549cb543922a087ef2a3f21772fa7f2f788b74562ee11977c","observation_id":"f1928238-7e14-485a-ae60-158c80c394f0","resolution":{"observed_at":"2026-05-23T07:52:43.792346Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-08-08T00:03:16.434203Z","title":"Aha: A vision- language-model for detecting and reasoning over failures in robotic manipulation,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08643","last_updated":"2025-02-18T16:45:59Z","snapshot_observed_at":"2026-08-09T11:31:44.840528Z","submitted_at":"2025-02-12T18:57:22Z","title":"A Real-to-Sim-to-Real Approach to Robotic Manipulation with VLM-Generated Iterative Keypoint Rewards","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T00:03:16.434203Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2502.08643"},"observation_digest":"sha256:ce390d55d56b8501cf7e7822f29a4f4b86996a5cad49e5e72bb3014c63460567","observation_id":"96103a68-ba73-4019-9b32-e39a14f13af7","resolution":{"observed_at":"2026-08-08T00:03:16.434203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-08-07T11:54:55.670715Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01182","last_updated":"2025-07-08T20:18:16Z","snapshot_observed_at":"2026-08-09T08:46:08.835639Z","submitted_at":"2025-06-01T21:33:36Z","title":"Humanoid World Models: Open World Foundation Models for Humanoid Robotics","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:55.670715Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2506.01182"},"observation_digest":"sha256:a60a85a82b9e815b218861ab33704e11d57624bf8a02900cb50793b6281fbaba","observation_id":"f7e39c4c-805e-46ad-9455-65c91d22ed33","resolution":{"observed_at":"2026-08-07T11:54:55.670715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-08-07T06:00:06.318287Z","title":"Aha: A vision-language-model for detecting and reasoning over failures in robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06570","last_updated":"2026-07-18T21:30:42Z","snapshot_observed_at":"2026-08-07T23:49:53.323472Z","submitted_at":"2025-06-06T22:50:39Z","title":"Unsupervised Discovery of Failure Taxonomies from Deployment Logs","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:06.318287Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2506.06570"},"observation_digest":"sha256:7d3f88a379a9d7a14562079968d036311d2fcc7ed33848317fef554c8c6fc2fe","observation_id":"68d689ad-07fa-4e28-a035-36e81a2aa6b9","resolution":{"observed_at":"2026-08-07T06:00:06.318287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2507.16815","last_updated":"2025-09-18T16:26:53Z","snapshot_observed_at":"2026-08-03T17:16:24.219569Z","submitted_at":"2025-07-22T17:59:46Z","title":"ThinkAct: Vision-Language-Action Reasoning via Reinforced Visual Latent Planning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-19T03:18:14.655384Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2507.16815"},"observation_digest":"sha256:d7623ef1462205b25efd1d7392fb3881a2bfda20a361b223c505dd1bc382c9c8","observation_id":"53b6622a-ec89-4f06-b696-9d0c5ad90052","resolution":{"observed_at":"2026-05-19T03:22:00.920996Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-08-05T20:31:07.266881Z","title":"R.; Tian, S.; Yuan, W.; Krishna, R.; Fox, D.; Mandlekar, A.; and Guo, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10416","last_updated":"2025-08-14T07:39:26Z","snapshot_observed_at":"2026-08-08T02:28:41.150453Z","submitted_at":"2025-08-14T07:39:26Z","title":"CorrectNav: Self-Correction Flywheel Empowers Vision-Language-Action Navigation Model","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T20:31:07.266881Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2508.10416"},"observation_digest":"sha256:311f2ab9f7133c3fc39295e2645cc88940850bf4bf713b76c7806ce6956e6f35","observation_id":"8fd88f4a-8463-4a14-a1da-911de1cac2b2","resolution":{"observed_at":"2026-08-05T20:31:07.266881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2509.21723","last_updated":"2026-05-01T09:02:01Z","snapshot_observed_at":"2026-08-08T16:18:02.148047Z","submitted_at":"2025-09-26T00:47:39Z","title":"VLBiMan: Vision-Language Anchored One-Shot Demonstration Enables Generalizable Bimanual Robotic Manipulation","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T13:47:30.943307Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2509.21723"},"observation_digest":"sha256:a43652b9309959272ab4c9a2eadf46ff75bbb9ec27ed4b4171136762234e9f4e","observation_id":"dd565390-c395-4cfa-95b1-1838669dd2e8","resolution":{"observed_at":"2026-05-18T13:51:25.724281Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-08-04T12:54:48.718813Z","title":"Aha: A vision- language-model for detecting and reasoning over failures in robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.01642","last_updated":"2026-07-07T04:25:23Z","snapshot_observed_at":"2026-08-08T01:28:25.872832Z","submitted_at":"2025-10-02T03:48:07Z","title":"FailSafe: Reasoning and Recovery from Failures in Vision-Language-Action Models","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T12:54:48.718813Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2510.01642"},"observation_digest":"sha256:fb66dbf2c90a44f99ec4f6203a87ee4970b95e5bca3e690c604c7dcc6df3f8f2","observation_id":"fe5ed932-e569-422c-b95e-db679ad4fb73","resolution":{"observed_at":"2026-08-04T12:54:48.718813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2510.19268","last_updated":"2026-04-15T17:36:28Z","snapshot_observed_at":"2026-07-06T22:33:48.680749Z","submitted_at":"2025-10-22T05:57:23Z","title":"Hierarchical DLO Routing with Reinforcement Learning and In-Context Vision-language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-18T05:21:09.184463Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2510.19268"},"observation_digest":"sha256:62609422fcee91e4663a3540996c887a7bd0fea0e24f451dd94668d9506c2f4c","observation_id":"ea083a00-9a09-49eb-97c6-5e43ee2f5c86","resolution":{"observed_at":"2026-05-18T05:22:24.017565Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2512.22519","last_updated":"2026-04-24T04:40:53Z","snapshot_observed_at":"2026-07-06T22:40:12.666349Z","submitted_at":"2025-12-27T08:31:25Z","title":"Clutter-Robust Vision-Language-Action Models through Object-Centric and Geometry Grounding","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T19:28:35.576661Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2512.22519"},"observation_digest":"sha256:b24e9e52edc083902f807a029fb50418577117903f32f86b7b282e896097f093","observation_id":"dded9421-d077-45db-9516-e792a8dcc1b9","resolution":{"observed_at":"2026-05-16T19:31:13.391790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-08-03T03:56:47.148395Z","title":"R., Tian, S., Yuan, W., Krishna, R., Fox, D., Mandlekar, A., and Guo, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.06508","last_updated":"2026-05-25T03:56:37Z","snapshot_observed_at":"2026-08-03T03:56:46.452714Z","submitted_at":"2026-02-06T08:57:55Z","title":"World-VLA-Loop: Closed-Loop Learning of Video World Model and VLA Policy","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T03:56:47.148395Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2602.06508"},"observation_digest":"sha256:9bf58d3b4485e865db764800c019ad79a6b1fba2174d35a2f13b1d91895a2a3a","observation_id":"50a45739-040c-4aa6-b625-8662acf61da4","resolution":{"observed_at":"2026-08-03T03:56:47.148395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-08-02T21:43:07.335584Z","title":"R., Tian, S., Yuan, W., Krishna, R., Fox, D., Mandlekar, A., and Guo, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.19313","last_updated":"2026-07-22T22:14:13Z","snapshot_observed_at":"2026-08-02T21:43:05.758047Z","submitted_at":"2026-02-22T19:25:48Z","title":"TOPReward: Token Probabilities as Hidden Zero-Shot Rewards for Robotics","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T21:43:07.335584Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2602.19313"},"observation_digest":"sha256:26fbbc24cefea060c050d27ad685a765ae7011ef6b45dfacd2085fa9ecbf0979","observation_id":"64148cd7-9b4b-41ab-a37a-39d90ba96a6b","resolution":{"observed_at":"2026-08-02T21:43:07.335584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2604.07395","last_updated":"2026-04-08T08:01:35Z","snapshot_observed_at":"2026-07-06T22:55:37.787732Z","submitted_at":"2026-04-08T08:01:35Z","title":"A Physical Agentic Loop for Language-Guided Grasping with Execution-State Monitoring","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T18:34:06.704114Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2604.07395"},"observation_digest":"sha256:dd2362fb7363c693bb6926c1dfa19930d4d0774788d8e3d0dd53706e57e30efa","observation_id":"2e053378-b919-41b9-a37e-b9aef4cc7a12","resolution":{"observed_at":"2026-05-11T00:20:55.402020Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2604.19839","last_updated":"2026-04-21T09:11:00Z","snapshot_observed_at":"2026-07-06T23:06:26.596990Z","submitted_at":"2026-04-21T09:11:00Z","title":"Environmental Understanding Vision-Language Model for Embodied Agent","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T03:36:52.685696Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2604.19839"},"observation_digest":"sha256:2a0acb74178ef5a5a6a1f850f8a32d60c92284bea491a5776b12858f087a08a0","observation_id":"873ec7a8-30f8-41be-b19b-b854b4688bed","resolution":{"observed_at":"2026-05-11T12:26:11.105245Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2605.01191","last_updated":"2026-05-28T05:36:20Z","snapshot_observed_at":"2026-08-08T16:03:51.103968Z","submitted_at":"2026-05-02T02:10:54Z","title":"Sentinel-VLA: A Metacognitive VLA Model with Active Status Monitoring for Dynamic Reasoning and Error Recovery","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-09T15:14:03.865035Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2605.01191"},"observation_digest":"sha256:ce390769b8cda43096754a507e2736c83194c2f16c95423d5b2ec9aee7780d04","observation_id":"ba2e66be-fa3a-4bc6-a2de-5be30884c6a3","resolution":{"observed_at":"2026-05-11T16:46:04.841959Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2605.01191","last_updated":"2026-05-28T05:36:20Z","snapshot_observed_at":"2026-08-08T16:03:51.103968Z","submitted_at":"2026-05-02T02:10:54Z","title":"Sentinel-VLA: A Metacognitive VLA Model with Active Status Monitoring for Dynamic Reasoning and Error Recovery","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-01T01:10:48.111387Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2605.01191"},"observation_digest":"sha256:b13a60b13fb9c997cc2ce73e1722655efe4ab90665b8b46a7ff1a8b15a6cc015","observation_id":"f128c689-32bb-4302-85bf-02e66a2deb50","resolution":{"observed_at":"2026-07-01T13:05:45.092375Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2605.08434","last_updated":"2026-05-12T15:21:07Z","snapshot_observed_at":"2026-07-06T23:20:38.385189Z","submitted_at":"2026-05-08T19:57:11Z","title":"Failing Forward: Adaptive Failure-Informed Learning for Vision-Language-Action Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-12T00:53:11.881352Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2605.08434"},"observation_digest":"sha256:27fd003953097078067562a33ba9e36b6bb2f8ea24b9ae46a4608c3a01a20a1e","observation_id":"38f46265-0151-465e-9ce1-0816252a8c93","resolution":{"observed_at":"2026-05-12T08:36:26.691714Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2605.08434","last_updated":"2026-05-12T15:21:07Z","snapshot_observed_at":"2026-07-06T23:20:38.385189Z","submitted_at":"2026-05-08T19:57:11Z","title":"Failing Forward: Adaptive Failure-Informed Learning for Vision-Language-Action Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-13T06:37:32.737230Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2605.08434"},"observation_digest":"sha256:60dfb64cfabf412d264bd39786a2ca6a34c9c18c838e65465966d213394cac13","observation_id":"c4e7f509-e905-4a46-89d6-b64c5e3a8ff9","resolution":{"observed_at":"2026-05-13T06:42:26.482901Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2605.11750","last_updated":"2026-05-12T08:27:16Z","snapshot_observed_at":"2026-07-06T23:23:34.924221Z","submitted_at":"2026-05-12T08:27:16Z","title":"DreamAvoid: Critical-Phase Test-Time Dreaming to Avoid Failures in VLA Policies","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-13T05:58:45.128070Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2605.11750"},"observation_digest":"sha256:4a2cbd21a17b1d5fab623d2a3019f6b4268b1423529639793743676460bc59ef","observation_id":"4f2a80ed-d0ec-439f-850c-da00477a8281","resolution":{"observed_at":"2026-05-13T06:02:23.353956Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2605.11951","last_updated":"2026-05-12T11:00:45Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:00:45Z","title":"From Reaction to Anticipation: Proactive Failure Recovery through Agentic Task Graph for Robotic Manipulation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T05:14:45.978785Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2605.11951"},"observation_digest":"sha256:fa70c8edd3faeade57fffade99e677cd629c9d134b74129c7b39f3f0846af8b7","observation_id":"8043fcc3-df64-43d3-9262-a69d78bc7d5e","resolution":{"observed_at":"2026-05-13T05:17:18.275471Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2605.16056","last_updated":"2026-05-15T15:21:39Z","snapshot_observed_at":"2026-08-02T09:17:44.455772Z","submitted_at":"2026-05-15T15:21:39Z","title":"Health-Conditioned Vision-Language-Action Models for Malfunction-Aware Robot Control","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T18:18:33.018240Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2605.16056"},"observation_digest":"sha256:adf2b3f711f4032f1d458abc735b77bdb547e27e1d6430d70fe23ca4ed3a28df","observation_id":"88e0bad2-02d9-4c96-b5c1-4b0e8acf76dc","resolution":{"observed_at":"2026-05-20T18:18:52.420148Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2605.29605","last_updated":"2026-05-28T08:42:12Z","snapshot_observed_at":"2026-07-06T23:39:01.234601Z","submitted_at":"2026-05-28T08:42:12Z","title":"VLAConf: Calibrated Task-Success Confidence for Vision-Language-Action Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T06:53:56.750481Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2605.29605"},"observation_digest":"sha256:b30aa4929c476f4ed1588f128186f9a450c20a83dbacf7abcd5d2d203d663893","observation_id":"3c904262-2115-404f-b9e1-0558daebb122","resolution":{"observed_at":"2026-06-29T14:13:30.514020Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2606.03385","last_updated":"2026-06-02T09:29:03Z","snapshot_observed_at":"2026-07-06T23:43:40.769504Z","submitted_at":"2026-06-02T09:29:03Z","title":"Grasp-Then-Plan with Failure Attribution: A Closed Two-Stage Framework for Precise and Generalizable Robotic Manipulation","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-06-28T09:37:58.434897Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2606.03385"},"observation_digest":"sha256:4fa223465b2fde875b5ac7f55c40274798fc24acd9d385a31c37da3bb1e6c921","observation_id":"205f7350-8ae2-435e-8597-b1b9c5d5e613","resolution":{"observed_at":"2026-07-02T03:56:34.488923Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2606.08508","last_updated":"2026-06-07T08:18:11Z","snapshot_observed_at":"2026-08-01T03:26:40.185550Z","submitted_at":"2026-06-07T08:18:11Z","title":"ActProbe: Action-Space Probe for Early Failure Detection of Generative Robot Policies","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T18:35:24.934570Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2606.08508"},"observation_digest":"sha256:fb84b7a75f2a30c782b2201d471ab8695ea0827616af7dcf88d39036b12a4355","observation_id":"130146db-c909-4032-8762-fdc5ffe0804b","resolution":{"observed_at":"2026-07-02T22:57:26.064895Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2606.08542","last_updated":"2026-06-07T09:49:40Z","snapshot_observed_at":"2026-08-06T08:30:27.988052Z","submitted_at":"2026-06-07T09:49:40Z","title":"When Video Misreads: Closed-Loop Distillation of Reading Heuristics for Exploratory Manipulation Trace QA","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T18:26:47.393632Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2606.08542"},"observation_digest":"sha256:f77876286eb8d4df8c2f64c13d37a0c052ccfdd49e34f0e6bf932729dcfe865b","observation_id":"cea7307a-dc03-44fc-aa7e-6c6c92ad09e1","resolution":{"observed_at":"2026-07-02T23:07:27.114587Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2606.18328","last_updated":"2026-06-16T17:59:57Z","snapshot_observed_at":"2026-08-02T08:25:02.445404Z","submitted_at":"2026-06-16T17:59:57Z","title":"Recover, Discover, Plan: Learning Skills and Concepts from Robot Failures","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-27T00:13:58.572795Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2606.18328"},"observation_digest":"sha256:da35004f394f33ff1daa2c91395854f089a4a46fc649fb1c51805bbaaadd9c86","observation_id":"b4d21191-762b-4631-a510-4fa3a65c580b","resolution":{"observed_at":"2026-07-03T21:48:59.192112Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2606.19598","last_updated":"2026-06-17T21:02:47Z","snapshot_observed_at":"2026-08-07T03:02:32.233459Z","submitted_at":"2026-06-17T21:02:47Z","title":"Fail-RAG : A Retrieval Augmented Generation Informed Framework for Robot Failure Identification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T20:25:49.498851Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2606.19598"},"observation_digest":"sha256:a3697e07705538aed2064f459263e223f6475421c1e8d7478725f0cd61831024","observation_id":"5c9c5390-6390-4921-af45-545cbac409d9","resolution":{"observed_at":"2026-07-04T01:19:21.469430Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2606.21572","last_updated":"2026-06-19T16:14:12Z","snapshot_observed_at":"2026-07-06T23:56:31.454439Z","submitted_at":"2026-06-19T16:14:12Z","title":"Robot Critics that Sweat the Small Stuff","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:37.905355Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2606.21572"},"observation_digest":"sha256:672441c305c70fc352fa59c294fabe4ece2bfa5f7310365573d80d3bdd4195f7","observation_id":"8a06b629-349b-4afc-88c4-7902fd6181ee","resolution":{"observed_at":"2026-07-04T06:39:37.248074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2606.23085","last_updated":"2026-06-22T09:32:28Z","snapshot_observed_at":"2026-08-05T05:46:25.463258Z","submitted_at":"2026-06-22T09:32:28Z","title":"Foresight: Failure Detection for Long-Horizon Robotic Manipulation with Action-Conditioned World Model Latents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T08:43:06.983870Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2606.23085"},"observation_digest":"sha256:e0040cb2203457e6dcbe95ffcc05070c3d3f573b3eea05ecc40d0e5d30220bbf","observation_id":"94360049-8322-4889-8cce-a0df74aa394b","resolution":{"observed_at":"2026-07-04T10:39:44.762616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2410.00371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-04T10:39:44.761069Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","venue":null,"work_id":"46d7e088-65ee-4c38-aa0d-a98eb767ce6f","year":2024},"citing_paper":{"arxiv_id":"2607.01088","last_updated":"2026-07-01T15:45:08Z","snapshot_observed_at":"2026-08-02T11:41:51.446909Z","submitted_at":"2026-07-01T15:45:08Z","title":"ROSA: A Robotics Foundation Model Serving System for Robot Factories","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-02T11:11:39.584755Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2607.01088"},"observation_digest":"sha256:bbb5b3f3e179de384592505d661d950d1fef27b54125ed5b230ea8f0109354cb","observation_id":"e6079092-b7bb-402c-9741-ce8535afe41e","resolution":{"observed_at":"2026-07-02T11:16:52.706391Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-08-01T17:08:12.717524Z","title":"Aha: A vision- language-model for detecting and reasoning over failures in robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17769","last_updated":"2026-07-20T10:02:18Z","snapshot_observed_at":"2026-08-08T13:18:17.054774Z","submitted_at":"2026-07-20T10:02:18Z","title":"From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T17:08:12.717524Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2607.17769"},"observation_digest":"sha256:cd555a0db7463f084f729343a178e545500213a61b5c8ba566ca4ce0321ee2b3","observation_id":"48b162a2-7a9b-4816-8fe4-ce3e25d567e5","resolution":{"observed_at":"2026-08-01T17:08:12.717524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-08-01T08:12:02.895123Z","title":"AHA: A vision-language-model for detecting and reasoning over failures in robotic manipulation.arXiv preprint arXiv:2410.00371, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21227","last_updated":"2026-07-23T11:43:31Z","snapshot_observed_at":"2026-08-07T11:00:18.499970Z","submitted_at":"2026-07-23T11:43:31Z","title":"FORGE-plus: Force-Budgeted Recovery for Contact-Rich Assembly with a Frozen LLM Supervisor","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T08:12:02.895123Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2607.21227"},"observation_digest":"sha256:56e5f41d5aa30361bc773c432ad649701056fb3becd353659aa7987f4a2c57e1","observation_id":"e401117b-7edc-4164-9fb2-a190a0fbb6af","resolution":{"observed_at":"2026-08-01T08:12:02.895123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-30T15:24:45.015831Z","title":"R.; Tian, S.; Yuan, W.; Krishna, R.; Fox, D.; Mandlekar, A.; and Guo, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23704","last_updated":"2026-07-29T11:00:47Z","snapshot_observed_at":"2026-08-08T04:45:17.632035Z","submitted_at":"2026-07-26T14:56:04Z","title":"LabRobFail: A Benchmark for Robotic Failure Analysis in Chemical Self-driving Laboratory","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-07-30T15:24:45.015831Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2607.23704"},"observation_digest":"sha256:f9dae279f3a9d551c838979133fd8c0e3e8fa44409bd3006279aaf695da0b439","observation_id":"7a94d36d-b984-4d91-ace9-274767d1ecf9","resolution":{"observed_at":"2026-07-30T15:24:45.015831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-07-31T06:18:55.449101Z","title":"Aha: a vision-language-model for detecting and reasoning over failures in robotic manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24744","last_updated":"2026-07-27T17:59:58Z","snapshot_observed_at":"2026-08-06T17:57:37.442251Z","submitted_at":"2026-07-27T17:59:58Z","title":"Data Pyramid for Embodied Manipulation","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-07-31T06:18:55.449101Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2607.24744"},"observation_digest":"sha256:8184d59d2a165b63e05ae07fcb51edba7a121972965bb7a7de8220991bc37ad0","observation_id":"17fe0119-d03b-4e45-9994-6ee05d923a1f","resolution":{"observed_at":"2026-07-31T06:18:55.449101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-08-04T19:45:29.223894Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01851","last_updated":"2026-08-03T07:58:35Z","snapshot_observed_at":"2026-08-07T23:22:57.641630Z","submitted_at":"2026-08-03T07:58:35Z","title":"Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-04T19:45:29.223894Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2608.01851"},"observation_digest":"sha256:08b1049eba42cf9b0dab86ed77dcad52873b1e2ca05634a586a60cbef1080ccb","observation_id":"d9e2f3d2-0a29-4fd4-bb5a-94e551352474","resolution":{"observed_at":"2026-08-04T19:45:29.223894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-08-04T10:39:55.298965Z","title":"Aha: A vision- language-model for detecting and reasoning over failures in robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02257","last_updated":"2026-08-03T14:03:26Z","snapshot_observed_at":"2026-08-09T03:51:35.418523Z","submitted_at":"2026-08-03T14:03:26Z","title":"Learning Panorama-Aware VLA for Mobile Manipulation with Whole-Body Teleoperation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T10:39:55.298965Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2608.02257"},"observation_digest":"sha256:33e077b2cdebd400f2d6841cb814e23f7ffbfa1c9193355c2fe81179525a9507","observation_id":"918c3416-cee8-4987-a731-305b7f267211","resolution":{"observed_at":"2026-08-04T10:39:55.298965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-08-08T00:10:44.901421Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04246","last_updated":"2026-08-04T21:57:03Z","snapshot_observed_at":"2026-08-09T01:57:01.578076Z","submitted_at":"2026-08-04T21:57:03Z","title":"SAFECAST: Robust Failure Detection for VLA Policies with Contrast-Set Training and Calibration","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T00:10:44.901421Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2608.04246"},"observation_digest":"sha256:5658d6535857643fef70c7cc89c4322ffc8d5bbe9736d73e028039d9e0006b43","observation_id":"209c0759-16f9-414e-86a3-12027c894049","resolution":{"observed_at":"2026-08-08T00:10:44.901421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.00371/citation-record","integrity":"/paper/2410.00371/integrity","json":"/paper/2410.00371/citation-record.json","paper":"/paper/2410.00371"},"outbound":[],"paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-07T23:49:16.921379Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 37 inbound Pith citation observations for arXiv:2410.00371."}