{"as_of":"2026-08-18T16:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:03328f53fb477eaa61a3d2707ee7ae178309988989518a4b2d8baf95ef9761a5","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:26:40.671326Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T20:08:36.724196Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:39:50.503852Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-08-04T09:34:42.018214Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.14836","last_updated":"2026-06-09T10:47:44Z","snapshot_observed_at":"2026-08-15T23:50:04.432268Z","submitted_at":"2025-10-16T16:11:18Z","title":"QDepth-VLA: Quantized Depth Prediction as Auxiliary Supervision for Vision-Language-Action Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T09:34:42.018214Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2510.14836"},"observation_digest":"sha256:4f6f4873a94f03493aca47db11905fd040e112ba4eddfca14dd732d75e936cfb","observation_id":"0b94335a-12fb-41e2-90b6-d788b28cc417","resolution":{"observed_at":"2026-08-04T09:34:42.018214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2508.19958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-07-04T13:39:50.503852Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation","venue":null,"work_id":"3b763de6-a4b4-4318-82bb-4c26bfc575c5","year":2025},"citing_paper":{"arxiv_id":"2605.05714","last_updated":"2026-05-07T05:57:49Z","snapshot_observed_at":"2026-08-16T10:55:42.716340Z","submitted_at":"2026-05-07T05:57:49Z","title":"TriRelVLA: Triadic Relational Structure for Generalizable Embodied Manipulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T14:54:48.058400Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2605.05714"},"observation_digest":"sha256:a9bf26aa5cfaa06f197c9f4eeb5b578a0b51b018272c42ca35590620c7160cd9","observation_id":"1a73b8ad-194f-4d63-98fa-0d596b87ef88","resolution":{"observed_at":"2026-05-11T18:41:08.210598Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2508.19958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-07-04T13:39:50.503852Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation","venue":null,"work_id":"3b763de6-a4b4-4318-82bb-4c26bfc575c5","year":2025},"citing_paper":{"arxiv_id":"2606.00985","last_updated":"2026-05-31T03:52:53Z","snapshot_observed_at":"2026-08-13T04:05:01.754752Z","submitted_at":"2026-05-31T03:52:53Z","title":"Make Your VLA More Robust Without More Data By Interleaving Motion Planning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T17:31:55.850609Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2606.00985"},"observation_digest":"sha256:30924afda6f0faaf05b46cbdd75446fe63581647cac98a0a6641aff66b0922f7","observation_id":"2c9a56d3-070a-4b59-88fd-35e378d90c8e","resolution":{"observed_at":"2026-07-01T21:06:13.507847Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2508.19958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-07-04T13:39:50.503852Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation","venue":null,"work_id":"3b763de6-a4b4-4318-82bb-4c26bfc575c5","year":2025},"citing_paper":{"arxiv_id":"2606.05660","last_updated":"2026-06-04T03:43:09Z","snapshot_observed_at":"2026-08-17T19:42:45.060413Z","submitted_at":"2026-06-04T03:43:09Z","title":"Safe Embodied AI for Long-horizon Tasks: A Cross-layer Analysis of Robotic Manipulation","version":1},"reference_index":281,"source":"arxiv_source","source_observed_at":"2026-06-28T01:46:36.081851Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2606.05660"},"observation_digest":"sha256:0ab7244ad1f099d824a0c8432f551eb806cdf621ad6415ea2081b6a8d9ebf995","observation_id":"9e56d40f-df03-490e-9e3e-6a999e6432d0","resolution":{"observed_at":"2026-07-02T12:56:56.778622Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2508.19958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-07-04T13:39:50.503852Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation","venue":null,"work_id":"3b763de6-a4b4-4318-82bb-4c26bfc575c5","year":2025},"citing_paper":{"arxiv_id":"2606.08653","last_updated":"2026-06-07T14:41:22Z","snapshot_observed_at":"2026-08-08T02:07:04.461006Z","submitted_at":"2026-06-07T14:41:22Z","title":"FiberTune: Preserving Action-Fiber Visual Residuals in Vision-Language-Action Fine-Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T18:41:51.839543Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2606.08653"},"observation_digest":"sha256:aed1263eb1f9d27151c12c8b9fdf3f3e7c02d384d33a741d77ab521805bb3562","observation_id":"326d6b46-addc-493c-bc0a-a133440fcbd4","resolution":{"observed_at":"2026-07-02T22:37:26.704455Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2508.19958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-07-04T13:39:50.503852Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation","venue":null,"work_id":"3b763de6-a4b4-4318-82bb-4c26bfc575c5","year":2025},"citing_paper":{"arxiv_id":"2606.12403","last_updated":"2026-06-10T17:59:08Z","snapshot_observed_at":"2026-08-01T17:35:24.729614Z","submitted_at":"2026-06-10T17:59:08Z","title":"World Pilot: Steering Vision-Language-Action Models with World-Action Priors","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-27T09:40:02.137152Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2606.12403"},"observation_digest":"sha256:4ca5831fd03180ae3fbd44b98163e89a3c33fcc2a215321eb43d124caa93a388","observation_id":"d867052d-7cf1-447a-8705-3d62bf6ca167","resolution":{"observed_at":"2026-07-03T11:18:03.369410Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2508.19958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-07-04T13:39:50.503852Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation","venue":null,"work_id":"3b763de6-a4b4-4318-82bb-4c26bfc575c5","year":2025},"citing_paper":{"arxiv_id":"2606.12497","last_updated":"2026-06-10T13:26:40Z","snapshot_observed_at":"2026-08-05T05:15:21.338433Z","submitted_at":"2026-06-10T13:26:40Z","title":"$\\mu$VLA: On Recurrent Memory for Partially Observable Manipulation in VLA Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T10:50:55.866910Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2606.12497"},"observation_digest":"sha256:421bad127ece327e8e61e6a3ddd1c0c20bd609a367675215f8d072a31a92b34f","observation_id":"64bff53c-ec84-4d38-b22a-9d03d1f93a3d","resolution":{"observed_at":"2026-07-03T08:17:45.609841Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2508.19958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-07-04T13:39:50.503852Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation","venue":null,"work_id":"3b763de6-a4b4-4318-82bb-4c26bfc575c5","year":2025},"citing_paper":{"arxiv_id":"2606.21501","last_updated":"2026-06-19T14:53:40Z","snapshot_observed_at":"2026-08-10T23:41:47.312099Z","submitted_at":"2026-06-19T14:53:40Z","title":"UniviewVLA: A Unified Multiview Vision-Language-Action Model with World Modeling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T14:27:40.585782Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2606.21501"},"observation_digest":"sha256:8d7dbc81ee1683ea78554f382c0bbeee9a8a4d0eaa6340b1c903f86315f90839","observation_id":"5ce132dc-71ee-4a1d-92a7-7f5242e8912e","resolution":{"observed_at":"2026-07-04T06:29:37.526893Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2508.19958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-07-04T13:39:50.503852Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation","venue":null,"work_id":"3b763de6-a4b4-4318-82bb-4c26bfc575c5","year":2025},"citing_paper":{"arxiv_id":"2606.27144","last_updated":"2026-06-25T15:17:43Z","snapshot_observed_at":"2026-08-16T22:46:17.446189Z","submitted_at":"2026-06-25T15:17:43Z","title":"PAMAE: Phase-Aware-MoE Action Experts Towards Reliable Flow-Matching Vision-Language-Action Policies","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T05:04:32.182271Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2606.27144"},"observation_digest":"sha256:2e56cb2e1e08eef949cc01af5fa0c686750e92fed9c071db3a84ac130a568482","observation_id":"70027506-ebf8-41b6-8701-a825e9bce7d0","resolution":{"observed_at":"2026-07-04T13:39:50.505359Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2508.19958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-07-04T13:39:50.503852Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation","venue":null,"work_id":"3b763de6-a4b4-4318-82bb-4c26bfc575c5","year":2025},"citing_paper":{"arxiv_id":"2607.00351","last_updated":"2026-07-01T02:48:17Z","snapshot_observed_at":"2026-08-08T13:08:24.574087Z","submitted_at":"2026-07-01T02:48:17Z","title":"Unleashing More Actions via Action Compositional Training for VLA Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-02T12:04:18.028417Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2607.00351"},"observation_digest":"sha256:40ec9aa5db4813e89b317604147183ae55f3ed20649dda8508e3c8681689b0e1","observation_id":"d927d3cf-f43c-4730-94f8-54e85c6e4e5f","resolution":{"observed_at":"2026-07-02T12:06:55.279468Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-08-07T20:08:36.724196Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05970","last_updated":"2026-08-06T12:46:13Z","snapshot_observed_at":"2026-08-13T21:35:35.159682Z","submitted_at":"2026-08-06T12:46:13Z","title":"SkillMemo: Expert-guided Skill Memory Framework for Compositional Embodied Manipulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T20:08:36.724196Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2608.05970"},"observation_digest":"sha256:c8aef879c13cbb2411b55252f19c244d7fd2bb336f88c2e597767dbe9b8232ca","observation_id":"980ced80-b03a-45c9-b69e-f2068dbe297b","resolution":{"observed_at":"2026-08-07T20:08:36.724196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.19958/citation-record","integrity":"/paper/2508.19958/integrity","json":"/paper/2508.19958/citation-record.json","paper":"/paper/2508.19958"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:41.060575Z","title":null,"venue":null,"work_id":"a4d9fb5b-5d88-4dc5-9025-e309689ffeb6","year":2024},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.561996Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:a68c2c2fd7194d772c9318785c2358df1681d0060dfbcead25ec3f28cac728a3","observation_id":"e5baeca8-8910-40b4-acd3-ebb463c300a3","resolution":{"observed_at":"2026-08-05T15:26:41.065143Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:41.045279Z","title":"Dalal, T","venue":null,"work_id":"7fcfbab9-7f82-4e92-94a4-9bd9cf3de4ec","year":2024},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.567126Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:2821b0c1161621e0eed8f77a51c6ea35497719935876ddebc8735e94739405eb","observation_id":"91818e99-30e6-47dc-ba5c-8f234b81f87d","resolution":{"observed_at":"2026-08-05T15:26:41.050953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:41.031155Z","title":"Brohan, N","venue":null,"work_id":"148fd593-c01c-4545-8f72-cbe4e6d2f36d","year":2023},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.571883Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:916bb902e866ac1bc1d7af7fd76d8bbc418a4653dd10b599f4c01303cb57bc30","observation_id":"3644d08c-ae44-4a98-86fa-d61f762d537a","resolution":{"observed_at":"2026-08-05T15:26:41.035607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:41.017176Z","title":"Zitkovich, T","venue":null,"work_id":"13da19e9-317f-47a4-b082-a407f0abf5e1","year":2023},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.576645Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:b1e8de1ced05b30c270ae7f649071785a6874ea4a649f07ebc2ad80ee3cf0ae7","observation_id":"9149219a-14e6-47eb-a4ef-6b61aa17c6b9","resolution":{"observed_at":"2026-08-05T15:26:41.021876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:41.002379Z","title":null,"venue":null,"work_id":"f4c64cde-e477-4720-9e07-57c31ae4e79a","year":2024},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.581938Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:325a496fde57832319b497d2f0e860fb4888d454dbda51d545537095fb88c673","observation_id":"631e2a7f-5ab3-440d-ab29-43a6206e3272","resolution":{"observed_at":"2026-08-05T15:26:41.007045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09268","last_updated":"2025-02-14T01:51:57Z","snapshot_observed_at":"2026-08-13T15:35:38.190506Z","submitted_at":"2025-02-13T12:29:50Z","title":"GEVRM: Goal-Expressive Video Generation Model For Robust Visual Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09268","snapshot_observed_at":"2026-08-05T15:26:40.586348Z","title":"Zhang, P","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.586348Z"},"links":{"cited_paper":"/paper/2502.09268","citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:b98f760f959b045bf4ff0568f0eb043723242d1840c6b7c6ac1a4fe6d814835a","observation_id":"087655ed-d631-4ecc-90a3-cb09436d4293","resolution":{"observed_at":"2026-08-05T15:26:40.586348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.988355Z","title":null,"venue":null,"work_id":"d0c740e1-caa5-4dfa-b149-b947374e770f","year":2025},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.592027Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:fb5aa46cf34845365dabe6a73a8dee51fbc179d1392fa6a02c6225838eb28e6e","observation_id":"1b352a98-be6f-4cbb-95ff-46de6ddd70c0","resolution":{"observed_at":"2026-08-05T15:26:40.992912Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.974472Z","title":null,"venue":null,"work_id":"fbef7a5e-41d0-4fe4-ab42-66a3f8892813","year":2025},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.595991Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:7af3b037011c8605288a74278444bcf369ffa74df4d018a82dc3da561960bac3","observation_id":"0cfb882c-e0fa-4066-a901-e8c1102f8c52","resolution":{"observed_at":"2026-08-05T15:26:40.978960Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14795","last_updated":"2025-02-21T08:09:14Z","snapshot_observed_at":"2026-08-18T03:21:18.321656Z","submitted_at":"2025-02-20T18:17:11Z","title":"Humanoid-VLA: Towards Universal Humanoid Control with Visual Integration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14795","snapshot_observed_at":"2026-08-05T15:26:40.600207Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.600207Z"},"links":{"cited_paper":"/paper/2502.14795","citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:6ce2438bd412254abb8c9ee47b3d03e061d71e0a6f82dea3b6ef1b3c3c11694a","observation_id":"d0d88848-270b-485f-ab49-ca18a92f2907","resolution":{"observed_at":"2026-08-05T15:26:40.600207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.960441Z","title":null,"venue":null,"work_id":"a2003dc6-8130-4d19-8739-cd8cd14f6b61","year":2025},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.604602Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:4e55f6bf313256916bef1e412361d93a7f15c4dac4cf17f98df329de7cb1986e","observation_id":"ba6bac17-d4ce-45f2-b80a-252e9ca690bf","resolution":{"observed_at":"2026-08-05T15:26:40.964874Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06782","last_updated":"2025-08-10T06:09:58Z","snapshot_observed_at":"2026-08-17T08:56:24.817214Z","submitted_at":"2024-12-09T18:59:18Z","title":"CARP: Visuomotor Policy Learning via Coarse-to-Fine Autoregressive Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06782","snapshot_observed_at":"2026-08-05T15:26:40.608665Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.608665Z"},"links":{"cited_paper":"/paper/2412.06782","citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:7f4082b43f9056b82a933c3a54ca5127fc8833315724501c863139a27eb9aba8","observation_id":"cbd469a7-e88f-4f30-be27-ac30c1732ccc","resolution":{"observed_at":"2026-08-05T15:26:40.608665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.945653Z","title":"Konidaris, S","venue":null,"work_id":"c792c880-c352-4285-b4b6-f2b74440f36a","year":2012},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.619107Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:70c89fc9b2050fc421377a98ef8aae7240162400e73e9d08ce1ada906468292a","observation_id":"5d71e6d9-c2d6-47c0-ac3b-b1f15c22e5a9","resolution":{"observed_at":"2026-08-05T15:26:40.950162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12631","last_updated":"2025-02-21T06:56:09Z","snapshot_observed_at":"2026-08-16T12:57:25.721333Z","submitted_at":"2025-02-18T08:22:20Z","title":"Score-Based Diffusion Policy Compatible with Reinforcement Learning via Optimal Transport","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12631","snapshot_observed_at":"2026-08-05T15:26:40.623243Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.623243Z"},"links":{"cited_paper":"/paper/2502.12631","citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:c471f38ce2fe65955eabf1e931d7c561dbfcdea7efbf68e651f70d2797201dbc","observation_id":"55828c2b-7009-468e-9dc1-0683367824ab","resolution":{"observed_at":"2026-08-05T15:26:40.623243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.931063Z","title":"Reuss, Omer Erding Ya&Smurlu, F","venue":null,"work_id":"3500e792-755d-4b40-b50d-cba2ca9bf8cc","year":2024},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.627613Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:943370d447d907891b079e3da5f408f8d834bf0519c3e5a83cfaa582bcfabf05","observation_id":"bc1b11ac-c20b-4807-96e2-32c0edf53021","resolution":{"observed_at":"2026-08-05T15:26:40.936294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.916272Z","title":null,"venue":null,"work_id":"5b443e60-13f0-4783-b83d-5d08fdc30094","year":2016},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.632702Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:c13fab60bce9f77c658f6a092861a39f3cea6720296f1fd3d1290a76d3f60230","observation_id":"fa48a7bc-67f7-4436-906f-1d2f9c0a7ad0","resolution":{"observed_at":"2026-08-05T15:26:40.920684Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.901058Z","title":"Radford, J","venue":null,"work_id":"3e5f306d-e07d-49f8-b36e-a71f36c31a37","year":2021},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.636789Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:e5bece874bcf719a16175f47f64840a3236e15e69c601944709db99d20346c6d","observation_id":"ede7feda-fc01-4e44-9b30-025433728507","resolution":{"observed_at":"2026-08-05T15:26:40.905683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.883793Z","title":null,"venue":null,"work_id":"72f8fbc5-054d-4d1b-8133-db4c9f94fb1c","year":2024},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.641019Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:24dd0341af1111051b6605c9b9430e126472352702f5f25de71893a1d9b0962b","observation_id":"ef11b348-566a-412d-a3a9-2aa31de4589c","resolution":{"observed_at":"2026-08-05T15:26:40.890068Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.868310Z","title":null,"venue":null,"work_id":"ee4aeaf7-010c-4eab-a4f8-e0b310d15311","year":2022},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.645098Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:83e2ba47717ece1619358ddf2ce569889d843a681c66cde50ac34befa17a38dd","observation_id":"e2538010-d873-4d64-b3a4-42db4ec58928","resolution":{"observed_at":"2026-08-05T15:26:40.872704Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.853856Z","title":"Perez, F","venue":null,"work_id":"4ebe8d95-905e-4053-bc98-735c9114fbd8","year":2018},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.649252Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:c3a06f946bbe945f8a2080f137423a05902e4e77eaef71985da59fd50c3f9f81","observation_id":"cce3582b-0204-4e52-95be-ba6485354f7a","resolution":{"observed_at":"2026-08-05T15:26:40.858333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.838946Z","title":null,"venue":null,"work_id":"1192e121-dd76-4469-bd03-4b622639d524","year":2024},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.653430Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:81e26a04400a7ba79d031cce83862823278b95b6c05067327062ab4f660c5ed7","observation_id":"2ac93a40-1187-42b2-af68-4a40cd4976d7","resolution":{"observed_at":"2026-08-05T15:26:40.844020Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.824303Z","title":"Zhang, Y","venue":null,"work_id":"9c6b6b0f-e552-4dd0-986a-8150120583ff","year":2025},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.657619Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:ac36baf0ed329c1a63eb47b80c54d8af57f40a73b50255703c8f4e9e1c13fb8a","observation_id":"0ddd2c31-4e8c-41ed-a16c-49b954a77db9","resolution":{"observed_at":"2026-08-05T15:26:40.828700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14058","last_updated":"2026-02-13T02:05:15Z","snapshot_observed_at":"2026-08-17T09:33:59.536762Z","submitted_at":"2024-12-18T17:07:20Z","title":"What Matters in Building Vision-Language-Action Models for Generalist Robots","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14058","snapshot_observed_at":"2026-08-05T15:26:40.661829Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.661829Z"},"links":{"cited_paper":"/paper/2412.14058","citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:31541cf951768d97ff8edfdfc58ba88f7c2852a13c8e0f4bb3f442dae8a5369e","observation_id":"05320bbe-34ca-4a1e-a85c-b9294b827571","resolution":{"observed_at":"2026-08-05T15:26:40.661829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19622","last_updated":"2025-02-01T11:17:14Z","snapshot_observed_at":"2026-08-16T14:05:25.612830Z","submitted_at":"2024-03-28T17:42:54Z","title":"RH20T-P: A Primitive-Level Robotic Dataset Towards Composable Generalization Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19622","snapshot_observed_at":"2026-08-05T15:26:40.666459Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.666459Z"},"links":{"cited_paper":"/paper/2403.19622","citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:e6f9e765e3ab375c9e784acb86a5d76ec5f9210abfeef5b05caaf290c8a68010","observation_id":"2f9875a4-1add-431b-8f49-7694506bc9c4","resolution":{"observed_at":"2026-08-05T15:26:40.666459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.808282Z","title":"Put the red block or 1) cal into the drawer","venue":null,"work_id":"06f68cdd-b4ac-46c9-bb9b-724c0645da34","year":2022},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.671326Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:0a9c45c16f149c24c81855dedc84d71550324d49537b6ba8d33c5de6d0029b70","observation_id":"7d539a0b-bd4d-4db2-90ff-76fb24303360","resolution":{"observed_at":"2026-08-05T15:26:40.813926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07864","last_updated":"2025-03-01T08:57:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-10T12:33:46Z","title":"RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07864","snapshot_observed_at":"2026-08-05T15:26:40.613924Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":367,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.613924Z"},"links":{"cited_paper":"/paper/2410.07864","citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:8f561a80ac69a264ee950b2da2c9e9a881312e83841e9816cb2be7c654a38455","observation_id":"627d1f8e-40e2-4a48-8f1f-776840e74917","resolution":{"observed_at":"2026-08-05T15:26:40.613924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-17T17:22:47.119340Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 11 inbound Pith citation observations for arXiv:2508.19958."}