{"as_of":"2026-08-20T00:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e487ccc94d86ad349a402036f01fb6cc77e24c8bb59e7cffe2ef22db3d05105f","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:20:10.182935Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09448/citation-record","integrity":"/paper/2608.09448/integrity","json":"/paper/2608.09448/citation-record.json","paper":"/paper/2608.09448"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-14T04:20:10.061498Z","title":"RT-2: Vision-language-action models transfer web knowledge to robotic control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.061498Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:ebe50cad2da6fbbf63255908cc41ac727c96839d41953489827ee79d7afd780b","observation_id":"8af9adce-2dc7-4e0f-a2e0-de686139b078","resolution":{"observed_at":"2026-08-14T04:20:10.061498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-16T21:53:14.144225Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-14T04:20:10.066611Z","title":"OpenVLA: An open-source vision-language-action model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.066611Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:bb95b214ef6207979364966dbe68bd3c3985ac0d5e95b0bda0efb85bd8992e94","observation_id":"d540df9c-ad99-4d5c-96e0-59a3c2b72b4c","resolution":{"observed_at":"2026-08-14T04:20:10.066611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-08-16T17:53:54.636855Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-14T04:20:10.070360Z","title":"π0: A vision-language-action flow model for general robot control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.070360Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:50eeec3956ee803944cf847504b1dd4f94d18344cea874951d1ce1aa987eb353","observation_id":"26e91fc9-82ca-4b9b-9fff-3067fc20a1fc","resolution":{"observed_at":"2026-08-14T04:20:10.070360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11757","last_updated":"2026-04-13T17:30:01Z","snapshot_observed_at":"2026-07-06T23:00:03.762376Z","submitted_at":"2026-04-13T17:30:01Z","title":"StarVLA-$\\alpha$: Reducing Complexity in Vision-Language-Action Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.11757","snapshot_observed_at":"2026-08-14T04:20:10.075185Z","title":"StarVLA-α: Reducing complexity in vision-language-action systems,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.075185Z"},"links":{"cited_paper":"/paper/2604.11757","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:16ebaf984c0bb4b5fc884ad4009ba589889fa39204a707dab5c0d39e93735a92","observation_id":"2ca6b3fb-0633-4398-a319-1160854f3757","resolution":{"observed_at":"2026-08-14T04:20:10.075185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:10.079556Z","title":"Test-time training with self-supervision for generalization under distribution shifts,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.079556Z"},"links":{"citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:400ba000e6f9b39c35e338b0b803aa3623613c6af1efafc41d8ffe59e184bf57","observation_id":"142c2801-48ca-4b6f-89bd-e6c2793c91f7","resolution":{"observed_at":"2026-08-14T04:20:10.079556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.03127","last_updated":"2026-06-02T04:10:39Z","snapshot_observed_at":"2026-08-17T01:11:56.796853Z","submitted_at":"2026-06-02T04:10:39Z","title":"TTT-VLA: Test-Time Latent Prompt Optimization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.03127","snapshot_observed_at":"2026-08-14T04:20:10.083589Z","title":"TTT-VLA: Test-time latent prompt optimization for vision-language-action models,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.083589Z"},"links":{"cited_paper":"/paper/2606.03127","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:d66ceb9bb2a1d0e22b685b9c47fbd9237f05faff81763a51e15f08341b036a34","observation_id":"c96c18bf-6874-429e-9c42-f13a36a879de","resolution":{"observed_at":"2026-08-14T04:20:10.083589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-14T04:20:10.087933Z","title":"RT-1: Robotics transformer for real-world control at scale,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.087933Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:cbd634441cbfe362deb492ce226e46cf8d3a658e161a0b28aa4e39c44379b683","observation_id":"2386901c-2bbe-4a1a-a360-a391b682802d","resolution":{"observed_at":"2026-08-14T04:20:10.087933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-14T04:20:10.091425Z","title":"Open X-Embodiment: Robotic learning datasets and RT-X models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.091425Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:f0902893bde49d0625f98666a649ceba00a84d9d26f56fd72b822f025d91e3f9","observation_id":"530d3316-935d-443c-987c-d563c8395ad2","resolution":{"observed_at":"2026-08-14T04:20:10.091425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-08-14T08:22:11.295012Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12213","snapshot_observed_at":"2026-08-14T04:20:10.095016Z","title":"Octo: An open-source generalist robot policy,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.095016Z"},"links":{"cited_paper":"/paper/2405.12213","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:fdf869035e15c7b0b6d8047861749d5ab4125cd5a5e433d3b94432964cac825e","observation_id":"30546ba1-37a7-4189-8d63-03e6ee442367","resolution":{"observed_at":"2026-08-14T04:20:10.095016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-08-15T13:40:01.739055Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09985","snapshot_observed_at":"2026-08-14T04:20:10.099143Z","title":"V-JEPA 2: Self-supervised video models enable understanding, prediction and planning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.099143Z"},"links":{"cited_paper":"/paper/2506.09985","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:ffef51206397aa5994d1aae2dbe29d833c1d78451b0fcddf6ef5adac0ef062ed","observation_id":"c55b179d-bf12-4861-8f3e-2fd4017756b1","resolution":{"observed_at":"2026-08-14T04:20:10.099143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:10.102975Z","title":"FutureVLA: Joint visuomotor prediction for vision-language-action model,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.102975Z"},"links":{"citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:1ec2056ff14c6ed7c84a71774bd15c5f932d6f9bba64d4103eba6e7a8b8f5ec0","observation_id":"6da57c20-49e1-477d-978a-5d5fa303f2b6","resolution":{"observed_at":"2026-08-14T04:20:10.102975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21998","last_updated":"2026-03-22T15:37:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T17:07:43Z","title":"Causal World Modeling for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.21998","snapshot_observed_at":"2026-08-14T04:20:10.106868Z","title":"Causal world modeling for robot control,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.106868Z"},"links":{"cited_paper":"/paper/2601.21998","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:8b681b98baa1e28d96156aa015e8c66bf2b1099ebf6a685109f725712fe9542a","observation_id":"ce1a0f9c-d55e-4cf2-b557-b0fc1de32300","resolution":{"observed_at":"2026-08-14T04:20:10.106868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10726","last_updated":"2021-03-18T17:58:01Z","snapshot_observed_at":"2026-08-16T06:30:33.794820Z","submitted_at":"2020-06-18T17:55:28Z","title":"Tent: Fully Test-time Adaptation by Entropy Minimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10726","snapshot_observed_at":"2026-08-14T04:20:10.111381Z","title":"Tent: Fully test-time adaptation by entropy minimization,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.111381Z"},"links":{"cited_paper":"/paper/2006.10726","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:5e1a09389d3afe698280a9de0fe001a649b3476f7083d12a08e40aa41a0d262f","observation_id":"3864ed74-e1cd-412c-9e55-137c536323b3","resolution":{"observed_at":"2026-08-14T04:20:10.111381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13591","last_updated":"2022-03-25T11:42:02Z","snapshot_observed_at":"2026-08-16T17:11:50.468674Z","submitted_at":"2022-03-25T11:42:02Z","title":"Continual Test-Time Domain Adaptation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.13591","snapshot_observed_at":"2026-08-14T04:20:10.116348Z","title":"Continual test-time domain adaptation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.116348Z"},"links":{"cited_paper":"/paper/2203.13591","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:f28783d5233ffc9a208b62823b79cbaaac219610ec708ec9d284aac602454524","observation_id":"0474f3cf-5908-4785-bf6f-568a8b5bc9c1","resolution":{"observed_at":"2026-08-14T04:20:10.116348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02610","last_updated":"2022-05-31T03:02:41Z","snapshot_observed_at":"2026-08-16T17:08:58.731514Z","submitted_at":"2022-04-06T06:39:40Z","title":"Efficient Test-Time Model Adaptation without Forgetting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02610","snapshot_observed_at":"2026-08-14T04:20:10.120811Z","title":"Efficient test-time model adaptation without forgetting,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.120811Z"},"links":{"cited_paper":"/paper/2204.02610","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:723b75339f5b8413b2dfcc57874d785322bf3acb0b02000e79c41b6b1b8449b0","observation_id":"b7301b84-b894-4346-aabe-264d0dd3b191","resolution":{"observed_at":"2026-08-14T04:20:10.120811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:10.124848Z","title":"Test-time training on nearest neighbors for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.124848Z"},"links":{"citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:60dfa0839c90ad705e6b2d406e0d4b95092a836082390c8506679bcb47d8dd5c","observation_id":"3a9b7b0c-04b0-4e5b-ba74-3074f4b90492","resolution":{"observed_at":"2026-08-14T04:20:10.124848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:10.128394Z","title":"Test-time prompt tuning for zero-shot generalization in vision-language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.128394Z"},"links":{"citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:ac2e5e4c89e0b836fd8cd35f2d1ff6a435163dd2610e9a21a0aa2fb4cf58485a","observation_id":"c8ff7b68-ae3a-4b23-85b7-2c44caf3f6e7","resolution":{"observed_at":"2026-08-14T04:20:10.128394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08215","last_updated":"2026-06-04T07:39:54Z","snapshot_observed_at":"2026-08-14T19:26:58.794738Z","submitted_at":"2026-05-06T11:21:25Z","title":"Test-Time Training for Visual Foresight Vision-Language-Action Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08215","snapshot_observed_at":"2026-08-14T04:20:10.131763Z","title":"Test-time training for visual foresight vision-language- action models,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.131763Z"},"links":{"cited_paper":"/paper/2605.08215","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:e24f6bb5137d64708ce48e55e1f54fca0aaebd09e7bebf75f88b69338f180963","observation_id":"74e0c7a2-7a77-41cc-9f93-ccf8bb5c8277","resolution":{"observed_at":"2026-08-14T04:20:10.131763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.06748","last_updated":"2026-04-07T03:39:20Z","snapshot_observed_at":"2026-08-16T10:45:52.781857Z","submitted_at":"2026-01-11T01:51:30Z","title":"On-the-Fly VLA Adaptation via Test-Time Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.06748","snapshot_observed_at":"2026-08-14T04:20:10.135778Z","title":"On-the-fly VLA adaptation via test-time reinforcement learning,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.135778Z"},"links":{"cited_paper":"/paper/2601.06748","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:097a5e49a3f671ba7e17cc99f02773eb8f32859a14a916f4fb31fd066d28f2fd","observation_id":"510231cf-0c98-45f7-aa44-d460ec712d80","resolution":{"observed_at":"2026-08-14T04:20:10.135778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12952","last_updated":"2024-01-17T22:41:29Z","snapshot_observed_at":"2026-08-18T12:56:00.263505Z","submitted_at":"2023-08-24T17:41:20Z","title":"BridgeData V2: A Dataset for Robot Learning at Scale","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12952","snapshot_observed_at":"2026-08-14T04:20:10.139974Z","title":"BridgeData V2: A dataset for robot learning at scale,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.139974Z"},"links":{"cited_paper":"/paper/2308.12952","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:3c366e027974a1988f5c7ed6cbab6fe35c14f1df522a5557a534593226cdf4a7","observation_id":"c8e325b8-d7f1-4bc1-84d0-fd1450d1f2ac","resolution":{"observed_at":"2026-08-14T04:20:10.139974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05941","last_updated":"2024-05-09T17:30:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-09T17:30:16Z","title":"Evaluating Real-World Robot Manipulation Policies in Simulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05941","snapshot_observed_at":"2026-08-14T04:20:10.143939Z","title":"Evaluating real-world robot manipulation policies in simulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.143939Z"},"links":{"cited_paper":"/paper/2405.05941","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:c6beed2d5c78b5a9d252221314c0169a0baa2d951ac1e28dccc8ac71cc572e15","observation_id":"66a2923f-3800-4a3a-8592-9cac3a8b9aa3","resolution":{"observed_at":"2026-08-14T04:20:10.143939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-08-17T12:53:34.218587Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-14T04:20:10.148239Z","title":"SpatialVLA: Exploring spatial representations for vision-language-action model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.148239Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:2cb5644df5e43b27a0ef8641d41b7dd807ba32effcc8bb9ce68769180a60fec6","observation_id":"c1169a87-6de4-474d-9f74-4b48ae8ff20a","resolution":{"observed_at":"2026-08-14T04:20:10.148239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:10.151970Z","title":"Magma: A foundation model for multimodal AI agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.151970Z"},"links":{"citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:c4c46748bd2f804299e29a683c47cf47372ab0342c46f0854817cf0d388c7678","observation_id":"8f862a66-1709-4dc3-9993-1b13d72ec0b7","resolution":{"observed_at":"2026-08-14T04:20:10.151970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14058","last_updated":"2026-02-13T02:05:15Z","snapshot_observed_at":"2026-08-17T09:33:59.536762Z","submitted_at":"2024-12-18T17:07:20Z","title":"What Matters in Building Vision-Language-Action Models for Generalist Robots","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14058","snapshot_observed_at":"2026-08-14T04:20:10.156291Z","title":"Towards generalist robot policies: What matters in building vision-language-action models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.156291Z"},"links":{"cited_paper":"/paper/2412.14058","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:173f438d7bb0e00add3eda96a0986eedc67fabfe9371e002b30b0df6ef68debf","observation_id":"6c4d3083-627a-4d0e-8965-24c2f5a6c559","resolution":{"observed_at":"2026-08-14T04:20:10.156291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:10.160193Z","title":"InstructVLA: Vision-language-action instruction tuning from understanding to manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.160193Z"},"links":{"citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:25aa7aa249a5cacf4f7b85ab8510310ffd88c6f11327a0afc2f6a526035b9de7","observation_id":"fb691054-b0e9-497f-bad4-6b78624c3ea9","resolution":{"observed_at":"2026-08-14T04:20:10.160193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19650","last_updated":"2024-11-29T12:06:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-29T12:06:03Z","title":"CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19650","snapshot_observed_at":"2026-08-14T04:20:10.163707Z","title":"CogACT: A foundational vision-language-action model for synergizing cognition and action in robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.163707Z"},"links":{"cited_paper":"/paper/2411.19650","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:fac1cdbf62d1a9ceb0c306c7e644277b2108541aa175f0ba1280a974a0a4d1b6","observation_id":"23ea9715-6dcc-478d-915c-f39e9ed88c6c","resolution":{"observed_at":"2026-08-14T04:20:10.163707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:10.167723Z","title":"ThinkAct: Vision-language-action reasoning via reinforced visual latent planning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.167723Z"},"links":{"citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:357d986bbf174a51457849d3d996300c299ee6e21c78f97235ebc139dc36cf1a","observation_id":"22fd791a-005a-4cb2-868b-be8ac04b3595","resolution":{"observed_at":"2026-08-14T04:20:10.167723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:10.171516Z","title":"TraceVLA: Visual trace prompting enhances spatial-temporal awareness for generalist robotic policies,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.171516Z"},"links":{"citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:27a0a7ce177b5e7030048fa6f2f8736fdf8be1ec28b67a31af6b5b419e04b590","observation_id":"5d16377d-b58c-4042-83c1-c9121d8308ff","resolution":{"observed_at":"2026-08-14T04:20:10.171516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11974","last_updated":"2024-12-17T14:12:56Z","snapshot_observed_at":"2026-08-12T14:28:34.481864Z","submitted_at":"2024-12-16T16:58:28Z","title":"Emma-X: An Embodied Multimodal Action Model with Grounded Chain of Thought and Look-ahead Spatial Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.11974","snapshot_observed_at":"2026-08-14T04:20:10.174839Z","title":"Emma-X: An embodied multimodal action model with grounded chain of thought and look-ahead spatial reasoning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.174839Z"},"links":{"cited_paper":"/paper/2412.11974","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:7324a12e8d73fa3934e04457605dfefbfdb7823e7868fd83bbe40ca9450c608a","observation_id":"4578b24d-9fc7-49a8-816b-69b7f5d34e25","resolution":{"observed_at":"2026-08-14T04:20:10.174839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:10.179001Z","title":"FAST: Efficient action tokenization for vision-language-action models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.179001Z"},"links":{"citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:3ba1aff9bb9a528599e8bbc31cd4f8f1da2e6e2601c15835cbbe7d42ff34f388","observation_id":"6f28aa92-404e-4f33-81b5-df9c888393a7","resolution":{"observed_at":"2026-08-14T04:20:10.179001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-14T04:20:10.182935Z","title":"GR00T N1: An open foundation model for generalist humanoid robots,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T04:20:10.182935Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2608.09448"},"observation_digest":"sha256:8e7c4c6393cf594cb5f6cad9409f1a121bcc70a66318378da1e21177931314c3","observation_id":"d29cd0b6-3f15-494c-adcd-f4730ffa8fd7","resolution":{"observed_at":"2026-08-14T04:20:10.182935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.09448","last_updated":"2026-08-12T10:16:02Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-15T23:09:39.189698Z","submitted_at":"2026-08-10T11:22:54Z","title":"VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2608.09448."}