{"as_of":"2026-08-09T05:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9140cf645143e109e26bfcaf37549602918240bb5d50a1503c0d63107191fc41","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T01:11:13.774961Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.25918/citation-record","integrity":"/paper/2607.25918/integrity","json":"/paper/2607.25918/citation-record.json","paper":"/paper/2607.25918"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-01T01:11:12.643801Z","title":"X.; Tanner, J.; Vuong, Q.; Walling,A.;Wang,H.;andZhilinsky,U.2024.π 0:AVision- Language-Action Flow Model for General Robot Control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T01:11:12.643801Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2607.25918"},"observation_digest":"sha256:07cbaeec4fadf1fee977268229da6fa49145d6d8d036439424d85512ce77bfef","observation_id":"771a6031-95fa-4f67-87e2-a8eb5c7495b8","resolution":{"observed_at":"2026-08-01T01:11:12.643801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.13626","last_updated":"2025-12-26T12:19:56Z","snapshot_observed_at":"2026-07-06T22:32:42.381894Z","submitted_at":"2025-10-15T14:51:36Z","title":"LIBERO-Plus: In-depth Robustness Analysis of Vision-Language-Action Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.13626","snapshot_observed_at":"2026-08-01T01:11:12.724620Z","title":"Gao, S.; Liang, W.; Zheng, K.; Malik, A.; Ye, S.; Yu, S.; Tseng, W.-C.; Dong, Y.; Mo, K.; Lin, C.-H.; Ma, Q.; Nah, S.; Magne, L.; Xiang, J.; Xie, Y.; Zheng, R.; Niu, D.; Tan, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T01:11:12.724620Z"},"links":{"cited_paper":"/paper/2510.13626","citing_paper":"/paper/2607.25918"},"observation_digest":"sha256:4e691e0b493ab9153e5729e72de194ffddba1483fb67661aa700414ce1466c00","observation_id":"44a525a5-6ad8-420d-b7fc-b262cc13ea1f","resolution":{"observed_at":"2026-08-01T01:11:12.724620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.23856","last_updated":"2026-05-22T17:08:37Z","snapshot_observed_at":"2026-07-06T23:33:59.210165Z","submitted_at":"2026-05-22T17:08:37Z","title":"Point Tracking Improves World Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.23856","snapshot_observed_at":"2026-08-01T01:11:12.900982Z","title":"arXiv preprint arXiv:2605.23856","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T01:11:12.900982Z"},"links":{"cited_paper":"/paper/2605.23856","citing_paper":"/paper/2607.25918"},"observation_digest":"sha256:bacc6a719fcda1eaeeb90c5b03190873d91711b09062661fca5b17aebcdff5cf","observation_id":"d1967c02-21fb-4f4a-a094-7401a79f0487","resolution":{"observed_at":"2026-08-01T01:11:12.900982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11831","last_updated":"2024-10-15T17:56:32Z","snapshot_observed_at":"2026-08-03T21:35:04.144048Z","submitted_at":"2024-10-15T17:56:32Z","title":"CoTracker3: Simpler and Better Point Tracking by Pseudo-Labelling Real Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11831","snapshot_observed_at":"2026-08-01T01:11:13.043210Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T01:11:13.043210Z"},"links":{"cited_paper":"/paper/2410.11831","citing_paper":"/paper/2607.25918"},"observation_digest":"sha256:279de750825be032ea58d5a4b3024a4f1f385636d6c7864b7b0e96a624caa1f4","observation_id":"f759cb84-2386-4846-9935-86dbc41f6038","resolution":{"observed_at":"2026-08-01T01:11:13.043210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.16163","last_updated":"2026-01-22T18:09:30Z","snapshot_observed_at":"2026-08-06T02:05:52.408905Z","submitted_at":"2026-01-22T18:09:30Z","title":"Cosmos Policy: Fine-Tuning Video Models for Visuomotor Control and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.16163","snapshot_observed_at":"2026-08-01T01:11:13.085244Z","title":"arXiv:2601.16163","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T01:11:13.085244Z"},"links":{"cited_paper":"/paper/2601.16163","citing_paper":"/paper/2607.25918"},"observation_digest":"sha256:bddbed11cba72946855e575b2a069a40969264a2585c304866d336d387de297b","observation_id":"4fb3af46-9844-4937-bbcd-b3cbe7f9d656","resolution":{"observed_at":"2026-08-01T01:11:13.085244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-01T01:11:13.146510Z","title":"Kirillov, A.; Mintun, E.; Ravi, N.; Mao, H.; Rolland, C.; Gustafson, L.; Xiao, T.; Whitehead, S.; Berg, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T01:11:13.146510Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2607.25918"},"observation_digest":"sha256:fa3047a038161d8194c4bf080ccfa227be1c74ef7a03497dd1eb3d62af247089","observation_id":"3ffeb904-e736-4326-8b7e-5362dbde740f","resolution":{"observed_at":"2026-08-01T01:11:13.146510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-01T01:11:13.205998Z","title":"arXiv preprint arXiv:2304.02643","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T01:11:13.205998Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2607.25918"},"observation_digest":"sha256:67fce9791221f62c31e9dee3283d062b4390b3f47d2b82a556e2e42dadbf5841","observation_id":"d6276561-a2c7-4f6a-9c57-cff77e9f39b3","resolution":{"observed_at":"2026-08-01T01:11:13.205998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03310","last_updated":"2023-10-14T15:52:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-05T23:32:26Z","title":"LIBERO: Benchmarking Knowledge Transfer for Lifelong Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03310","snapshot_observed_at":"2026-08-01T01:11:13.270955Z","title":"Liu, Y.; Sun, P.; Li, S.; Xie, Y.; Zhang, L.; Chao, X.; Dong, S.; Chen, F.; Zhang, X.-P.; and Ding, W","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T01:11:13.270955Z"},"links":{"cited_paper":"/paper/2306.03310","citing_paper":"/paper/2607.25918"},"observation_digest":"sha256:26f2b4ef9eb7ce5ae1aa1bc4700797339d40d719e112b5bd1db76f346f37d8b5","observation_id":"540a39a4-a466-4d27-99a4-952f90a3847f","resolution":{"observed_at":"2026-08-01T01:11:13.270955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.06481","last_updated":"2026-05-07T16:06:08Z","snapshot_observed_at":"2026-08-03T04:45:05.402667Z","submitted_at":"2026-05-07T16:06:08Z","title":"OA-WAM: Object-Addressable World Action Model for Robust Robot Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.06481","snapshot_observed_at":"2026-08-01T01:11:13.343957Z","title":"Lou,Y.;Chi,X.;Zhang,X.;Qian,Z.;Li,C.;Zhang,R.;Lyu, Y.; Song, G.; Fu, C.; Xu, H.; Wang, P.; and Zhang, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T01:11:13.343957Z"},"links":{"cited_paper":"/paper/2605.06481","citing_paper":"/paper/2607.25918"},"observation_digest":"sha256:9328edbe406c0dd381f5b70fad09e743ac7c168ec8d2170a497bb907b3c28365","observation_id":"fa6fcbef-54f8-4666-9d98-31859806c2f3","resolution":{"observed_at":"2026-08-01T01:11:13.343957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19683","last_updated":"2026-04-22T17:44:56Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:05:37Z","title":"Mask World Model: Predicting What Matters for Robust Robot Policy Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.19683","snapshot_observed_at":"2026-08-01T01:11:13.411612Z","title":"Press,O.;Smith,N.A.;andLewis,M.2022.TrainShort,Test Long: Attention with Linear Biases Enables Input Length Extrapolation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T01:11:13.411612Z"},"links":{"cited_paper":"/paper/2604.19683","citing_paper":"/paper/2607.25918"},"observation_digest":"sha256:09a1660c68e69852f194f5eee8f4de0b5bffe57d75db5068e6974a264eb4738e","observation_id":"f2564b36-80ca-4f95-9f6f-d7084664454e","resolution":{"observed_at":"2026-08-01T01:11:13.411612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-01T01:11:13.471242Z","title":"arXiv:2503.20314","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T01:11:13.471242Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.25918"},"observation_digest":"sha256:4d05fdc7631c34112167af794b5319485449de784881e6315a2268c32f280b9a","observation_id":"9f4848e4-24f5-48d7-a0d5-51431ecda614","resolution":{"observed_at":"2026-08-01T01:11:13.471242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.13515","last_updated":"2026-06-11T16:02:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-11T16:02:42Z","title":"MaskWAM: Unifying Mask Prompting and Prediction for World-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.13515","snapshot_observed_at":"2026-08-01T01:11:13.569491Z","title":"Yuan, T.; Dong, Z.; Liu, Y.; and Zhao, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T01:11:13.569491Z"},"links":{"cited_paper":"/paper/2606.13515","citing_paper":"/paper/2607.25918"},"observation_digest":"sha256:3ad7d391a0303757292480c46d61db80645c2da69e3b1bbcaebdb1eef2f1cc8d","observation_id":"7e1e5aeb-e2b5-440a-a5cf-0671109db37b","resolution":{"observed_at":"2026-08-01T01:11:13.569491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.16666","last_updated":"2026-03-23T05:41:14Z","snapshot_observed_at":"2026-07-06T22:49:23.750692Z","submitted_at":"2026-03-17T15:33:43Z","title":"Fast-WAM: Do World Action Models Need Test-time Future Imagination?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.16666","snapshot_observed_at":"2026-08-01T01:11:13.658902Z","title":"Zhang, J.; Zhu, J.; Su, T.; Ma, C.; Huang, Z.; Xu, Y.; and Wang, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T01:11:13.658902Z"},"links":{"cited_paper":"/paper/2603.16666","citing_paper":"/paper/2607.25918"},"observation_digest":"sha256:32dcdb07dad2f10aa7ea6e2a130fc462bea70b0ba992bbbc30c666a47ebea9e6","observation_id":"4107d791-13a4-4417-b56f-a30e272bfcb9","resolution":{"observed_at":"2026-08-01T01:11:13.658902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10345","last_updated":"2025-06-05T21:26:08Z","snapshot_observed_at":"2026-08-02T17:44:41.340688Z","submitted_at":"2024-12-13T18:40:51Z","title":"TraceVLA: Visual Trace Prompting Enhances Spatial-Temporal Awareness for Generalist Robotic Policies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10345","snapshot_observed_at":"2026-08-01T01:11:13.774961Z","title":"Zhu,C.;Yu,R.;Feng,S.;Burchfiel,B.;Shah,P.;andGupta, A.2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T01:11:13.774961Z"},"links":{"cited_paper":"/paper/2412.10345","citing_paper":"/paper/2607.25918"},"observation_digest":"sha256:e1e1f166c381330c782cc0136317c71ace8c41496cc244fd3e002ef2ff1702ef","observation_id":"a82f0af1-b0bb-4f45-8742-5246783b6c53","resolution":{"observed_at":"2026-08-01T01:11:13.774961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01977","last_updated":"2023-11-06T05:53:08Z","snapshot_observed_at":"2026-08-07T20:30:49.785912Z","submitted_at":"2023-11-03T15:31:51Z","title":"RT-Trajectory: Robotic Task Generalization via Hindsight Trajectory Sketches","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01977","snapshot_observed_at":"2026-08-01T01:11:12.828429Z","title":"Guan,J.;Zhao,W.;Pei,Y.;Chen,Z.;Solin,A.;andKannala, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T01:11:12.828429Z"},"links":{"cited_paper":"/paper/2311.01977","citing_paper":"/paper/2607.25918"},"observation_digest":"sha256:594eef7b2d897261e96bc884067bb05a788b1386637b1d0b9c572f133f947e4e","observation_id":"b66a5f3c-618c-4a2e-8a7c-28c872ae9a23","resolution":{"observed_at":"2026-08-01T01:11:12.828429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14803","last_updated":"2025-05-04T04:28:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T12:48:40Z","title":"Video Prediction Policy: A Generalist Robot Policy with Predictive Visual Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14803","snapshot_observed_at":"2026-08-01T01:11:12.974759Z","title":"Karaev, N.; Makarov, I.; Wang, J.; Neverova, N.; Vedaldi, A.; and Rupprecht, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T01:11:12.974759Z"},"links":{"cited_paper":"/paper/2412.14803","citing_paper":"/paper/2607.25918"},"observation_digest":"sha256:0cbe036ebfea388cbb3f26fd0393d4d84996dd27ddbcc169a0bcf094805651c2","observation_id":"380c9f7e-a689-4e1b-b48e-1454cc2021e5","resolution":{"observed_at":"2026-08-01T01:11:12.974759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.08113","last_updated":"2025-08-11T15:53:23Z","snapshot_observed_at":"2026-08-07T18:09:09.035859Z","submitted_at":"2025-08-11T15:53:23Z","title":"AimBot: A Simple Auxiliary Visual Cue to Enhance Spatial Awareness of Visuomotor Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.08113","snapshot_observed_at":"2026-08-01T01:11:12.686720Z","title":"Fei,S.;Wang,S.;Shi,J.;Dai,Z.;Cai,J.;Qian,P.;Ji,L.;He, X.; Zhang, S.; Fei, Z.; Fu, J.; Gong, J.; and Qiu, X","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T01:11:12.686720Z"},"links":{"cited_paper":"/paper/2508.08113","citing_paper":"/paper/2607.25918"},"observation_digest":"sha256:a74a392a19cb4a58c420d280182a8aa9c036691eb57e21c58f25007dee61a942","observation_id":"02db98bc-4928-478c-a500-7ca6b5be480c","resolution":{"observed_at":"2026-08-01T01:11:12.686720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.06949","last_updated":"2026-02-06T18:49:43Z","snapshot_observed_at":"2026-07-06T22:44:51.126114Z","submitted_at":"2026-02-06T18:49:43Z","title":"DreamDojo: A Generalist Robot World Model from Large-Scale Human Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.06949","snapshot_observed_at":"2026-08-01T01:11:12.794759Z","title":"Gu, J.; Kirmani, S.; Wohlhart, P.; Lu, Y.; Arenas, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-01T01:11:12.794759Z"},"links":{"cited_paper":"/paper/2602.06949","citing_paper":"/paper/2607.25918"},"observation_digest":"sha256:3c0d2a648250dc53649052487108771491e5c33e9eb114ca1c951d7d449d2b6b","observation_id":"e9fffaa5-02f1-439e-b9c7-55a144751123","resolution":{"observed_at":"2026-08-01T01:11:12.794759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.25918","last_updated":"2026-07-28T16:08:50Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T22:00:20.789163Z","submitted_at":"2026-07-28T16:08:50Z","title":"DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2607.25918."}