{"as_of":"2026-08-12T07:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a376eb8cb52b705aa7cbd42999583160f8f65a30ebe08cc41f37cc99188c0d19","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:41:43.912335Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06799/citation-record","integrity":"/paper/2608.06799/integrity","json":"/paper/2608.06799/citation-record.json","paper":"/paper/2608.06799"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.10125","last_updated":"2026-03-01T08:24:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-11T09:13:10Z","title":"Ctrl-World: A Controllable Generative World Model for Robot Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.10125","snapshot_observed_at":"2026-08-10T20:41:43.805937Z","title":"Ctrl-World: A controllable generative world model for robot manipulation.arXiv preprint arXiv:2510.10125,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.805937Z"},"links":{"cited_paper":"/paper/2510.10125","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:1ffc8c1991cfd958450c7c08cd25c5c100e017adf974a7f903c76aeaa0ccf82e","observation_id":"c0ab036a-f408-45a3-84df-45276b015293","resolution":{"observed_at":"2026-08-10T20:41:43.805937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-10T20:41:43.810581Z","title":"World models.arXiv preprint arXiv:1803.10122, 2(3):440,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.810581Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:502aa9751db06f082dcde32482cf60a72124184c44051c18b57c709eb897f8f1","observation_id":"ff021cfc-2268-44d6-ab40-4170ef71fb38","resolution":{"observed_at":"2026-08-10T20:41:43.810581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.00080","last_updated":"2026-04-30T14:35:31Z","snapshot_observed_at":"2026-08-04T20:02:32.182599Z","submitted_at":"2026-04-30T14:35:31Z","title":"World Model for Robot Learning: A Comprehensive Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.00080","snapshot_observed_at":"2026-08-10T20:41:43.819932Z","title":"World model for robot learning: A comprehensive survey.arXiv preprint arXiv:2605.00080,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.819932Z"},"links":{"cited_paper":"/paper/2605.00080","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:213f8d57c9fa7aba0961a5542a7e80c62c8f3ec236878c3d1698c629828ba1d3","observation_id":"3b91ce94-53c9-4e2e-976c-7b955099b888","resolution":{"observed_at":"2026-08-10T20:41:43.819932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-08-10T20:41:43.824533Z","title":"GAIA-1: A generative world model for autonomous driving.arXiv preprint arXiv:2309.17080,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.824533Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:e224e9e12416abe8a5b42da86cf4355b87009e89edef621101a94d230581c53d","observation_id":"dcd1afdb-0f74-4bc3-9709-a984eff04d8b","resolution":{"observed_at":"2026-08-10T20:41:43.824533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.18375","last_updated":"2026-06-23T16:50:09Z","snapshot_observed_at":"2026-08-02T07:17:06.028384Z","submitted_at":"2026-06-16T18:23:23Z","title":"PAIWorld: A 3D-Consistent World Foundation Model for Robotic Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.18375","snapshot_observed_at":"2026-08-10T20:41:43.829126Z","title":"PAIWorld: A 3D-consistent world foundation model for robotic manipulation.arXiv preprint arXiv:2606.18375,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.829126Z"},"links":{"cited_paper":"/paper/2606.18375","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:e703510d2e15491d78547789ade6061740f675a4b11599b7bd4d9ee6dcebcfe8","observation_id":"5f92cb20-abac-4f4a-8b4b-aac060782734","resolution":{"observed_at":"2026-08-10T20:41:43.829126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:41:44.676170Z","title":"Robots pre-train robots: Manipulation-centric robotic representation from large-scale robot datasets","venue":null,"work_id":"9ba3c4f0-5dae-4e58-b57f-22583b0f49fd","year":2025},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.833447Z"},"links":{"citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:3ef8109c022117aa9fe5e97503b5818c8a825580a1ceb37889eb75f5dcda0bfe","observation_id":"1fc97768-26d9-43a6-be44-ef0a5a4f0c8e","resolution":{"observed_at":"2026-08-10T20:41:44.680657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.01711","last_updated":"2026-05-31T14:16:48Z","snapshot_observed_at":"2026-08-04T12:55:01.902418Z","submitted_at":"2025-10-02T06:41:22Z","title":"Contrastive Representation Regularization for Vision-Language-Action Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.01711","snapshot_observed_at":"2026-08-10T20:41:43.838078Z","title":"Contrastive representation regularization for vision-language-action models.arXiv preprint arXiv:2510.01711,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.838078Z"},"links":{"cited_paper":"/paper/2510.01711","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:69a723dc1d6bcb8bff8406d8f5eafd8dac5a59dacd4dc3e97bd8dac4f88318d1","observation_id":"7ea2f6d8-a26b-4621-8ca7-0e96105cb8e0","resolution":{"observed_at":"2026-08-10T20:41:43.838078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.07278","last_updated":"2026-05-08T05:43:33Z","snapshot_observed_at":"2026-08-01T00:55:28.214005Z","submitted_at":"2026-05-08T05:43:33Z","title":"Predictive but Not Plannable: RC-aux for Latent World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.07278","snapshot_observed_at":"2026-08-10T20:41:43.842384Z","title":"Predictive but not plannable: RC-aux for latent world models.arXiv preprint arXiv:2605.07278,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.842384Z"},"links":{"cited_paper":"/paper/2605.07278","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:a346de1cdf6b5c14152248a178739b3172f27a4b678fcaea0670b05ca633068c","observation_id":"af3f1281-6c88-4867-b91b-fddb33a74a6e","resolution":{"observed_at":"2026-08-10T20:41:43.842384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.05635","last_updated":"2025-11-04T12:01:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-07T17:59:44Z","title":"Genie Envisioner: A Unified World Foundation Platform for Robotic Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.05635","snapshot_observed_at":"2026-08-10T20:41:43.846637Z","title":"Genie envisioner: A unified world foundation platform for robotic manipulation.arXiv preprint arXiv:2508.05635,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.846637Z"},"links":{"cited_paper":"/paper/2508.05635","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:42d0aae8e5e5fa5e350906468e81dd12cb9cc82052679141decd82b7ebd2fe63","observation_id":"2bb77745-38f2-4b85-b1d7-189a61b52d8a","resolution":{"observed_at":"2026-08-10T20:41:43.846637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12215","last_updated":"2026-06-03T04:04:20Z","snapshot_observed_at":"2026-08-02T23:57:43.860710Z","submitted_at":"2026-02-12T17:53:51Z","title":"LDA-1B: Scaling Latent Dynamics Action Model via Universal Embodied Data Ingestion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.12215","snapshot_observed_at":"2026-08-10T20:41:43.851098Z","title":"Lda-1b: Scaling latent dynamics action model via universal embodied data ingestion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.851098Z"},"links":{"cited_paper":"/paper/2602.12215","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:0d3b147d40738cff0ccbd0bbfa3b26d7235b93b46ca4d2a60cb24070edb16511","observation_id":"51beead7-cf0f-4c5a-bc12-9285f117fa83","resolution":{"observed_at":"2026-08-10T20:41:43.851098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.19312","last_updated":"2026-06-03T18:50:40Z","snapshot_observed_at":"2026-08-06T05:42:53.129146Z","submitted_at":"2026-03-13T19:48:14Z","title":"LeWorldModel: Stable End-to-End Joint-Embedding Predictive Architecture from Pixels","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.19312","snapshot_observed_at":"2026-08-10T20:41:43.855678Z","title":"LeWorldModel: Stable end-to-end joint-embedding predictive architecture from pixels.arXiv preprint arXiv:2603.19312,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.855678Z"},"links":{"cited_paper":"/paper/2603.19312","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:3ee4b7c14a9ed5c4e750ec5323569085efe2d1efbb4449d87fe3ee85db887e94","observation_id":"aedfe381-ac0e-4ae4-9857-f3162503142e","resolution":{"observed_at":"2026-08-10T20:41:43.855678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.14482","last_updated":"2026-06-11T10:07:56Z","snapshot_observed_at":"2026-08-06T07:23:27.418432Z","submitted_at":"2026-03-15T17:02:40Z","title":"V-JEPA 2.1: Unlocking Dense Features in Video Self-Supervised Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.14482","snapshot_observed_at":"2026-08-10T20:41:43.859391Z","title":"V-JEPA 2.1: Unlocking dense features in video self-supervised learning.arXiv preprint arXiv:2603.14482,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.859391Z"},"links":{"cited_paper":"/paper/2603.14482","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:c793fce7d36a0fdc953275b1a6b457712f20e474c2b15e33280c773322061fe8","observation_id":"643e5636-e55b-4e10-bad6-760151b930b4","resolution":{"observed_at":"2026-08-10T20:41:43.859391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08732","last_updated":"2026-06-05T11:55:33Z","snapshot_observed_at":"2026-08-11T12:43:37.131156Z","submitted_at":"2026-05-09T06:36:23Z","title":"Latent Geometry Beyond Search: Amortizing Planning in World Models","version":2},"cited_work":{"arxiv_id":"2605.08732","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.08732","snapshot_observed_at":"2026-08-10T20:41:44.406625Z","title":"Latent Geometry Beyond Search: Amortizing Planning in World Models","venue":"cs.RO","work_id":"94c33f2b-5e63-4bfd-9330-8ad8e0739e6a","year":2026},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.863650Z"},"links":{"cited_paper":"/paper/2605.08732","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:07a66a3360182e6268f821c65a1ab2adb16b4f01599fff07aff1d08dc3502937","observation_id":"67a071b4-b42c-4f8a-adcc-b42a81e085d4","resolution":{"observed_at":"2026-08-10T20:41:44.410479Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11689","last_updated":"2026-04-13T16:30:35Z","snapshot_observed_at":"2026-07-06T23:00:03.762376Z","submitted_at":"2026-04-13T16:30:35Z","title":"LARY: A Latent Action Representation Yielding Benchmark for Generalizable Vision-to-Action Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.11689","snapshot_observed_at":"2026-08-10T20:41:43.867336Z","title":"LARY: A latent action representation yielding benchmark for generalizable vision-to-action alignment.arXiv preprint arXiv:2604.11689,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.867336Z"},"links":{"cited_paper":"/paper/2604.11689","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:5293a8e11a0ca76595dbcc830618e93cc855438962434edb381a34f7aa7e7e1c","observation_id":"10945e6d-0db1-408e-b76b-d182625c2ba1","resolution":{"observed_at":"2026-08-10T20:41:43.867336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.06388","last_updated":"2026-05-07T15:05:26Z","snapshot_observed_at":"2026-08-02T19:03:40.916172Z","submitted_at":"2026-05-07T15:05:26Z","title":"Reconstruction or Semantics? What Makes a Latent Space Useful for Robotic World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.06388","snapshot_observed_at":"2026-08-10T20:41:43.871583Z","title":"Reconstruction or semantics? what makes a latent space useful for robotic world models, 2026.https://arxiv.org/abs/2605.06388","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.871583Z"},"links":{"cited_paper":"/paper/2605.06388","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:6ca13905cf98aaea49fe755f1ba1f708f0b570d75b6784f97116cc3895bd6ff6","observation_id":"ec375ccf-128a-4bf5-a12b-5cc8b3c77bcf","resolution":{"observed_at":"2026-08-10T20:41:43.871583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:41:44.663926Z","title":"OGBench: Benchmarking offline goal-conditioned RL","venue":null,"work_id":"45269915-dc95-44c5-945b-dc911ec3bdd0","year":2025},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.876052Z"},"links":{"citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:a71d75026f694f7886814ec9fc7b3aa7af7bff7a906e0815e50f543039f0b4e8","observation_id":"2efa1da1-fa8e-4df0-a553-911bd1a2e13f","resolution":{"observed_at":"2026-08-10T20:41:44.668012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:41:44.651184Z","title":null,"venue":null,"work_id":"aa38b70b-ef06-4918-9018-f9e09b55ff7c","year":2025},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.880350Z"},"links":{"citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:962465c3c83534b9a7fb84436ae130e83f2875ab18f65f8154c6a65962968e3b","observation_id":"8c808325-6709-4310-8b71-c8b8d37aec99","resolution":{"observed_at":"2026-08-10T20:41:44.655923Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:41:43.884472Z","title":"GigaWorld-0: World models as data engine to empower embodied AI.arXiv preprint arXiv:2511.19861,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.884472Z"},"links":{"citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:9508d13e79fc253f2c94837341cf1d7c86158fde2dd96aae00579a08b07c218c","observation_id":"5ab9f07f-3493-4110-82c5-0dec7157c14d","resolution":{"observed_at":"2026-08-10T20:41:43.884472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.02642","last_updated":"2026-07-02T17:02:43Z","snapshot_observed_at":"2026-08-03T12:39:47.539491Z","submitted_at":"2026-07-02T17:02:43Z","title":"GigaWorld-1: A Roadmap to Build World Models for Robot Policy Evaluation","version":1},"cited_work":{"arxiv_id":"2607.02642","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.02642","snapshot_observed_at":"2026-08-10T20:41:44.285728Z","title":"GigaWorld-1: A Roadmap to Build World Models for Robot Policy Evaluation","venue":"cs.RO","work_id":"e55265ce-2c44-4edc-a894-d8765cd4a471","year":2026},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.888041Z"},"links":{"cited_paper":"/paper/2607.02642","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:ac04011c9c633b45b8a044887cfa5580ee658c9ebfc702da73eae69ab0434db1","observation_id":"fa3a742b-7e23-4cc6-bc98-485f524eae8d","resolution":{"observed_at":"2026-08-10T20:41:44.293651Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:41:43.891873Z","title":"Beyond language modeling: An exploration of multimodal pretraining","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.891873Z"},"links":{"citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:1678edf87b126e52fb18b5edfff6a33fed277a69c01989f9abec66146b7c2aec","observation_id":"100d3085-3228-4b68-934e-1b92b13bcb18","resolution":{"observed_at":"2026-08-10T20:41:43.891873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:41:43.895990Z","title":"Open-world hand-object interaction video generation based on structure and contact-aware representation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.895990Z"},"links":{"citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:89480266d478fddc49691cb86bdca2961750000472f6f9cf35989672c0d0f4e4","observation_id":"b2b4d677-4f69-4894-89b2-530598783472","resolution":{"observed_at":"2026-08-10T20:41:43.895990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:41:43.899958Z","title":"UniDriveDreamer: A single-stage multimodal world model for autonomous driving.arXiv preprint arXiv:2602.02002,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.899958Z"},"links":{"citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:7c700057fa79398019ab0af701a834454d32443a657a2c65a8c848b94cdbe650","observation_id":"fd1f48ef-37a7-4918-ab92-6647f9a4f302","resolution":{"observed_at":"2026-08-10T20:41:43.899958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:41:43.904159Z","title":"FlowVLA: Visual chain of thought-based motion reasoning for vision-language-action models.arXiv preprint arXiv:2508.18269,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.904159Z"},"links":{"citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:3214154cdd278e927bfa4d3c395fe8d1a0d78f15ce54f9f754ab1b68dca05f86","observation_id":"a6211a8a-2fbd-4454-aef9-41f3e0c4ef1e","resolution":{"observed_at":"2026-08-10T20:41:43.904159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:41:43.908418Z","title":"DualCoT-VLA: Visual-linguistic chain of thought via parallel reasoning for vision-language-action models.arXiv preprint arXiv:2603.22280,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.908418Z"},"links":{"citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:4511631c0d54fb721b417dc84f040e79eefeebd1df5d9db2f9017f61853c8732","observation_id":"4de75839-f51f-4d07-8fc8-2261a689b7ea","resolution":{"observed_at":"2026-08-10T20:41:43.908418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04983","last_updated":"2025-02-01T02:40:49Z","snapshot_observed_at":"2026-07-06T19:46:54.707852Z","submitted_at":"2024-11-07T18:54:37Z","title":"DINO-WM: World Models on Pre-trained Visual Features enable Zero-shot Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04983","snapshot_observed_at":"2026-08-10T20:41:43.912335Z","title":"DINO-WM: World models on pre-trained visual features enable zero-shot planning.arXiv preprint arXiv:2411.04983,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.912335Z"},"links":{"cited_paper":"/paper/2411.04983","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:0d0355fc12842bd7df867961dc49771c90b619f65b1128147a31882702e2ff8c","observation_id":"45e2f42a-1cc4-4f11-9eae-04f23fe607f5","resolution":{"observed_at":"2026-08-10T20:41:43.912335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-10T20:41:43.815090Z","title":"Dream to control: Learning behaviors by latent imagination","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.815090Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:37279ce4da6e2a8ec5be0df06404b24aff5ff86f776eb5821d62d5d009b94ad7","observation_id":"b57a9edb-0419-45a3-ae8c-8411cb48279c","resolution":{"observed_at":"2026-08-10T20:41:43.815090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09985","snapshot_observed_at":"2026-08-10T20:41:43.793178Z","title":"V-JEPA 2: Self-supervised video models enable understanding, prediction and planning.arXiv preprint arXiv:2506.09985, 2025.https://arxiv.org/abs/2506.09985","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.793178Z"},"links":{"cited_paper":"/paper/2506.09985","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:b2bf3dde7f931668013c0463626464705d2bba3b5104fcd05c0aa8f56c117060","observation_id":"cec43895-c873-4d31-8f07-e2c3850ce7af","resolution":{"observed_at":"2026-08-10T20:41:43.793178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:41:43.797534Z","title":"Why ai systems don’t learn and what to do about it: Lessons on autonomous learning from cognitive science.arXiv preprint arXiv:2603.15381,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.797534Z"},"links":{"citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:42705ecb51136cf3a4ba583b64fc8c4940142f2417dcd69a128e14a7b916eb66","observation_id":"bfdf302f-39df-4e2f-a3ec-b7a8a32bc3f2","resolution":{"observed_at":"2026-08-10T20:41:43.797534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02117","last_updated":"2024-01-04T07:55:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T07:55:53Z","title":"Mobile ALOHA: Learning Bimanual Mobile Manipulation with Low-Cost Whole-Body Teleoperation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02117","snapshot_observed_at":"2026-08-10T20:41:43.801307Z","title":"Mobile ALOHA: Learning bimanual mobile manipulation with low-cost whole-body teleoperation.arXiv preprint arXiv:2401.02117,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-10T20:41:43.801307Z"},"links":{"cited_paper":"/paper/2401.02117","citing_paper":"/paper/2608.06799"},"observation_digest":"sha256:f311ae7b76b2f35c40a05581c38f3b326206823f30bed01b946d11e012957f01","observation_id":"faa62ea0-a425-480d-a657-9e928ba511f5","resolution":{"observed_at":"2026-08-10T20:41:43.801307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.06799","last_updated":"2026-08-07T04:44:16Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-12T07:10:38.396753Z","submitted_at":"2026-08-07T04:44:16Z","title":"Is Forward Prediction Enough? Physical State Grounding for JEPA World Models"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2608.06799."}