{"as_of":"2026-08-12T09:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d5a1673c670442ef855e8daa5758aa1c85f29f0a3443d75184c34894bcae41ad","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T04:59:30.123195Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07420/citation-record","integrity":"/paper/2608.07420/integrity","json":"/paper/2608.07420/citation-record.json","paper":"/paper/2608.07420"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:31.046769Z","title":"DIAMOND: Diffusion for world modeling: Visual details matter in atari","venue":null,"work_id":"e821c130-d657-4846-8e62-f36566616165","year":2024},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.771043Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:b943d733eb14608050699dc0c95b2ec414680c6ddbd5a0b6d9e439b35838022f","observation_id":"18a55230-a3d0-421e-8626-213ced7f1d97","resolution":{"observed_at":"2026-08-10T04:59:31.050712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07193","last_updated":"2018-07-27T12:40:44Z","snapshot_observed_at":"2026-07-06T06:34:19.449844Z","submitted_at":"2018-04-19T14:29:41Z","title":"Lipschitz Continuity in Model-based Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07193","snapshot_observed_at":"2026-08-10T04:59:29.778982Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.778982Z"},"links":{"cited_paper":"/paper/1804.07193","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:6a18d93999633bb26b599ab26042041b11f351cf126647cb4fe3cd399f22ae6e","observation_id":"bc17e08a-d9e3-4061-b923-471599a71ac0","resolution":{"observed_at":"2026-08-10T04:59:29.778982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.13320","last_updated":"2019-05-30T21:30:29Z","snapshot_observed_at":"2026-07-06T07:56:54.143277Z","submitted_at":"2019-05-30T21:30:29Z","title":"Combating the Compounding-Error Problem with a Multi-step Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.13320","snapshot_observed_at":"2026-08-10T04:59:29.801091Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.801091Z"},"links":{"cited_paper":"/paper/1905.13320","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:7c50ad11015e3599dc5a65a6bd81ca060b8f2fa55efe1b6e0ce3b699e3cb7e4b","observation_id":"8924a219-fff0-48f2-a868-c38026dba62f","resolution":{"observed_at":"2026-08-10T04:59:29.801091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:31.029387Z","title":null,"venue":null,"work_id":"fa14ba6c-e5d5-4809-bd96-caec9ed8b713","year":null},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.811809Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:71192bb362f4b70479303f4e3faf88d0b76f1dd4e7d8887ad0e7d554003afe52","observation_id":"ebd0a93a-89f6-4a9e-a688-8d5e9904f08d","resolution":{"observed_at":"2026-08-10T04:59:31.033425Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.915423Z","title":"Multi-timestep models for model-based reinforcement learning, 2024","venue":null,"work_id":"7b85e487-bec4-41ee-8077-9c7262c877c6","year":2024},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.831665Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:45dce9b73013af5c33da5ba7b8a13086126befc1bf7cc4a239f68542fe40928d","observation_id":"1bf57239-b047-4876-97af-b141bc0ba86b","resolution":{"observed_at":"2026-08-10T04:59:30.920337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1506.03099","last_updated":"2015-09-23T16:35:42Z","snapshot_observed_at":"2026-08-10T07:40:27.776315Z","submitted_at":"2015-06-09T20:33:47Z","title":"Scheduled Sampling for Sequence Prediction with Recurrent Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.03099","snapshot_observed_at":"2026-08-10T04:59:29.836826Z","title":"Scheduled sampling for sequence prediction with recurrent neural networks, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.836826Z"},"links":{"cited_paper":"/paper/1506.03099","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:c34b62eed2be5317ae6a72511ec5c97c93aa369192dbcec65eda14671f0235dd","observation_id":"c9756a44-3dd8-4e7a-b65d-bdea80427dd6","resolution":{"observed_at":"2026-08-10T04:59:29.836826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:29.842128Z","title":"Bengio, P","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.842128Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:2a3aa67d35a6e191b1dd7147a716c35425bf4e5006a0f0f85346519c4991101c","observation_id":"509f6108-6320-48dc-97de-017997baafdf","resolution":{"observed_at":"2026-08-10T04:59:29.842128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15391","last_updated":"2024-02-23T15:47:26Z","snapshot_observed_at":"2026-08-03T22:04:23.465893Z","submitted_at":"2024-02-23T15:47:26Z","title":"Genie: Generative Interactive Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15391","snapshot_observed_at":"2026-08-10T04:59:29.852319Z","title":"Genie: Generative interactive environments, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.852319Z"},"links":{"cited_paper":"/paper/2402.15391","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:894aa1424a680346d549787490cef8f11edac615c3db7e55ea16bdc62e3bd947","observation_id":"c3745dbc-1307-4d3e-8b80-58cec1498792","resolution":{"observed_at":"2026-08-10T04:59:29.852319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.905304Z","title":null,"venue":null,"work_id":"ad9bc30d-05fc-44f8-980e-dce4a5e7d909","year":2018},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.864749Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:1f056b49cb1cadcb8af508553e0c6dec19f45be9c6f8cb2e3b5d0ee79c62f37e","observation_id":"c5e39d5e-cb7f-46d8-9686-a160288d0aba","resolution":{"observed_at":"2026-08-10T04:59:30.908698Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:29.880604Z","title":"Diversity is all you need: Learning skills without a reward function, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.880604Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:3a79ea37111fae887e215ad411c17ffd888258ffdafbe929004b441e62c05795","observation_id":"ecf415a8-e5bc-46ec-9d9d-bd1722164bb7","resolution":{"observed_at":"2026-08-10T04:59:29.880604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1605.07157","last_updated":"2016-10-17T20:09:56Z","snapshot_observed_at":"2026-08-08T07:55:53.520010Z","submitted_at":"2016-05-23T19:45:55Z","title":"Unsupervised Learning for Physical Interaction through Video Prediction","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1605.07157","snapshot_observed_at":"2026-08-10T04:59:29.907634Z","title":"Goodfellow, and Sergey Levine","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.907634Z"},"links":{"cited_paper":"/paper/1605.07157","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:a30678854e57d80e5959d0e5fd9cb5ad243a4fb9add141e675302e79a154b5d3","observation_id":"8484d6b5-9a5e-4446-807b-24198e626695","resolution":{"observed_at":"2026-08-10T04:59:29.907634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.888540Z","title":"Professor forcing: a new algorithm for training recurrent networks","venue":null,"work_id":"876d5891-6b7c-4a0a-b7f1-6d2e0a207d72","year":2016},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.921602Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:f3b9de57a8c01fb62459e73b9585309b8feb3dabb705dd9b76cdb05ad4423a5f","observation_id":"2efd76cf-11c6-4d3f-aa1c-fa2dad9e4eeb","resolution":{"observed_at":"2026-08-10T04:59:30.892786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.879296Z","title":null,"venue":null,"work_id":"d22c7e69-4819-4f85-b276-599aa904c23b","year":2024},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.926815Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:7a301d3f4f9fa0c836898842f94f5a00cbe9e3e86653201a6d23ddb90ede4b1e","observation_id":"eb109124-017c-4354-bbe8-85b802985da1","resolution":{"observed_at":"2026-08-10T04:59:30.882635Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-10T04:59:29.931514Z","title":"World models.arXiv preprint arXiv:1803.10122, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.931514Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:a58f0d2fda0f50ec5d13a39e1d71825155f6e0bd75948157c56d11edcb825933","observation_id":"7ecb51a3-1aed-4ab5-9597-832a27ff0e9e","resolution":{"observed_at":"2026-08-10T04:59:29.931514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-09T02:21:17.479736Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01603","snapshot_observed_at":"2026-08-10T04:59:29.945091Z","title":"Dream to control: Learning behaviors by latent imagination.arXiv preprint arXiv:1912.01603, 2019","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.945091Z"},"links":{"cited_paper":"/paper/1912.01603","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:fcaeb9066ebdc706d6248e2031ddb965e0889e8de0eaca48f713bbf0f1928b5e","observation_id":"b6c6053b-d93f-4d82-a187-7dda275cde1f","resolution":{"observed_at":"2026-08-10T04:59:29.945091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.869389Z","title":"Learning latent dynamics for planning from pixels","venue":null,"work_id":"e05f3c35-65c4-4eda-89a4-e8395267b4dc","year":2019},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.949219Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:dd6b52c5fcce6c8c5dc5451a24c842761c1463661abf0681dcab6b920568b0c5","observation_id":"51dbb2c8-847d-467c-ae8a-962a3d5465ea","resolution":{"observed_at":"2026-08-10T04:59:30.873165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02193","last_updated":"2022-02-12T20:01:53Z","snapshot_observed_at":"2026-08-02T12:02:13.904371Z","submitted_at":"2020-10-05T17:52:14Z","title":"Mastering Atari with Discrete World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02193","snapshot_observed_at":"2026-08-10T04:59:29.953241Z","title":"Mastering atari with discrete world models.arXiv preprint arXiv:2010.02193, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.953241Z"},"links":{"cited_paper":"/paper/2010.02193","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:7865c25e853cea6e062ffbf34805b94a0a0a7f6dc921a113308c207fdef90536","observation_id":"7c28e615-7198-4377-8890-398d25d81af6","resolution":{"observed_at":"2026-08-10T04:59:29.953241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:29.958235Z","title":"Mastering diverse control tasks through world models.Nature, pages 1–7, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.958235Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:6454bda69332aaba6dc1bbbc0d831777f08daaa09f5a91b1c722153352c5da6c","observation_id":"7274d489-584c-40c0-bfbd-c42f85c0de6a","resolution":{"observed_at":"2026-08-10T04:59:29.958235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.04955","last_updated":"2022-07-19T18:14:36Z","snapshot_observed_at":"2026-08-10T15:55:33.977855Z","submitted_at":"2022-03-09T18:58:28Z","title":"Temporal Difference Learning for Model Predictive Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.04955","snapshot_observed_at":"2026-08-10T04:59:29.962056Z","title":"Temporal difference learning for model predictive control, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.962056Z"},"links":{"cited_paper":"/paper/2203.04955","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:bf326952fd3c85f19a996fe013d07312e316167655458805fc14fa99aba2db09","observation_id":"ebd9d996-4f3e-46b1-92c9-ddf6cc0476fb","resolution":{"observed_at":"2026-08-10T04:59:29.962056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16828","last_updated":"2024-03-21T17:56:19Z","snapshot_observed_at":"2026-07-31T05:32:29.431480Z","submitted_at":"2023-10-25T17:57:07Z","title":"TD-MPC2: Scalable, Robust World Models for Continuous Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16828","snapshot_observed_at":"2026-08-10T04:59:29.965750Z","title":"Td-mpc2: Scalable, robust world models for continuous control, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.965750Z"},"links":{"cited_paper":"/paper/2310.16828","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:8206904f863ce9ffd8296a9c56102bbd18d2678d47d8ed50aabf74b325e290b1","observation_id":"72721181-b42e-46c8-99ea-441da93f5856","resolution":{"observed_at":"2026-08-10T04:59:29.965750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.854056Z","title":"Neural motion simulator pushing the limit of world models in reinforcement learning","venue":null,"work_id":"6e4e9d01-4428-444c-afc5-a7818762ee0f","year":2025},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.970317Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:a44dabc244034282a4157d40ab4070fc56697bff8fe72ead27e03d8e631348c4","observation_id":"abff9003-dd0a-4bde-a219-9f6b7aa5e784","resolution":{"observed_at":"2026-08-10T04:59:30.857939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07177","last_updated":"2018-04-04T06:34:26Z","snapshot_observed_at":"2026-08-09T10:10:27.648203Z","submitted_at":"2017-05-19T20:38:49Z","title":"Model-Based Planning with Discrete and Continuous Actions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07177","snapshot_observed_at":"2026-08-10T04:59:29.974197Z","title":"Model-based planning with discrete and continuous actions.arXiv preprint arXiv:1705.07177, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.974197Z"},"links":{"cited_paper":"/paper/1705.07177","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:c532d332683cdc4a29fd28cc6f5a24ceacc15d233b999931a1bd5e0d1b9d0ca1","observation_id":"9d8d26ea-6baf-49e8-8124-620a905db362","resolution":{"observed_at":"2026-08-10T04:59:29.974197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.843554Z","title":"Efros, and Sergey Levine","venue":null,"work_id":"5e617d66-ecc0-4812-ae99-1c4d122aa8d6","year":2018},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.978606Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:4fc808ff1ef9ad3eab9fab940766f2374fbbc02c766c5d899b90ec10034ee501","observation_id":"7f691b9c-6c79-4130-946d-43ddc1ee227f","resolution":{"observed_at":"2026-08-10T04:59:30.847048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02385","last_updated":"2025-06-22T03:30:55Z","snapshot_observed_at":"2026-08-02T22:45:54.982294Z","submitted_at":"2024-11-04T18:53:05Z","title":"How Far is Video Generation from World Model: A Physical Law Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02385","snapshot_observed_at":"2026-08-10T04:59:29.983053Z","title":"How far is video generation from world model: A physical law perspective, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.983053Z"},"links":{"cited_paper":"/paper/2411.02385","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:efb246104a3aeb59989c38cebd67f48585acd200ea5a793b387883b4cfc061fb","observation_id":"9c4fb1de-afc7-41ea-8918-e250a9ddf26f","resolution":{"observed_at":"2026-08-10T04:59:29.983053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:29.994748Z","title":"A path towards autonomous machine intelligence version 0.9","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.994748Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:0fd55008c2a680c702c5fa6c4f5665bc8dfaf0acdbc9dae0b453aed8feca78eb","observation_id":"6b7357ab-847c-43cf-8f44-66073d45d155","resolution":{"observed_at":"2026-08-10T04:59:29.994748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.006373Z","title":"Smallworlds: Assessing dynamics understanding of world models in isolated environments, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.006373Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:c54939b36e7fc352008ca961843b47dae358efacd070439196828cad7c14b9c6","observation_id":"23986565-173e-4354-ba80-9534289887bd","resolution":{"observed_at":"2026-08-10T04:59:30.006373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.826644Z","title":"Any-step dynamics model improves future predictions for online and offline reinforcement learning","venue":null,"work_id":"4a7e22f5-fdc7-46e8-9ce6-22956e49ca4e","year":2025},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.025690Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:fe5eccc1681ca2db761850c8b2bc5954831bd49a4ef2ce3e39be292600884778","observation_id":"ed6be7a9-5a88-49ed-9cb5-05cfc077e36e","resolution":{"observed_at":"2026-08-10T04:59:30.830802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.816138Z","title":"Adm-v2: Pursuing full-horizon roll-out in dynamics models for offline policy learning and evaluation","venue":null,"work_id":"16c3a3f8-c78e-4892-a340-f787347831b3","year":2026},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.035363Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:34e438b9fc676d2fc04daca536bbf370935b87bfb3c5509cbcecc88a962ded53","observation_id":"2ec7ce6e-adeb-48f1-924e-acc3c9fe2900","resolution":{"observed_at":"2026-08-10T04:59:30.819902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.044258Z","title":"From kepler to newton: Inductive biases guide learned world models in transformers.ArXiv, abs/2602.06923, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.044258Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:3165cba660b09b4fff426049b50cc02f255ed24840ba8cfaf14cee767cf3e0be","observation_id":"040b0d5a-f667-4ab8-bf43-19d833ca7ea7","resolution":{"observed_at":"2026-08-10T04:59:30.044258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05740","last_updated":"2023-04-11T21:03:47Z","snapshot_observed_at":"2026-08-05T21:26:08.146481Z","submitted_at":"2021-10-12T05:07:43Z","title":"Temporal Abstraction in Reinforcement Learning with the Successor Representation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05740","snapshot_observed_at":"2026-08-10T04:59:30.049297Z","title":"Machado, Andre Barreto, Doina Precup, and Michael Bowling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.049297Z"},"links":{"cited_paper":"/paper/2110.05740","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:8faba9b8ebf98a6b5e84e8d67ddc0a65295d8c97c692ab26618ef87dadba4c9f","observation_id":"cabdb706-c5ba-4a3b-8755-0ef54ca2c5f3","resolution":{"observed_at":"2026-08-10T04:59:30.049297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.053548Z","title":"Transformers are sample-efficient world models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.053548Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:190432c53a9f97bde59416220ebaa169d5b0983ecda5ed267945a13351b89eb2","observation_id":"1b3a1c66-b37e-4734-9a9c-7773efe6e0c6","resolution":{"observed_at":"2026-08-10T04:59:30.053548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.799797Z","title":"On the difficulty of training recurrent neural networks","venue":null,"work_id":"0d8bf329-b106-4a69-96a8-e5fd11c589e4","year":2012},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.057316Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:54c4ec86499ce1b1f022a2fd3ce5596d04611e9f2f10f6df5d017b68013dcd3e","observation_id":"ba1f3809-9950-45a9-9ba8-fbd27856e298","resolution":{"observed_at":"2026-08-10T04:59:30.803658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.07871","last_updated":"2017-12-18T21:25:53Z","snapshot_observed_at":"2026-08-10T12:32:01.327435Z","submitted_at":"2017-09-22T17:54:12Z","title":"FiLM: Visual Reasoning with a General Conditioning Layer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.07871","snapshot_observed_at":"2026-08-10T04:59:30.061059Z","title":"Film: Visual reasoning with a general conditioning layer, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.061059Z"},"links":{"cited_paper":"/paper/1709.07871","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:3c1c9192e9b7153d01ab091e701de2425869dc25a1f9cf4f9f9efd9d36a3afb4","observation_id":"70d19c9a-ffe3-4741-9a06-b413dd1958bb","resolution":{"observed_at":"2026-08-10T04:59:30.061059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-08-12T04:55:58.532015Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-10T04:59:30.067738Z","title":"Roformer: Enhanced transformer with rotary position embedding, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.067738Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:6e6a83c56e702e99815bcce4bc9b80385629c7f86f3102b659acef51897af823","observation_id":"7da57128-7daf-4edd-841f-644a5b705db7","resolution":{"observed_at":"2026-08-10T04:59:30.067738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.071735Z","title":"Dyna, an integrated architecture for learning, planning, and reacting.ACM Sigart Bulletin, 2(4):160–163, 1991","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.071735Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:a13ca5b90f4716c5068ce12d318d3a4a841bf08b2af3d418acfaec598402d718","observation_id":"514c3c40-f568-47a9-9d94-a69c2936babe","resolution":{"observed_at":"2026-08-10T04:59:30.071735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.06018","last_updated":"2017-07-26T18:53:51Z","snapshot_observed_at":"2026-07-06T05:23:15.238465Z","submitted_at":"2016-12-19T01:09:23Z","title":"Self-Correcting Models for Model-Based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.06018","snapshot_observed_at":"2026-08-10T04:59:30.075418Z","title":"Self-correcting models for model-based reinforcement learning, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.075418Z"},"links":{"cited_paper":"/paper/1612.06018","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:0f1492488663dfa1a9d421022d4efbcbc5bdb67260d3a869303f1c14da077fbe","observation_id":"1cefa4cd-3179-4da4-b099-35c19afcc944","resolution":{"observed_at":"2026-08-10T04:59:30.075418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.406576Z","title":"dm_control: Software and tasks for continuous control.Software Impacts, 6:100022, 2020","venue":null,"work_id":"8aed0620-3100-46df-832c-ccf0a5c648c8","year":2020},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.084747Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:001489e5eaead48a7214904489e8f3fead571b6dce203a06b3d00506de926e08","observation_id":"c0a12810-1087-447e-8ecc-2f3b50ba2502","resolution":{"observed_at":"2026-08-10T04:59:30.410235Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.097929Z","title":"Chang, Ashesh Rambachan, and Sendhil Mullainathan","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.097929Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:1f44b92950c9c28439c8ed3c25c527ba0ad1fe992f32897e4f62fa6716074ecc","observation_id":"ace92813-913a-4b2f-9108-7604b61f49b8","resolution":{"observed_at":"2026-08-10T04:59:30.097929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-10T04:59:30.107081Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.107081Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:ba871ba02910f200f738b7613a9241d75859345744fb66c01a79313e3c122013","observation_id":"3dbc8750-b62b-4341-a41e-fa5a637ac7a4","resolution":{"observed_at":"2026-08-10T04:59:30.107081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.26782","last_updated":"2026-04-20T20:34:09Z","snapshot_observed_at":"2026-08-11T16:48:14.865374Z","submitted_at":"2025-10-30T17:56:43Z","title":"Cloning Deterministic Worlds: The Critical Role of Latent Geometry in Long-Horizon World Models","version":3},"cited_work":{"arxiv_id":"2510.26782","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.26782","snapshot_observed_at":"2026-08-10T04:59:30.202338Z","title":"Cloning Deterministic Worlds: The Critical Role of Latent Geometry in Long-Horizon World Models","venue":"cs.LG","work_id":"1200f75e-3678-4a34-b269-42aef8dbd2b8","year":2025},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.111088Z"},"links":{"cited_paper":"/paper/2510.26782","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:356b0a2b5667f5f62119e28ad4bec32c25081df779e6298ebf155b2e4d0fbe3e","observation_id":"00e1ab39-4f77-49cf-88fc-d7169a220c7d","resolution":{"observed_at":"2026-08-10T04:59:30.209152Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12617","last_updated":"2023-02-24T13:26:03Z","snapshot_observed_at":"2026-08-12T08:01:45.123686Z","submitted_at":"2023-02-24T13:26:03Z","title":"Leveraging Jumpy Models for Planning and Fast Learning in Robotic Domains","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12617","snapshot_observed_at":"2026-08-10T04:59:30.115031Z","title":"Leveraging jumpy models for planning and fast learning in robotic domains, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.115031Z"},"links":{"cited_paper":"/paper/2302.12617","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:d89d18fe41c41ab52a0e4ddfa17afacce872cef592fa3dee51cdee29ac72aa61","observation_id":"808b15e9-03b9-4a16-a966-7f99c3c59e1a","resolution":{"observed_at":"2026-08-10T04:59:30.115031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.03208","last_updated":"2026-06-16T20:46:31Z","snapshot_observed_at":"2026-07-13T13:29:04.173053Z","submitted_at":"2026-04-03T17:32:36Z","title":"Hierarchical Planning with Latent World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.03208","snapshot_observed_at":"2026-08-10T04:59:30.119375Z","title":"Hierarchical planning with latent world models, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.119375Z"},"links":{"cited_paper":"/paper/2604.03208","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:47b965e7b11d1ac0f8da3c5dfd9b4ff93d3a0d8514b8ce6cf12dc7f96e1af773","observation_id":"d7cfc94c-c10d-40a2-9978-d9584051322a","resolution":{"observed_at":"2026-08-10T04:59:30.119375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13705","last_updated":"2023-04-23T19:10:53Z","snapshot_observed_at":"2026-08-03T01:22:01.078078Z","submitted_at":"2023-04-23T19:10:53Z","title":"Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13705","snapshot_observed_at":"2026-08-10T04:59:30.123195Z","title":"Zhao, Vikash Kumar, Sergey Levine, and Chelsea Finn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.123195Z"},"links":{"cited_paper":"/paper/2304.13705","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:c0aabc778419d289fbfca22864de5c5cf5387f4475311a372228ff5f22bffb4b","observation_id":"402418ff-d869-4e2e-a0c2-589f9658b771","resolution":{"observed_at":"2026-08-10T04:59:30.123195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:29.826523Z","title":"doi: 10.1613/jair.3912","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.826523Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:33accef9def707cad7782a022c0e7e056243b08dad2e41bc639af0d8e25b6f0d","observation_id":"9064f369-0960-4a8a-aac1-34655adb0efa","resolution":{"observed_at":"2026-08-10T04:59:29.826523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.783685Z","title":null,"venue":null,"work_id":"31cc67f5-85d2-42a1-8896-188d9c85c1a9","year":null},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.102693Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:8505912c9a237bf5280f8d1079a4f1fb46a96795169f466c340972f51fdd4d5f","observation_id":"3ca24311-a5b0-4c36-874a-e56b581dd810","resolution":{"observed_at":"2026-08-10T04:59:30.787424Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T08:12:11.061694Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":2,"verified_fuzzy":9},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2608.07420."}