{"as_of":"2026-08-09T09:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a023f705cbec6264396af08444f1271c985f175b375ee6db28cae7c9bb80161a","coverage":[{"denominator":253,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T23:38:44.933410Z","state":"measured"},{"denominator":200,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":200,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":423,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T00:42:56.918869Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":9,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2401.03048","last_updated":"2025-05-01T09:40:21Z","snapshot_observed_at":"2026-08-02T13:01:06.918463Z","submitted_at":"2024-01-05T19:55:15Z","title":"Latte: Latent Diffusion Transformer for Video Generation","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T21:45:35.754742Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2401.03048"},"observation_digest":"sha256:aea44a48c287030f5f47d146502045b1f5e73f49b9d296d941972443032c74ce","observation_id":"87e26b48-3ac2-407e-b763-1e55d40d7074","resolution":{"observed_at":"2026-05-13T21:45:35.796766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2501.09038","last_updated":"2025-02-27T15:10:51Z","snapshot_observed_at":"2026-08-02T17:18:33.867969Z","submitted_at":"2025-01-14T20:59:37Z","title":"Do generative video models understand physical principles?","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-20T12:47:05.825659Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2501.09038"},"observation_digest":"sha256:11790168cea8daf2120d0902e7cf08a1732271bd95ece62b4059bd95298a455a","observation_id":"4097a27e-822c-4e46-b132-57a05af61dd6","resolution":{"observed_at":"2026-05-20T12:47:05.854160Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2501.12386","last_updated":"2025-07-13T18:57:17Z","snapshot_observed_at":"2026-08-06T07:17:05.291678Z","submitted_at":"2025-01-21T18:59:00Z","title":"InternVideo2.5: Empowering Video MLLMs with Long and Rich Context Modeling","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-17T02:52:20.643070Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2501.12386"},"observation_digest":"sha256:869f85269b686cbdf274c75eed22b7a56cb3623ba81b9d06a031d7e4163d1057","observation_id":"07d9e05a-eb3a-484f-b201-1502b89bf29a","resolution":{"observed_at":"2026-05-17T02:52:20.670876Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-09T00:42:56.918869Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.04397","last_updated":"2025-06-29T03:09:34Z","snapshot_observed_at":"2026-08-09T00:35:23.283222Z","submitted_at":"2025-02-06T06:58:09Z","title":"Multimodal Medical Code Tokenizer","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T00:42:56.918869Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2502.04397"},"observation_digest":"sha256:9e70e86e88843f193b4d146d29d9b5a67bdf370d9a39270b9121535257e2908a","observation_id":"dc8db966-b688-4d8c-82b4-cdffaee7983e","resolution":{"observed_at":"2026-08-09T00:42:56.918869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-08T21:07:32.156095Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.04896","last_updated":"2025-02-10T13:56:35Z","snapshot_observed_at":"2026-08-08T21:00:11.502449Z","submitted_at":"2025-02-07T13:03:55Z","title":"Goku: Flow Based Video Generative Foundation Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T21:07:32.156095Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2502.04896"},"observation_digest":"sha256:a91b6bf1a55f3d978ca4e32f6fa38181ea8f67d5e4c6f86914ce8c8d8bd392be","observation_id":"85928938-7044-4a89-a653-5151f2f030ab","resolution":{"observed_at":"2026-08-08T21:07:32.156095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2502.10248","last_updated":"2025-02-24T10:12:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-14T15:58:10Z","title":"Step-Video-T2V Technical Report: The Practice, Challenges, and Future of Video Foundation Model","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-19T08:02:23.002090Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2502.10248"},"observation_digest":"sha256:6fc8c9eeeb698098a52ad27a10a9f1e1ab469cfaea3f531b9cfaa2e3d842a132","observation_id":"6f1d706e-5be6-48ce-a7eb-88a2acd01955","resolution":{"observed_at":"2026-05-19T08:02:23.962171Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2502.11537","last_updated":"2026-05-10T12:01:50Z","snapshot_observed_at":"2026-08-06T08:12:31.919308Z","submitted_at":"2025-02-17T08:06:10Z","title":"Simulus: Combining Improvements in Sample-Efficient World Model Agents","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-23T02:28:23.113408Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2502.11537"},"observation_digest":"sha256:c1a24af0322908efa3c8af784743f8057a3ca5efbbd79a47951e9e91aa525fca","observation_id":"eaad51e5-1286-4666-9fd2-e6c708b049e3","resolution":{"observed_at":"2026-05-23T02:32:26.169585Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T19:09:10.112304Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2503.14734"},"observation_digest":"sha256:cc7a34e91a310cbdb7dcb09f0a1eab7f6933471c9c7c599c63ae67f384a2a8dd","observation_id":"f4bafd84-306a-4ebd-80cf-94f7275ee836","resolution":{"observed_at":"2026-05-10T23:38:47.256647Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2503.15558","last_updated":"2025-05-19T17:59:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-18T22:06:58Z","title":"Cosmos-Reason1: From Physical Common Sense To Embodied Reasoning","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-16T12:47:10.146795Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2503.15558"},"observation_digest":"sha256:970747a507dbebca4a58e5e0adde591ae5266fcc0d5ff0b87b7378a917a315ec","observation_id":"0086e66b-c74d-4771-86c5-fc8b87d6633c","resolution":{"observed_at":"2026-05-16T12:47:10.244526Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2503.19325","last_updated":"2025-05-18T02:27:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T03:38:06Z","title":"Long-Context Autoregressive Video Modeling with Next-Frame Prediction","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T23:05:17.201790Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2503.19325"},"observation_digest":"sha256:870e071fbb22da38da6503bd4a397bf77d5a2829d6ea306606aa384c34535e5d","observation_id":"a3d5a6f2-c170-4668-8183-428a9b4e96b2","resolution":{"observed_at":"2026-05-16T23:05:17.269584Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2503.20523","last_updated":"2025-03-26T13:11:35Z","snapshot_observed_at":"2026-07-06T20:59:00.415760Z","submitted_at":"2025-03-26T13:11:35Z","title":"GAIA-2: A Controllable Multi-View Generative World Model for Autonomous Driving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T13:48:22.279405Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2503.20523"},"observation_digest":"sha256:38676cfa25a7569f6cec9580b39d3aba7230e44c837f7b5068679f72d2f4361d","observation_id":"6f53b649-f81f-4bcd-8611-eb03a817272e","resolution":{"observed_at":"2026-05-15T13:48:22.318514Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2503.20654","last_updated":"2026-04-11T05:12:40Z","snapshot_observed_at":"2026-07-06T20:59:04.804570Z","submitted_at":"2025-03-26T15:50:42Z","title":"AccidentSim: Generating Vehicle Collision Videos with Physically Realistic Collision Trajectories from Real-World Accident Reports","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T22:25:57.796922Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2503.20654"},"observation_digest":"sha256:001de4c208909893ad3c5310c55a100ad8e3c87db291c0a3bffb23675b266542","observation_id":"d8035884-cc36-4141-b377-9d2473332ee3","resolution":{"observed_at":"2026-05-22T22:27:12.531213Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2503.21755","last_updated":"2025-08-20T15:49:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-27T17:57:01Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-14T18:42:02.940250Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2503.21755"},"observation_digest":"sha256:52869716a4dadda9b6cbdb2d2d5373d1d89e623dd95e943f05e0db8e3db6cf50","observation_id":"b2a5a481-821d-47ca-b442-25c02053e973","resolution":{"observed_at":"2026-05-14T18:42:03.311760Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2504.02792","last_updated":"2025-05-23T00:47:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-03T17:38:59Z","title":"Unified World Models: Coupling Video and Action Diffusion for Pretraining on Large Robotic Datasets","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-13T16:25:00.365534Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2504.02792"},"observation_digest":"sha256:b9e61b2c97c39697ff76cc7a675ce31adba8c29537ef9fd1d5881d82101926ab","observation_id":"faa18e6f-0cb2-4d91-a77a-f29599f73889","resolution":{"observed_at":"2026-05-13T16:25:00.461445Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2504.13074","last_updated":"2025-04-21T10:34:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-17T16:37:27Z","title":"SkyReels-V2: Infinite-length Film Generative Model","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-14T20:23:04.022599Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2504.13074"},"observation_digest":"sha256:f3646d859f6dcc6ab0f84f3ee4397c4e685c741f84aede9bf0e080057199d569","observation_id":"727c359b-f3fa-4b70-802e-74e0fe353586","resolution":{"observed_at":"2026-05-14T20:23:04.195745Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2505.11709","last_updated":"2026-03-09T06:44:42Z","snapshot_observed_at":"2026-07-06T21:25:23.371749Z","submitted_at":"2025-05-16T21:34:47Z","title":"EgoDex: Learning Dexterous Manipulation from Large-Scale Egocentric Video","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T15:40:29.361187Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2505.11709"},"observation_digest":"sha256:a952e25efb1ca6e94c483e6a0e04f70da05bbbe363d71101b2cea1ed69dc3be3","observation_id":"fda9cd74-497c-42ec-ba96-b2fb99f30de6","resolution":{"observed_at":"2026-05-15T15:40:29.404704Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2505.12705","last_updated":"2025-06-17T22:33:35Z","snapshot_observed_at":"2026-07-06T21:26:01.534136Z","submitted_at":"2025-05-19T04:55:39Z","title":"DreamGen: Unlocking Generalization in Robot Learning through Video World Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T23:50:45.332466Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2505.12705"},"observation_digest":"sha256:cffc6bb864d488b4072c524f0284d7bf4025b29b86f2ce7b1501ec6da97d0ab9","observation_id":"3be5cab3-7d3b-43a4-96a2-d5a64357f8ab","resolution":{"observed_at":"2026-05-15T23:50:45.427504Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T15:43:24.006927Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14135","last_updated":"2025-05-28T13:11:02Z","snapshot_observed_at":"2026-08-08T15:14:56.532724Z","submitted_at":"2025-05-20T09:39:48Z","title":"Hunyuan-Game: Industrial-grade Intelligent Game Creation Model","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:24.006927Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2505.14135"},"observation_digest":"sha256:2a573a09f4813862dcace8d9a2aa20c8dba1b2d29cde6777bf75ae602924b82e","observation_id":"3d2a7284-190a-4ad7-a50a-dfcb170daa82","resolution":{"observed_at":"2026-08-07T15:43:24.006927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T15:14:20.861002Z","title":"arXiv preprint arXiv:2501.03575 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15800","last_updated":"2025-05-25T17:44:44Z","snapshot_observed_at":"2026-08-09T08:24:06.276351Z","submitted_at":"2025-05-21T17:53:47Z","title":"Interspatial Attention for Efficient 4D Human Video Generation","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T15:14:20.861002Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2505.15800"},"observation_digest":"sha256:74f66a4b6d05960f84713633cc6ffef96f4c3acbf3173f1b32e044b7a44c76e9","observation_id":"e75c1a73-b4f3-4a38-878b-ce2f6d7f4a94","resolution":{"observed_at":"2026-08-07T15:14:20.861002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T15:09:00.103049Z","title":"Cosmos world foundation model platform for physical ai, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16175","last_updated":"2025-05-31T13:43:36Z","snapshot_observed_at":"2026-08-08T10:58:05.073646Z","submitted_at":"2025-05-22T03:26:50Z","title":"QuickVideo: Real-Time Long Video Understanding with System Algorithm Co-Design","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:00.103049Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2505.16175"},"observation_digest":"sha256:c1d376038f2067b1a5d94a32bd2e4e521dc1df85ed56ef273d53a34da495f8fc","observation_id":"4e2ee009-0eea-42d5-80d2-b1e18af85000","resolution":{"observed_at":"2026-08-07T15:09:00.103049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2505.17012","last_updated":"2026-04-13T12:33:41Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:03Z","title":"SpatialScore: Towards Comprehensive Evaluation for Spatial Intelligence","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T13:07:11.548885Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2505.17012"},"observation_digest":"sha256:297b0b7739a5186c3c475db09d2c2361bd2975110b6ad156224e0a528b56c862","observation_id":"589dae3b-092e-4076-be5d-cc5563d90ebf","resolution":{"observed_at":"2026-05-22T13:11:35.653194Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2505.21282","last_updated":"2026-04-19T13:43:39Z","snapshot_observed_at":"2026-08-05T20:01:00.305386Z","submitted_at":"2025-05-27T14:51:34Z","title":"EgoWalk: A Multimodal Dataset for Robot Navigation in the Wild","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-19T12:56:30.634284Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2505.21282"},"observation_digest":"sha256:d00889ec02a909d179921677599189e44d62c85001a0b5ed13b6e63cf460022f","observation_id":"b40e162f-bb38-4acf-a8b4-4ee07e587fdb","resolution":{"observed_at":"2026-05-19T12:57:17.713523Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T13:10:33.421703Z","title":"Agarwal, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22626","last_updated":"2025-09-09T06:38:19Z","snapshot_observed_at":"2026-08-07T13:00:31.711808Z","submitted_at":"2025-05-28T17:45:05Z","title":"SCIZOR: A Self-Supervised Approach to Data Curation for Large-Scale Imitation Learning","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:10:33.421703Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2505.22626"},"observation_digest":"sha256:5e4fd58b96c0be60d1c2099b8b96f724b86646cc23e00c55ca9fdc2f25a929a8","observation_id":"694019ef-d3d2-49e6-b448-33ea55633d84","resolution":{"observed_at":"2026-08-07T13:10:33.421703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T12:45:04.895413Z","title":"Agarwal, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23656","last_updated":"2025-05-29T17:06:44Z","snapshot_observed_at":"2026-08-07T12:38:23.686012Z","submitted_at":"2025-05-29T17:06:44Z","title":"VideoREPA: Learning Physics for Video Generation through Relational Alignment with Foundation Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:04.895413Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2505.23656"},"observation_digest":"sha256:358cbf6c29410c02fe4a48e43c1a2199baf7947f319e9947ec12c381b60dce4a","observation_id":"f9a3f170-251e-44e0-964c-d8d060f8bb88","resolution":{"observed_at":"2026-08-07T12:45:04.895413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2506.00433","last_updated":"2026-04-15T21:38:44Z","snapshot_observed_at":"2026-07-06T21:34:10.158018Z","submitted_at":"2025-05-31T07:28:32Z","title":"Latent Wavelet Diffusion For Ultra-High-Resolution Image Synthesis","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-19T12:00:37.025335Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.00433"},"observation_digest":"sha256:73e561e27a5a67235141854fa8431c8f10aa7327bb887c297f36286d501874ef","observation_id":"e4f598ac-8b86-4fea-86e9-ae2af88e63ad","resolution":{"observed_at":"2026-05-19T12:02:16.767815Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T11:54:16.397022Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-09T02:30:41.757787Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:16.397022Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:91c45f8d482dd255bb39a5c5668bf7e8f943da332de59c153a8de2fd5c4b4a6e","observation_id":"13f4c28b-51d2-409c-a6ab-5e75404bc1cc","resolution":{"observed_at":"2026-08-07T11:54:16.397022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T11:54:56.598202Z","title":"Peebles, W","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01182","last_updated":"2025-07-08T20:18:16Z","snapshot_observed_at":"2026-08-09T08:46:08.835639Z","submitted_at":"2025-06-01T21:33:36Z","title":"Humanoid World Models: Open World Foundation Models for Humanoid Robotics","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:56.598202Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.01182"},"observation_digest":"sha256:6ed5b3ed2dc89e5c3bde2f2b60f9470860bf8f4735f3d344de5bb0ade645f319","observation_id":"d1063c36-9b65-4a8f-a1eb-08ceecfdc30b","resolution":{"observed_at":"2026-08-07T11:54:56.598202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T11:49:41.669315Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01380","last_updated":"2025-07-04T14:56:46Z","snapshot_observed_at":"2026-08-09T05:00:23.474295Z","submitted_at":"2025-06-02T07:16:01Z","title":"Playing with Transformer at 30+ FPS via Next-Frame Diffusion","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:49:41.669315Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.01380"},"observation_digest":"sha256:11d7b8e85653792fb8fad75d193bbb80abbd7993f0c4fdf3bf8751abafcd9211","observation_id":"244b70f9-ebf8-4ce1-8757-fca7a6da178c","resolution":{"observed_at":"2026-08-07T11:49:41.669315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T10:50:50.945500Z","title":"Cosmos world foundation model platform for physical ai, 2025.https://arxiv.org/abs/2501.03575","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04363","last_updated":"2025-06-04T18:22:40Z","snapshot_observed_at":"2026-08-07T10:41:45.061614Z","submitted_at":"2025-06-04T18:22:40Z","title":"WorldPrediction: A Benchmark for High-level World Modeling and Long-horizon Procedural Planning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.945500Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.04363"},"observation_digest":"sha256:e745ec140493dbe6da4c49b44adb96a4ca28885169c4ef39d10594c67adac5e2","observation_id":"95e7e55d-1297-4f69-be1c-775a2973b5ea","resolution":{"observed_at":"2026-08-07T10:50:50.945500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T10:42:40.968572Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04611","last_updated":"2025-06-05T04:02:17Z","snapshot_observed_at":"2026-08-07T13:54:09.003484Z","submitted_at":"2025-06-05T04:02:17Z","title":"Revisiting Test-Time Scaling: A Survey and a Diversity-Aware Method for Efficient Reasoning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T10:42:40.968572Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.04611"},"observation_digest":"sha256:2dd019508c3861d5dc0df6b9b24bd509338045cdea1ab8505aa3de0aeac9e21b","observation_id":"2182539b-505d-4ca3-aaaf-b2657f45872e","resolution":{"observed_at":"2026-08-07T10:42:40.968572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T06:07:23.995257Z","title":"Cosmos world foundation model platform for physical AI","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06006","last_updated":"2026-06-03T11:54:47Z","snapshot_observed_at":"2026-08-07T10:25:28.420174Z","submitted_at":"2025-06-06T11:50:18Z","title":"Can VLMs Predict Future States? Bootstrapping World Models from Inverse Dynamics","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:23.995257Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.06006"},"observation_digest":"sha256:3653ecd7e03a760708cb9cacc80806f8b8e142d92d792bb99c4561de4ed080f4","observation_id":"4286e6d7-37ae-4216-b2cc-2fbec26dba99","resolution":{"observed_at":"2026-08-07T06:07:23.995257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T05:47:14.332355Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07136","last_updated":"2025-06-08T13:30:11Z","snapshot_observed_at":"2026-08-09T04:53:18.646207Z","submitted_at":"2025-06-08T13:30:11Z","title":"Hi-VAE: Efficient Video Autoencoding with Global and Detailed Motion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:14.332355Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.07136"},"observation_digest":"sha256:6dd4c130f43818814b2498c2e4e2b981959c7537911cdaa78e5807cdd5beb6a3","observation_id":"bf189677-c2e6-4593-8b7f-a41be0088752","resolution":{"observed_at":"2026-08-07T05:47:14.332355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T05:41:30.982950Z","title":"Cosmos world foundation model platform for physical ai.CoRR, abs/2501.03575, January 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-07T10:25:31.097897Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.982950Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:9d79c1fcaa345c9028ec52c0b6f7a0bab2e92db7f4e569239c1bce3b935b5eea","observation_id":"1194eee9-5f64-4a62-b271-043a3751e3ce","resolution":{"observed_at":"2026-08-07T05:41:30.982950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T05:31:42.352925Z","title":"Cosmos world foun- dation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07886","last_updated":"2025-07-19T15:33:13Z","snapshot_observed_at":"2026-08-07T17:01:29.957060Z","submitted_at":"2025-06-09T15:59:25Z","title":"EgoM2P: Egocentric Multimodal Multitask Pretraining","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:42.352925Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.07886"},"observation_digest":"sha256:fca87add970997bcfa427fb246cbf1937e021ad0b6cc02a02bbfb094f38ce8b9","observation_id":"cf5137c5-86e3-4333-9e18-23dcab4e0c56","resolution":{"observed_at":"2026-08-07T05:31:42.352925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T05:26:02.174857Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07999","last_updated":"2025-06-09T17:59:01Z","snapshot_observed_at":"2026-08-07T14:14:59.427680Z","submitted_at":"2025-06-09T17:59:01Z","title":"MADFormer: Mixed Autoregressive and Diffusion Transformers for Continuous Image Generation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T05:26:02.174857Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.07999"},"observation_digest":"sha256:e95984d0e475cb31576c5fb689c5f0cebfbf65cf9798d1811ca180e4623b6794","observation_id":"e296f37f-7262-4e36-9ab5-699e0e348ad8","resolution":{"observed_at":"2026-08-07T05:26:02.174857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T05:02:20.961334Z","title":"Agarwal, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09042","last_updated":"2025-06-18T17:37:28Z","snapshot_observed_at":"2026-08-07T04:54:23.914784Z","submitted_at":"2025-06-10T17:58:17Z","title":"Cosmos-Drive-Dreams: Scalable Synthetic Driving Data Generation with World Foundation Models","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:02:20.961334Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.09042"},"observation_digest":"sha256:65bbb7e17e0673e1cb20a083934ee233bb506de43e3c95e31d87fb55efe5ebe2","observation_id":"a969e97e-b74a-4849-88ad-4430658d805b","resolution":{"observed_at":"2026-08-07T05:02:20.961334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T04:58:54.075933Z","title":"Agarwal, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09229","last_updated":"2025-06-25T15:46:16Z","snapshot_observed_at":"2026-08-07T04:51:33.082495Z","submitted_at":"2025-06-10T20:34:47Z","title":"Cross-Frame Representation Alignment for Fine-Tuning Video Diffusion Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:54.075933Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.09229"},"observation_digest":"sha256:2e3452520822b82da8973821baaf2f232b14432b56963fdc04b132eba02cbd75","observation_id":"32cabdd5-345d-416c-ad84-abcc019dd647","resolution":{"observed_at":"2026-08-07T04:58:54.075933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T04:48:24.773347Z","title":"arXiv preprint arXiv:2501.03575 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09665","last_updated":"2025-06-16T12:02:05Z","snapshot_observed_at":"2026-08-07T05:41:53.542231Z","submitted_at":"2025-06-11T12:36:49Z","title":"VideoMat: Extracting PBR Materials from Video Diffusion Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:48:24.773347Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.09665"},"observation_digest":"sha256:0b0ffe8751a97a35e558ff7bec5c2fc7d058a9a4e3f5122f3f610e6ceb39f12b","observation_id":"64075647-6577-40f5-bbab-de06c42ae1a8","resolution":{"observed_at":"2026-08-07T04:48:24.773347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T04:43:58.401203Z","title":"Agarwal, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09849","last_updated":"2025-06-11T15:21:16Z","snapshot_observed_at":"2026-08-07T14:02:52.704779Z","submitted_at":"2025-06-11T15:21:16Z","title":"IntPhys 2: Benchmarking Intuitive Physics Understanding In Complex Synthetic Environments","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:43:58.401203Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.09849"},"observation_digest":"sha256:292b98c0520a99e079375991b1c60dc03869628d79ee792af9f24e2171e637c7","observation_id":"f7a93f73-ff0f-464d-b438-24e6dbb99af4","resolution":{"observed_at":"2026-08-07T04:43:58.401203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-11T00:33:50.471804Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.09985"},"observation_digest":"sha256:252ddf655769e59035604ee8b5b153046c1739b210fb29f92118cc6e7589f077","observation_id":"201bc43f-a55d-4a40-abd1-5a4ab1bd16a4","resolution":{"observed_at":"2026-05-11T00:33:50.706975Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T04:17:41.910019Z","title":"Cosmos world foun- dation model platform for physical ai.arXiv preprint arXiv:2501.03575, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10975","last_updated":"2025-06-12T17:59:33Z","snapshot_observed_at":"2026-08-07T04:10:22.736741Z","submitted_at":"2025-06-12T17:59:33Z","title":"GenWorld: Towards Detecting AI-generated Real-world Simulation Videos","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:41.910019Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.10975"},"observation_digest":"sha256:060809fddf05401fd394376181f95f10bdbff2e1d1e3cb5133084b8ff92f98e9","observation_id":"2c9d0627-ec58-446f-bd33-3bbd218ec092","resolution":{"observed_at":"2026-08-07T04:17:41.910019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T00:55:16.991821Z","title":"Agarwal, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12312","last_updated":"2025-06-14T02:22:28Z","snapshot_observed_at":"2026-08-09T04:53:53.558105Z","submitted_at":"2025-06-14T02:22:28Z","title":"Perspective on Utilizing Foundation Models for Laboratory Automation in Materials Research","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T00:55:16.991821Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.12312"},"observation_digest":"sha256:7b9183ad51c172a0ae13e9e09bda490a7e77ad633406b819047a2be7659098e2","observation_id":"4d51a2ba-e790-4222-a9af-b695382d504e","resolution":{"observed_at":"2026-08-07T00:55:16.991821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T00:30:26.225981Z","title":"Cosmos world foundation model platform for physical ai.arXiv preprint arXiv:2501.03575, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14168","last_updated":"2025-06-18T09:44:09Z","snapshot_observed_at":"2026-08-07T22:16:51.604935Z","submitted_at":"2025-06-17T04:08:18Z","title":"VideoMAR: Autoregressive Video Generatio with Continuous Tokens","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:26.225981Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.14168"},"observation_digest":"sha256:6818e9f6a5dfd4218c2b22285f6d5972d89a11e9fdf67363d21bd93659b910a4","observation_id":"2b23abd8-3f55-401d-bffb-a97364c2626b","resolution":{"observed_at":"2026-08-07T00:30:26.225981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T00:25:28.121151Z","title":"Agarwal, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-08T09:57:20.261631Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.121151Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:15ab485f065d9b75dd0af7b86f6503e73597bcd2cb4e48c5f4a9c05ac5b8f1d9","observation_id":"8a349e2f-cf44-4191-9e88-63c8540fcb83","resolution":{"observed_at":"2026-08-07T00:25:28.121151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T23:59:37.011999Z","title":"Cosmos world foundation model platform for physical AI","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15673","last_updated":"2025-06-18T17:56:45Z","snapshot_observed_at":"2026-08-09T08:25:00.126076Z","submitted_at":"2025-06-18T17:56:45Z","title":"UniRelight: Learning Joint Decomposition and Synthesis for Video Relighting","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T23:59:37.011999Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.15673"},"observation_digest":"sha256:3c7b062cebbe2bb4bae92e5ca3960be7900366bf24d1b5c70bddfbf4f912e28f","observation_id":"e084a9d0-7372-4584-8387-a3e17518e62a","resolution":{"observed_at":"2026-08-06T23:59:37.011999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T23:19:59.423764Z","title":"Cosmos: world foundation model platform for physical ai.arXiv preprint arXiv:2501.03575, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18701","last_updated":"2025-06-23T14:40:49Z","snapshot_observed_at":"2026-08-07T02:31:55.435917Z","submitted_at":"2025-06-23T14:40:49Z","title":"Matrix-Game: Interactive World Foundation Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:19:59.423764Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.18701"},"observation_digest":"sha256:c905293c8ee29dc77f33a704e159fa669a02dd186f465a00d32734064ac76619","observation_id":"807b8b19-2ca7-4da7-8abe-da57faf68049","resolution":{"observed_at":"2026-08-06T23:19:59.423764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2506.21539","last_updated":"2025-06-26T17:55:40Z","snapshot_observed_at":"2026-08-07T12:15:14.265779Z","submitted_at":"2025-06-26T17:55:40Z","title":"WorldVLA: Towards Autoregressive Action World Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-11T22:57:07.883617Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.21539"},"observation_digest":"sha256:03c8331d2d06a63173c28bdf92d7b6dcd0178958d89394cd24e26cb51a0ed6e4","observation_id":"ec3b4777-ccef-40fa-bbb0-fd13f8f9a177","resolution":{"observed_at":"2026-05-11T22:57:07.947528Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T21:56:07.501402Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:07.501402Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:60ba44777793c35cc733f10fc4a2de7a95ebcc6c126d9bf02410374b79059da5","observation_id":"2e4c45f8-31e5-4b5a-975f-31b039fcfc9a","resolution":{"observed_at":"2026-08-06T21:56:07.501402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T21:29:46.636813Z","title":"Cosmos world foun- dation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.24113","last_updated":"2025-06-30T17:56:35Z","snapshot_observed_at":"2026-08-08T02:57:16.646869Z","submitted_at":"2025-06-30T17:56:35Z","title":"Epona: Autoregressive Diffusion World Model for Autonomous Driving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:29:46.636813Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.24113"},"observation_digest":"sha256:21fb573c1d02651d7a640dfc0c75dc133353b9e2598395db47ec91dfa9b93129","observation_id":"10c8e198-bb2a-4f56-a575-d78b59a44d09","resolution":{"observed_at":"2026-08-06T21:29:46.636813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T21:28:16.402862Z","title":"Cosmos world foundation model platform for physical ai,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-07T22:12:22.087190Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:16.402862Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:384b61f70c4eb1a55276f821f4ddab16b6506bba84e9c3140fb2fccde26cb441","observation_id":"04808656-9896-405a-b698-c4a2c9708aa9","resolution":{"observed_at":"2026-08-06T21:28:16.402862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T21:09:18.844124Z","title":"Cosmos world foundation model platform for physical ai,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00917","last_updated":"2025-09-03T01:44:58Z","snapshot_observed_at":"2026-08-06T21:00:05.983801Z","submitted_at":"2025-07-01T16:23:00Z","title":"A Survey: Learning Embodied Intelligence from Physical Simulators and World Models","version":3},"reference_index":294,"source":"pdf_text","source_observed_at":"2026-08-06T21:09:18.844124Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.00917"},"observation_digest":"sha256:6d13a705455a2b8acbe2a6a5e01861fdb93620d6b50aa4dfd40371ba8d491a0a","observation_id":"5672c289-a6aa-4547-8b0d-01ff6d2e0014","resolution":{"observed_at":"2026-08-06T21:09:18.844124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T20:37:04.316465Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.02316","last_updated":"2025-07-03T05:01:46Z","snapshot_observed_at":"2026-08-08T00:48:21.298527Z","submitted_at":"2025-07-03T05:01:46Z","title":"Are Synthetic Videos Useful? A Benchmark for Retrieval-Centric Evaluation of Synthetic Videos","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:37:04.316465Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.02316"},"observation_digest":"sha256:31cc3afe5c3e35151c6287a34585d42e763bfa4fda0dc6f2991d9bca488d1844","observation_id":"a6c0ac49-d018-4331-8fcb-3f91c30212e7","resolution":{"observed_at":"2026-08-06T20:37:04.316465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T20:25:23.659772Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.02771","last_updated":"2025-07-03T16:34:34Z","snapshot_observed_at":"2026-08-09T00:45:22.366107Z","submitted_at":"2025-07-03T16:34:34Z","title":"Grounding Intelligence in Movement","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:25:23.659772Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.02771"},"observation_digest":"sha256:907303da799ac01dee9b82e94a04d52a18d82d63ae34de8739e5249fe70ee55d","observation_id":"cbea5d6c-2af4-48c4-a9e3-0f92c51cfc1f","resolution":{"observed_at":"2026-08-06T20:25:23.659772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T20:19:03.343161Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03298","last_updated":"2025-07-04T05:06:15Z","snapshot_observed_at":"2026-08-07T09:19:12.071996Z","submitted_at":"2025-07-04T05:06:15Z","title":"Dyn-O: Building Structured World Models with Object-Centric Representations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:03.343161Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.03298"},"observation_digest":"sha256:8529ff1640d5156976a9afbb03457fc9367d6e229ff31a8084d6b94398c6e391","observation_id":"ed99d9b5-29e1-4a9f-861f-f8e8401cd53f","resolution":{"observed_at":"2026-08-06T20:19:03.343161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T19:42:24.639870Z","title":"Cosmos world foundation model platform for physical ai.arXiv preprint arXiv:2501.03575, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05169","last_updated":"2026-06-17T19:20:50Z","snapshot_observed_at":"2026-08-08T07:42:25.836184Z","submitted_at":"2025-07-07T16:23:46Z","title":"Critique of World Model","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:42:24.639870Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.05169"},"observation_digest":"sha256:eea23691dacdb2d2aa3ca7a865128ede6b5cdde93ed6cef032f67932587073bf","observation_id":"b0d8c5d9-569b-4c5d-85fd-171432c7653b","resolution":{"observed_at":"2026-08-06T19:42:24.639870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T18:58:02.048778Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06830","last_updated":"2025-07-09T13:28:42Z","snapshot_observed_at":"2026-08-07T14:32:02.203442Z","submitted_at":"2025-07-09T13:28:42Z","title":"Physics-Grounded Motion Forecasting via Equation Discovery for Trajectory-Guided Image-to-Video Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T18:58:02.048778Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.06830"},"observation_digest":"sha256:242b7ecf46dfc874e94d85d1c964e4896946727ff5495ed780921686d3eaeddd","observation_id":"f8339469-0154-4c3f-b8f1-fac204824ed7","resolution":{"observed_at":"2026-08-06T18:58:02.048778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2507.07982","last_updated":"2026-05-05T14:55:01Z","snapshot_observed_at":"2026-08-04T10:05:27.686733Z","submitted_at":"2025-07-10T17:55:08Z","title":"Geometry Forcing: Marrying Video Diffusion and 3D Representation for Consistent World Modeling","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-19T05:13:28.767788Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.07982"},"observation_digest":"sha256:daadbe31cefdd53277f32262cf78ddf6e3f14cd78111fa9acde0ef16e533a8a4","observation_id":"f4a82a89-61d6-4790-b488-fad07dea0890","resolution":{"observed_at":"2026-05-19T05:17:06.758003Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T18:32:54.656073Z","title":"Cosmos world foundation model platform for physical ai.arXiv preprint arXiv:2501.03575,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07997","last_updated":"2025-07-14T09:33:58Z","snapshot_observed_at":"2026-08-09T08:02:17.898149Z","submitted_at":"2025-07-10T17:59:54Z","title":"MGVQ: Could VQ-VAE Beat VAE? A Generalizable Tokenizer with Multi-group Quantization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:32:54.656073Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.07997"},"observation_digest":"sha256:792460d2377f1b46d5257d953b5122031aa875168fb5664ffcc67b9af5ce171c","observation_id":"fa25afe9-7edb-429d-bea0-1266cf94a24a","resolution":{"observed_at":"2026-08-06T18:32:54.656073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T18:18:28.491430Z","title":"Cosmos world foundation model platform for physical AI,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08726","last_updated":"2025-07-11T16:26:31Z","snapshot_observed_at":"2026-08-06T23:34:07.839962Z","submitted_at":"2025-07-11T16:26:31Z","title":"Learning human-to-robot handovers through 3D scene reconstruction","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:28.491430Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.08726"},"observation_digest":"sha256:b73d42b73d1dd100c9e1469072154211938c6759441fa70f0656c3a3e48dfe49","observation_id":"2f0afddc-1342-4958-8d1e-b4ec0e7088fc","resolution":{"observed_at":"2026-08-06T18:18:28.491430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T18:10:12.942821Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09068","last_updated":"2025-07-23T13:06:44Z","snapshot_observed_at":"2026-08-07T05:26:16.655495Z","submitted_at":"2025-07-11T23:07:04Z","title":"Infinite Video Understanding","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:12.942821Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.09068"},"observation_digest":"sha256:3baa04cf61c97413bd60c9a4ee8a2281829a38295ecb6ab43a6f93141295c9b3","observation_id":"01d0693d-1a66-4237-85d4-664f63fa52b0","resolution":{"observed_at":"2026-08-06T18:10:12.942821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T17:59:41.742363Z","title":"Available: https://arxiv.org/abs/2501.03575","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09462","last_updated":"2025-07-13T02:59:13Z","snapshot_observed_at":"2026-08-06T17:52:57.659179Z","submitted_at":"2025-07-13T02:59:13Z","title":"MobiWorld: World Models for Mobile Wireless Network","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T17:59:41.742363Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.09462"},"observation_digest":"sha256:ee1c6cbc5841dda28bc41cbb8155b5f31e001b0bed76bce8de225a1cabbf16c6","observation_id":"276ef8b4-8d1d-4c8b-8999-1e05e8846ebf","resolution":{"observed_at":"2026-08-06T17:59:41.742363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T17:34:53.324850Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.10547","last_updated":"2025-07-14T17:59:41Z","snapshot_observed_at":"2026-08-06T19:31:40.096609Z","submitted_at":"2025-07-14T17:59:41Z","title":"Quantize-then-Rectify: Efficient VQ-VAE Training","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:53.324850Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.10547"},"observation_digest":"sha256:6d05358c42595cc99b45998157fbe757bbbc80d06981640a78d0318a0a73ff82","observation_id":"6d13776c-15ee-4bca-b638-36f7d06c1d33","resolution":{"observed_at":"2026-08-06T17:34:53.324850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2507.10722","last_updated":"2026-04-10T03:29:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-14T18:43:05Z","title":"Bridging Brains and Machines: A Unified Frontier in Neuroscience, Artificial Intelligence, and Neuromorphic Systems","version":2},"reference_index":184,"source":"pdf_text","source_observed_at":"2026-05-19T04:37:33.928616Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.10722"},"observation_digest":"sha256:0629a1ecc30b57a30b0b6b3346743dae9cf952ea5e352399b139b0fb50f9a3d2","observation_id":"38d58f02-6377-4c88-8266-ca01c57b2ee7","resolution":{"observed_at":"2026-05-19T04:42:04.946578Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T17:18:50.317023Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11296","last_updated":"2025-07-15T13:21:32Z","snapshot_observed_at":"2026-08-09T01:25:08.809694Z","submitted_at":"2025-07-15T13:21:32Z","title":"Diffusion-Based Imaginative Coordination for Bimanual Manipulation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:18:50.317023Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.11296"},"observation_digest":"sha256:55279d8466b3b9c161d213f7e1663a1ab8357ae8ee33610637301b012c035238","observation_id":"f724913f-e660-45f2-b610-9c76b74a65e6","resolution":{"observed_at":"2026-08-06T17:18:50.317023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T16:30:50.279897Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.13428","last_updated":"2026-05-26T08:34:24Z","snapshot_observed_at":"2026-08-06T16:22:35.916708Z","submitted_at":"2025-07-17T17:54:09Z","title":"\"PhyWorldBench\": A Comprehensive Evaluation of Physical Realism in Text-to-Video Models","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T16:30:50.279897Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.13428"},"observation_digest":"sha256:c38f542dc95712044bfcf3258e7114b5924d9efdc9e2a5ef779f24967e640810","observation_id":"6108ab6a-a227-464e-ae20-e8c38503606b","resolution":{"observed_at":"2026-08-06T16:30:50.279897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T15:27:00.219696Z","title":"Agarwal, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15824","last_updated":"2025-07-21T17:30:46Z","snapshot_observed_at":"2026-08-07T10:31:41.147971Z","submitted_at":"2025-07-21T17:30:46Z","title":"Can Your Model Separate Yolks with a Water Bottle? Benchmarking Physical Commonsense Understanding in Video Generation Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:00.219696Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.15824"},"observation_digest":"sha256:27a7ca7427107ccffc5324b02733c2c288f0a622c28f926a545857ccc2b548eb","observation_id":"dd05d835-036a-4d73-a28f-484ef0c0855e","resolution":{"observed_at":"2026-08-06T15:27:00.219696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T14:45:31.709925Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17744","last_updated":"2025-07-23T17:57:09Z","snapshot_observed_at":"2026-08-06T14:36:41.778601Z","submitted_at":"2025-07-23T17:57:09Z","title":"Yume: An Interactive World Generation Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:31.709925Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.17744"},"observation_digest":"sha256:74f64038a69ca91381d6d20046f182b0dbe27a715474548928f87479becce54e","observation_id":"1b330f06-99a8-433f-a996-18e374455eca","resolution":{"observed_at":"2026-08-06T14:45:31.709925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T14:24:19.930972Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19468","last_updated":"2025-07-25T17:54:10Z","snapshot_observed_at":"2026-08-08T15:35:43.235215Z","submitted_at":"2025-07-25T17:54:10Z","title":"Back to the Features: DINO as a Foundation for Video World Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:24:19.930972Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.19468"},"observation_digest":"sha256:9cf4aa4b7e56972f502d43def189e0b736ec00bfbbae35b3c148fad0f81e2daf","observation_id":"ffa81ed9-aa70-491f-b8cb-3ff58afef1fb","resolution":{"observed_at":"2026-08-06T14:24:19.930972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T13:08:47.960825Z","title":"Cosmos world foundation model platform for physical ai, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20967","last_updated":"2025-07-28T16:22:50Z","snapshot_observed_at":"2026-08-07T05:41:14.324729Z","submitted_at":"2025-07-28T16:22:50Z","title":"PROVCREATOR: Synthesizing Complex Heterogenous Graphs with Node and Edge Attributes","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T13:08:47.960825Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.20967"},"observation_digest":"sha256:f5a2df6302698531d304908e4814f6c1924949d7f9fbf3fa5359eac49761cdf8","observation_id":"1d93675a-5d02-4460-a2d7-560cce27e24a","resolution":{"observed_at":"2026-08-06T13:08:47.960825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T12:26:02.027355Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21809","last_updated":"2025-08-13T09:21:11Z","snapshot_observed_at":"2026-08-06T12:26:01.183840Z","submitted_at":"2025-07-29T13:43:35Z","title":"HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:02.027355Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.21809"},"observation_digest":"sha256:6be4ed03a5f072967d61bb2eaaeca0450caf58b8e2de6db3560c23a36696adbb","observation_id":"8e83fc43-eece-4238-9e7d-4277fd04c5fb","resolution":{"observed_at":"2026-08-06T12:26:02.027355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T05:15:41.372062Z","title":"Cosmos world foun- dation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02094","last_updated":"2025-08-04T06:05:36Z","snapshot_observed_at":"2026-08-08T15:06:07.047501Z","submitted_at":"2025-08-04T06:05:36Z","title":"\"Harmless to You, Hurtful to Me!\": Investigating the Detection of Toxic Languages Grounded in the Perspective of Youth","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T05:15:41.372062Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2508.02094"},"observation_digest":"sha256:f14bba89020f5ecd3ea7bfd0a6cb370e59e2108414ebd93b6db64b8929b6affb","observation_id":"be4d09c0-3d2e-44f3-adea-cc784d8148f5","resolution":{"observed_at":"2026-08-06T05:15:41.372062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T05:12:32.027479Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02095","last_updated":"2025-08-06T19:21:50Z","snapshot_observed_at":"2026-08-08T15:06:09.808299Z","submitted_at":"2025-08-04T06:06:06Z","title":"VLM4D: Towards Spatiotemporal Awareness in Vision Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T05:12:32.027479Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2508.02095"},"observation_digest":"sha256:8124308a0597385def11b0b0b61b1255680e727b8c187d1de39b72b4600bf160","observation_id":"023a61aa-dea6-453f-911a-67a3005c28a2","resolution":{"observed_at":"2026-08-06T05:12:32.027479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T14:29:06.883874Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2508.02324"},"observation_digest":"sha256:43c37ce71098a741bbe092f568ec82f81b4d384fa040be8176df023c01e89f68","observation_id":"88c3cd79-cdf0-4f59-a40d-b06cf58dcd00","resolution":{"observed_at":"2026-05-10T23:38:47.256647Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T23:27:34.279803Z","title":"Cosmos world foundation model platform for physical ai.arXiv preprint arXiv:2501.03575, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.05405","last_updated":"2025-08-07T13:58:19Z","snapshot_observed_at":"2026-08-07T21:23:23.842640Z","submitted_at":"2025-08-07T13:58:19Z","title":"DeepPHY: Benchmarking Agentic VLMs on Physical Reasoning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T23:27:34.279803Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2508.05405"},"observation_digest":"sha256:ef732a950992d66d11f6207251eea82e4d3800c07f94c64f737dfa18934057d9","observation_id":"782a905c-a10e-465f-b814-4353d40c42e0","resolution":{"observed_at":"2026-08-05T23:27:34.279803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2508.05635","last_updated":"2025-11-04T12:01:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-07T17:59:44Z","title":"Genie Envisioner: A Unified World Foundation Platform for Robotic Manipulation","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T21:28:41.904725Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2508.05635"},"observation_digest":"sha256:4835e37793eee35006b391d928b8fda779b67ce40631fe7c270719619dc2d210","observation_id":"a726a1b0-1197-4cf7-b00a-1ea8bc50e8fb","resolution":{"observed_at":"2026-05-15T21:28:41.941408Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T23:17:29.081553Z","title":"Agarwal, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-07T21:51:21.989392Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:29.081553Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:f0f25f0c0f1f59160bdb07adb7b98bda08b205f447375fb62c7304d9dcc657ba","observation_id":"1d82efa8-cf79-4816-a462-52bf55b1e559","resolution":{"observed_at":"2026-08-05T23:17:29.081553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T22:10:17.411409Z","title":", Ali, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07571","last_updated":"2025-08-19T11:54:07Z","snapshot_observed_at":"2026-08-07T21:59:26.623348Z","submitted_at":"2025-08-11T03:05:36Z","title":"Towards Theoretical Understanding of Transformer Test-Time Computing: Investigation on In-Context Linear Regression","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T22:10:17.411409Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2508.07571"},"observation_digest":"sha256:b06b1e501bdcb792a683c179a2337c77500fe5b9516253db5b38d769e5d5fad4","observation_id":"e558eb34-43f5-4d67-99a8-757ea8f54df1","resolution":{"observed_at":"2026-08-05T22:10:17.411409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T21:02:04.810077Z","title":"Cosmos world foundation model platform for physical AI,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.09561","last_updated":"2025-08-13T07:29:40Z","snapshot_observed_at":"2026-08-09T02:42:53.914860Z","submitted_at":"2025-08-13T07:29:40Z","title":"Edge General Intelligence Through World Models and Agentic AI: Fundamentals, Solutions, and Challenges","version":1},"reference_index":168,"source":"pdf_text","source_observed_at":"2026-08-05T21:02:04.810077Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2508.09561"},"observation_digest":"sha256:08a79ea5fd9dc471e09d5b391c57acb33107f12feea75e3917e5cba10415e54c","observation_id":"3103a322-c00a-4cac-8189-0e99aea15310","resolution":{"observed_at":"2026-08-05T21:02:04.810077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T20:20:18.913406Z","title":"Cosmos world foundation model platform for physical ai.arXiv preprint arXiv:2501.03575, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10858","last_updated":"2025-08-14T17:30:37Z","snapshot_observed_at":"2026-08-07T07:22:47.570469Z","submitted_at":"2025-08-14T17:30:37Z","title":"Hierarchical Fine-grained Preference Optimization for Physically Plausible Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T20:20:18.913406Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2508.10858"},"observation_digest":"sha256:328d841580ff2a46301aab3f4a6b8efdc0b36a9e2c1f0b560980aa6de70310d7","observation_id":"d64476b5-49d1-42ef-9c3f-9cfe5d576912","resolution":{"observed_at":"2026-08-05T20:20:18.913406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T20:17:43.268081Z","title":"Cosmos world foundation model platform for physical ai.arXiv preprint arXiv:2501.03575, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10860","last_updated":"2025-08-14T17:31:18Z","snapshot_observed_at":"2026-08-07T19:46:00.567985Z","submitted_at":"2025-08-14T17:31:18Z","title":"From Black Box to Transparency: Enhancing Automated Interpreting Assessment with Explainable AI in College Classrooms","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T20:17:43.268081Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2508.10860"},"observation_digest":"sha256:6776bfa0f49e78bb874b57df4d5d829a936ba8066b73ba0e7bb8d0fa5307e39a","observation_id":"2c4296a2-004f-4801-bd74-854b8d2cd7f1","resolution":{"observed_at":"2026-08-05T20:17:43.268081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T16:41:08.620285Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2508.10934"},"observation_digest":"sha256:b10e741841e473f8f56312b0c5722b4fc6fb496b0a1ceb345bb4580d4d03b002","observation_id":"9183893f-1457-4eb2-9d8f-cea04e2bebd3","resolution":{"observed_at":"2026-05-16T16:41:08.695393Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2508.13009","last_updated":"2026-04-07T11:37:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-18T15:28:53Z","title":"Matrix-game 2.0: An open-source real-time and streaming interactive world model","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T22:36:31.044743Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2508.13009"},"observation_digest":"sha256:9b4736c31110b2dcaefaf8d151e649a28b86a8a15e3c68c1014e8e11ece7b136","observation_id":"a8af67dd-e818-4905-9946-171650e69f48","resolution":{"observed_at":"2026-05-18T22:36:53.350371Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T19:14:34.361533Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.13104","last_updated":"2025-08-18T17:12:28Z","snapshot_observed_at":"2026-08-08T21:34:53.802326Z","submitted_at":"2025-08-18T17:12:28Z","title":"Precise Action-to-Video Generation Through Visual Action Prompts","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T19:14:34.361533Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2508.13104"},"observation_digest":"sha256:9487afdfa37cfaeec33c92963803cff67a12878927cf8a92ee822e04c80683d4","observation_id":"1daa2b1b-c9ed-47ff-9302-d7b07c4255a8","resolution":{"observed_at":"2026-08-05T19:14:34.361533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2508.17588","last_updated":"2026-05-14T09:03:20Z","snapshot_observed_at":"2026-07-06T22:17:57.808775Z","submitted_at":"2025-08-25T01:22:15Z","title":"HERO: Hierarchical Extrapolation and Refresh for Efficient World Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T22:10:16.645510Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2508.17588"},"observation_digest":"sha256:5b5524d92074b07080b7e700725276591338aeffdf7f5dd7fca697340ddbfa63","observation_id":"0f405814-3c69-4ed3-8836-3670c0dcd93b","resolution":{"observed_at":"2026-05-18T22:11:52.772377Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T10:52:02.100197Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03680","last_updated":"2025-09-03T19:59:20Z","snapshot_observed_at":"2026-08-09T08:25:50.746510Z","submitted_at":"2025-09-03T19:59:20Z","title":"LuxDiT: Lighting Estimation with Video Diffusion Transformer","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T10:52:02.100197Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2509.03680"},"observation_digest":"sha256:32379dd7c53f45c27ace338d257d015bd733434395d68372cc76c37afe75fc89","observation_id":"51a8f960-5ebe-4255-a418-2d0284ce4141","resolution":{"observed_at":"2026-08-05T10:52:02.100197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T05:36:52.435440Z","title":"Cosmos world foundation model platform for physical ai,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.05169","last_updated":"2025-09-05T15:09:49Z","snapshot_observed_at":"2026-08-09T01:22:19.431311Z","submitted_at":"2025-09-05T15:09:49Z","title":"Exploring Autoregressive Vision Foundation Models for Image Compression","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T05:36:52.435440Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2509.05169"},"observation_digest":"sha256:922dbc126f291ccd2433943f06a759a14e4762a9c75b079ed4e7310f8fadffc5","observation_id":"8d07c304-da9f-4247-b043-8013e0921c41","resolution":{"observed_at":"2026-08-05T05:36:52.435440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T06:04:02.866781Z","title":"Cosmos world foundation model platform for physical AI.arXiv preprint arXiv:2501.03575, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07996","last_updated":"2026-07-20T17:34:32Z","snapshot_observed_at":"2026-08-07T09:38:31.708978Z","submitted_at":"2025-09-04T17:59:58Z","title":"3D and 4D World Modeling: A Survey","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T06:04:02.866781Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2509.07996"},"observation_digest":"sha256:c2f77dee17446297c1f3b47e5ed12c73e2d0380b4fa174e05be6bc47fa3665bc","observation_id":"eda46ae9-ced9-464a-b77b-f65d436b6b31","resolution":{"observed_at":"2026-08-05T06:04:02.866781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2509.24702","last_updated":"2026-04-06T10:12:03Z","snapshot_observed_at":"2026-08-02T11:34:44.120596Z","submitted_at":"2025-09-29T12:32:54Z","title":"Enhancing Physical Plausibility in Video Generation by Reasoning the Implausibility","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T12:55:42.679016Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2509.24702"},"observation_digest":"sha256:8922472239bd984ce61538e86e9c44b9b89b146dd92b210cb1b7d31e4a4d4bee","observation_id":"5a788f97-59ff-4b64-86ba-6431ab55bc65","resolution":{"observed_at":"2026-05-18T12:56:24.406818Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-04T13:51:52.135555Z","title":"Cosmos world foundation model platform for physical ai.arXiv preprint arXiv:2501.03575, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.24739","last_updated":"2026-07-22T03:37:07Z","snapshot_observed_at":"2026-08-08T13:44:07.425298Z","submitted_at":"2025-09-29T13:03:57Z","title":"Toward a Vision-Language Foundation Model for Medical Data: Multimodal Dataset and Benchmarks for Vietnamese PET/CT Report Generation","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:52.135555Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2509.24739"},"observation_digest":"sha256:771494ede5531c68854bec73dee7e5af17f25b2e7c38087fe704bc4ef36c17ca","observation_id":"64df5fca-a99b-4165-9c84-2164f926d364","resolution":{"observed_at":"2026-08-04T13:51:52.135555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2509.25826","last_updated":"2026-05-14T13:13:15Z","snapshot_observed_at":"2026-08-06T08:14:59.922862Z","submitted_at":"2025-09-30T06:02:26Z","title":"Kairos: Toward Adaptive and Parameter-Efficient Time Series Foundation Models","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T13:21:02.738561Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2509.25826"},"observation_digest":"sha256:aaf70f3c783e6d290c0971430400b7eeca4c27c9ea2b39ca1e3bc7b331632fb9","observation_id":"6453827b-e935-4b90-b87e-1381952a8a0e","resolution":{"observed_at":"2026-05-18T13:21:23.781604Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-04T11:25:33.514720Z","title":"Cosmos world foundation model platform for physical AI","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04961","last_updated":"2026-06-29T15:33:46Z","snapshot_observed_at":"2026-08-04T11:25:31.717369Z","submitted_at":"2025-10-06T15:57:31Z","title":"SSDD: Single-Step Diffusion Decoder for Efficient Image Tokenization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T11:25:33.514720Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2510.04961"},"observation_digest":"sha256:c4e6f50099a374a43f0926a6d472409a8ca71ed8285d7545dbf1a9d89be7dd8a","observation_id":"afd23de3-b2cc-4395-9129-b0f4404e7310","resolution":{"observed_at":"2026-08-04T11:25:33.514720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2510.05094","last_updated":"2026-05-21T08:23:12Z","snapshot_observed_at":"2026-08-01T23:38:17.815297Z","submitted_at":"2025-10-06T17:57:59Z","title":"VChain: Chain-of-Visual-Thought for Reasoning in Video Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T13:19:50.252345Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2510.05094"},"observation_digest":"sha256:07d336bb00d9b2c3b8f223812529f9cc1daac13d00ee2135eb14653c637ab5ea","observation_id":"cad30db5-7e0d-47a5-aa2c-b4e6a4c5b74d","resolution":{"observed_at":"2026-05-22T13:21:35.661138Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2510.08431","last_updated":"2026-05-06T15:49:52Z","snapshot_observed_at":"2026-08-06T18:36:14.975364Z","submitted_at":"2025-10-09T16:45:30Z","title":"Large Scale Diffusion Distillation via Score-Regularized Continuous-Time Consistency","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-18T08:46:16.541104Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2510.08431"},"observation_digest":"sha256:ac1b9c89a58ea41f1538338296aca24a053e598e2c16f67f9dad8c340ff56dd7","observation_id":"62134817-4749-42ed-a948-0a647c7ae0ff","resolution":{"observed_at":"2026-05-18T08:51:09.155679Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2510.10125","last_updated":"2026-03-01T08:24:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-11T09:13:10Z","title":"Ctrl-World: A Controllable Generative World Model for Robot Manipulation","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T01:14:10.174044Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2510.10125"},"observation_digest":"sha256:7424310a08602c7bf870453b89adec3680b6ea21248b66a85ff08c4e1847b147","observation_id":"cb8ef6e5-5063-4c47-b854-74fbad2a2bca","resolution":{"observed_at":"2026-05-16T01:14:10.550114Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-04T07:54:30.449145Z","title":"Cosmos world foundation model platform for physical ai.arXiv preprint arXiv:2501.03575,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.24108","last_updated":"2026-07-08T06:19:04Z","snapshot_observed_at":"2026-08-07T05:50:37.378935Z","submitted_at":"2025-10-28T06:26:36Z","title":"Zero-Human Demonstration End-to-end Autonomous Driving with Trajectory Scorer","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T07:54:30.449145Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2510.24108"},"observation_digest":"sha256:63523d3a44b7fbf7e5680a6b1c9010226bdba6294fa2366688084bd180beda77","observation_id":"d6c2b98c-7420-43ca-ab21-8a9e0bd5f380","resolution":{"observed_at":"2026-08-04T07:54:30.449145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2510.24211","last_updated":"2026-05-05T17:15:37Z","snapshot_observed_at":"2026-07-06T22:34:13.674208Z","submitted_at":"2025-10-28T09:26:27Z","title":"Speculative Coupled Decoding for Training-Free Lossless Acceleration of Autoregressive Visual Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T03:20:35.021120Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2510.24211"},"observation_digest":"sha256:a770d3597c059d5166612f99f3bb3a6666574454fd1ea1049139849ef3670c73","observation_id":"83f7ae15-d0ae-425b-a7b1-22c1e2a35cef","resolution":{"observed_at":"2026-05-18T03:20:48.732645Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2511.00062","last_updated":"2026-02-24T21:52:50Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-10-28T22:44:13Z","title":"World Simulation with Video Foundation Models for Physical AI","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-12T23:01:13.546110Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2511.00062"},"observation_digest":"sha256:7a98b3b1d05a9983f3863c096d47ff162f43363da0c9713f13ef74546561b3a2","observation_id":"6f8d0196-3608-45c3-a9f9-cdf0d070daea","resolution":{"observed_at":"2026-05-12T23:01:13.716640Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2511.08704","last_updated":"2026-05-17T23:05:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-11T19:11:02Z","title":"Rethinking Generative Image Pretraining: How Far Are We From Scaling Up Next-Pixel Prediction?","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-21T18:17:53.581119Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2511.08704"},"observation_digest":"sha256:56df2f36e81ba486d1af9bfcdf5ef76c03d8e6168ae1e703a3dbceda67803647","observation_id":"756e2c06-caf1-4485-8a01-b0dcfa310336","resolution":{"observed_at":"2026-05-21T18:20:29.138865Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2511.16520","last_updated":"2026-05-12T03:36:08Z","snapshot_observed_at":"2026-07-06T22:36:30.947164Z","submitted_at":"2025-11-20T16:35:57Z","title":"Saving Foundation Flow-Matching Priors for Inverse Problems","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-17T20:36:13.408128Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2511.16520"},"observation_digest":"sha256:b24045c9f1c17b8f4f9186f908bdf83d9bc391df43d4d2b1eb9f4b04f721d214","observation_id":"5c57004e-ad8f-4ff7-91ab-003a995d78e4","resolution":{"observed_at":"2026-05-17T20:40:15.123284Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-03T20:59:49.860461Z","title":"Cosmos world foundation model platform for physical AI.arXiv preprint arXiv:2501.03575,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.17502","last_updated":"2026-05-30T03:49:39Z","snapshot_observed_at":"2026-08-03T20:59:48.866420Z","submitted_at":"2025-11-21T18:59:32Z","title":"RynnVLA-002: A Unified Vision-Language-Action and World Model","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T20:59:49.860461Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2511.17502"},"observation_digest":"sha256:101fe648d22aa6cb6ed51afbf0ded80b5d6adb89f001fcf249344632be8b2dc7","observation_id":"a5fcd7b0-61c9-4d43-856c-684c59195325","resolution":{"observed_at":"2026-08-03T20:59:49.860461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.03575/citation-record","integrity":"/paper/2501.03575/integrity","json":"/paper/2501.03575/citation-record.json","paper":"/paper/2501.03575"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.09540","last_updated":"2023-03-22T17:22:35Z","snapshot_observed_at":"2026-08-06T15:07:40.203199Z","submitted_at":"2023-03-16T17:53:24Z","title":"SemDeDup: Data-efficient learning at web-scale through semantic deduplication","version":3},"cited_work":{"arxiv_id":"2303.09540","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.09540","snapshot_observed_at":"2026-07-09T03:05:54.898931Z","title":"SemDeDup: Data-efficient learning at web-scale through semantic deduplication","venue":"cs.LG","work_id":"492d4320-a8d4-4094-b226-ea8d784560d9","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2303.09540","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:02d5f7c7c4d02137d43998bb9e3bb0eb8a987c4ae588ac6637c91370fd26e68e","observation_id":"b9eddad2-76cb-4889-99c8-a678007a23f1","resolution":{"observed_at":"2026-05-18T02:43:31.136179Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11704","last_updated":"2024-08-06T22:37:06Z","snapshot_observed_at":"2026-08-01T16:04:10.873571Z","submitted_at":"2024-06-17T16:25:04Z","title":"Nemotron-4 340B Technical Report","version":2},"cited_work":{"arxiv_id":"2406.11704","doi":"10.48550/arxiv.2406.11704","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Anh, Pallab Bhattacharya, Annika Brundyn, Jared Casper, Bryan Catanzaro, Sharon Clay, Jonathan Cohen, et al","venue":"arXiv (Cornell University)","work_id":"f462f380-6529-48f1-a3ff-1c847606a77e","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2406.11704","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:ce8952e7c297953a0dfdeeb4c0d413f4f9089cff8fdcdc7f7a707528c7117d60","observation_id":"d1a7fd91-439a-4324-839e-3360cddc9da9","resolution":{"observed_at":"2026-05-10T23:38:45.226532Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:25:26.583481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:25:26.583481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07073","last_updated":"2024-10-10T17:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-09T17:16:22Z","title":"Pixtral 12B","version":2},"cited_work":{"arxiv_id":"2410.07073","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.07073","snapshot_observed_at":"2026-07-04T13:59:52.216141Z","title":"Pixtral 12B","venue":"cs.CV","work_id":"9ad2b071-82d8-4cfa-b994-b9975094b575","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2410.07073","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:745d9744e0c99a75b466c9df29b1eb85d756735d1c5e27c7dfc9d2064b30ad5a","observation_id":"76d9eb47-b380-48e9-8d31-8ffadc314883","resolution":{"observed_at":"2026-05-14T23:53:29.932651Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bbc planet earth dataset","venue":null,"work_id":"b9404a0b-80da-4f82-ab89-4da072e0b23f","year":2016},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:bf46201c046b984eda6cff0b8d21dcdee725869298a57a9c49c33964d23a4ba0","observation_id":"b8248dc6-b877-4311-91ff-ad33d19df6b9","resolution":{"observed_at":"2026-05-10T23:38:46.954091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion for world modeling: Visual details matter in atari","venue":null,"work_id":"400f3a2a-a3b3-4971-bc4b-e343b8c103af","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:068067dca8312473bb8ebd056b969daad14923e1b848c06ffb425fe598373e63","observation_id":"6efd1fdc-cf2f-4d05-a6c2-ec65ee35ac70","resolution":{"observed_at":"2026-05-10T23:38:46.960688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08477","last_updated":"2023-04-18T03:27:52Z","snapshot_observed_at":"2026-07-06T15:16:38.500909Z","submitted_at":"2023-04-17T17:57:06Z","title":"Latent-Shift: Latent Diffusion with Temporal Shift for Efficient Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":"2304.08477","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.08477","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Latent- shift: Latent diffusion with temporal shift for efficient text-to-video generation","venue":null,"work_id":"bedd3bfc-5b36-4f28-80c6-ccc058c0b411","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2304.08477","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:38c5c40cba261b5eae1ad38566baf06bb9b2c3202a1c3078c6682527eede3de1","observation_id":"f0494f37-92a4-4ff7-a3d6-915ed3006afd","resolution":{"observed_at":"2026-05-10T23:38:45.256610Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07126","last_updated":"2024-11-11T16:58:31Z","snapshot_observed_at":"2026-07-06T19:48:32.368124Z","submitted_at":"2024-11-11T16:58:31Z","title":"Edify Image: High-Quality Image Generation with Pixel Space Laplacian Diffusion Models","version":1},"cited_work":{"arxiv_id":"2411.07126","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.07126","snapshot_observed_at":"2026-07-03T00:47:30.400558Z","title":"Edify image: High-quality image generation with pixel space laplacian diffusion models","venue":null,"work_id":"e07c55c7-533e-4182-9a44-b5440d29a1f4","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2411.07126","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:c72698f1e3648d4523799d33d2e3fc3453615be4f71110f0c4747b2cdeef45f0","observation_id":"9fa0fb77-f2be-4623-9000-9911990835d7","resolution":{"observed_at":"2026-05-10T23:38:45.273741Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:f9dbc1e25245f0586afd9ef59ddd7c639273213eac4b4cce87129e39f9494abe","observation_id":"cf7f9cde-43d7-4a40-921f-1846801b588a","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03572","last_updated":"2025-04-11T19:20:22Z","snapshot_observed_at":"2026-08-06T18:01:55.599924Z","submitted_at":"2024-12-04T18:59:45Z","title":"Navigation World Models","version":2},"cited_work":{"arxiv_id":"2412.03572","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03572","snapshot_observed_at":"2026-07-10T18:47:31.603869Z","title":"Navigation world models","venue":"cs.CV","work_id":"f794fe98-fcf4-4284-8187-3e937b00c828","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2412.03572","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:7d6f2be69a668a8d4b6e2b21563033f9c81c6a5bfa013e52660d408d2d3a41ca","observation_id":"8d2efc41-4c23-47e5-89e2-3780ca54d986","resolution":{"observed_at":"2026-05-10T23:38:45.293773Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving image generation with better captions.Computer Science","venue":null,"work_id":"fe5c3315-197d-4241-89af-f4b7e2f6532e","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:6782fdf42fb501d7103bce37ba9168a971b2a687591636315b0e3b2cdd20361a","observation_id":"44af0301-d311-4d46-a3f7-1583e5c2ae40","resolution":{"observed_at":"2026-05-10T23:38:47.032345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zero-shot robotic manipulation with pre-trained image-editing diffusion models","venue":null,"work_id":"01bca36f-4eeb-4674-87bc-ff51de7768da","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:dc37ec374979dc99f7f42c8e33e9eadd688739b197f37e630e8d81cc5366475f","observation_id":"5d9fd3bb-f132-439c-a9af-8c5c96f2ee6e","resolution":{"observed_at":"2026-05-10T23:38:47.050351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":"2311.15127","doi":"10.48550/arxiv.2311.15127","metadata_source":"pith","pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","venue":"cs.CV","work_id":"4f68eada-27e3-437a-a2fe-6e4ca524d0d3","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:aea469c3d7c67e00b379e54251aa0b0f774447124c5c3f5b97b99be43b23fc5f","observation_id":"82540ea0-d2ca-4dd0-b9b6-1a4ebb59f932","resolution":{"observed_at":"2026-05-10T23:38:45.307012Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Align your latents: High-resolution video synthesis with latent diffusion models","venue":null,"work_id":"3c8fdb1a-fcf7-470d-ab4b-651b7281afc3","year":null},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:3ef4e97e09f796ce3b90ccce1cddec666040358e6590cbae9e404f7e5f1796fd","observation_id":"8907886e-a7aa-47a4-95d0-fdc8a09b4772","resolution":{"observed_at":"2026-05-10T23:38:47.077346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"134085af-e64c-46f9-9a97-10660fe99835","year":null},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:c9f0b58fca0cbd575df6b31c5fad6a38544467dc4a11a3dc2cf313dbc1b1a81a","observation_id":"97be606c-2830-4c56-81e2-a1217a4a21c8","resolution":{"observed_at":"2026-05-10T23:38:47.103360Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video generation models as world simulators","venue":null,"work_id":"b0b166eb-1689-4efb-9236-594f0eaf38ed","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:6f591115a05a93b25781d5a03b8d533d8f7f56be7376c03051ccbdc092d6d655","observation_id":"24ff8b8c-8423-454a-abab-5bbac740306e","resolution":{"observed_at":"2026-05-10T23:38:47.112379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language models are few-shot learners","venue":null,"work_id":"90e1fe20-6d5f-49ea-970a-9d42ac4260a2","year":2020},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:a5a7a3b3c56d0becebb1b7de690dc207f9e449eed0c64f620ae796a8730e368a","observation_id":"7b001c47-7138-46fc-b888-302c1c553f15","resolution":{"observed_at":"2026-05-10T23:38:47.125359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Genie: Generative interactive environments","venue":null,"work_id":"5692bf8c-4375-4cfa-8c00-ed1b1d754ddd","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:43c3c97db55c3f4d6b076fea06bc58369ed6e76f38e8609fefee6635aa92aade","observation_id":"c510d33b-5c7b-4c81-918e-6bbdc0952019","resolution":{"observed_at":"2026-05-10T23:38:47.138349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lee, Deming Chen, and Tri Dao","venue":null,"work_id":"4b9656c6-3831-4c55-84b1-a01ade141afb","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:3c6f4b1ded9617af37d82994f7d96ed0ea9998eb1f5a7c51383c91fb7ae6c638","observation_id":"db82a035-dd8e-4187-ba25-023dbe0e05d9","resolution":{"observed_at":"2026-05-10T23:38:47.146855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pyscenedetect","venue":null,"work_id":"5167cda2-ca19-4676-a2ab-ff031e9d9630","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:06291217bb4112f018246342ff0324400c6e37093cb73a4ce5a27ed50aab23cb","observation_id":"f45fb0e2-4feb-4837-9304-8db4035cc461","resolution":{"observed_at":"2026-05-10T23:38:47.156354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"58a6fff1-bc88-4a40-a587-3cdd604343b0","year":2022},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:32756756ff3b87a574813c421c551322f35add0368ae26831917bd844d56c77b","observation_id":"082efe4e-f27d-4cdd-902e-c9c115d9211a","resolution":{"observed_at":"2026-05-10T23:38:47.160400Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"pixelsplat: 3d gaussian splats from image pairs for scalable generalizable 3d reconstruction","venue":null,"work_id":"2fdf98f2-2276-417e-873e-46992dc450d3","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:ad7747ac8e375e23097ba6d898f631a953c94b254a396e64d64a765486cec0ff","observation_id":"3a08caa9-f224-41a1-a58b-ea867f4fce90","resolution":{"observed_at":"2026-05-10T23:38:47.166349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06158","last_updated":"2024-10-08T16:00:47Z","snapshot_observed_at":"2026-08-03T02:22:13.984027Z","submitted_at":"2024-10-08T16:00:47Z","title":"GR-2: A Generative Video-Language-Action Model with Web-Scale Knowledge for Robot Manipulation","version":1},"cited_work":{"arxiv_id":"2410.06158","doi":"10.48550/arxiv.2410.06158","metadata_source":"pith","pith_arxiv_id":"2410.06158","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GR-2: A Generative Video-Language-Action Model with Web-Scale Knowledge for Robot Manipulation","venue":"cs.RO","work_id":"843ab5eb-2815-4db8-b3bc-890b23fa5ffa","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2410.06158","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:67eaa81d6aaf62fff17e7434dda7753749e63ecfa8f739e9e11d0e23a998517e","observation_id":"0d1d4298-c3d0-4f38-b305-c9920570d619","resolution":{"observed_at":"2026-05-12T01:09:34.215368Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-22T23:23:05.602157+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T23:23:05.602157+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1604.06174","last_updated":"2016-04-22T19:21:36Z","snapshot_observed_at":"2026-08-08T09:03:25.135475Z","submitted_at":"2016-04-21T04:15:27Z","title":"Training Deep Nets with Sublinear Memory Cost","version":2},"cited_work":{"arxiv_id":"1604.06174","doi":"10.48550/arxiv.1604.06174","metadata_source":"pith","pith_arxiv_id":"1604.06174","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training Deep Nets with Sublinear Memory Cost","venue":"cs.LG","work_id":"f2c5c287-a500-40e4-a136-e7e3172db1d7","year":2016},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/1604.06174","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:1b2ef5fabc92302a29d4f31c95885130b73d3a0e1bdcadc4f19cfea81e6647ea","observation_id":"df32755f-f906-4059-9229-11da98eeece8","resolution":{"observed_at":"2026-05-12T03:44:07.405726Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-21T12:26:33.666045+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T12:26:33.666045+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.10972","last_updated":"2023-05-21T07:07:55Z","snapshot_observed_at":"2026-08-08T02:32:31.177380Z","submitted_at":"2023-01-26T07:37:22Z","title":"On the Importance of Noise Scheduling for Diffusion Models","version":4},"cited_work":{"arxiv_id":"2301.10972","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.10972","snapshot_observed_at":"2026-07-07T18:04:00.522746Z","title":"On the importance of noise scheduling for diffu- sion models","venue":"cs.CV","work_id":"1783cbc7-505c-4ebc-82f3-86877ef131b3","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2301.10972","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:350218d2030e83140f036267f5a2ed610f18c20c3ac3850186abfc7f3f0f9b4a","observation_id":"610c0e48-b34e-48b6-be5f-9aab5e2955e9","resolution":{"observed_at":"2026-05-10T23:38:45.368038Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Panda-70m: Captioning 70m videos with multiple cross-modality teachers","venue":null,"work_id":"1e2a44e4-682b-4010-a73e-a8160e5a6d18","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:9c2b268ffeb2acb6df13beec32f730c2719b550bdaa5b4e225a46fe30424960b","observation_id":"68e5fbf5-4dff-4f0f-a559-1e7c26f17cb3","resolution":{"observed_at":"2026-05-10T23:38:47.194838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion.RSS","venue":null,"work_id":"ef0986a1-d242-4579-baf5-51042ecc5245","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:e7be61f809a3fabb2aef35683e681b7a223e2d937473351bd26bba744150dff9","observation_id":"fd0ccab1-fe39-4eb6-9969-9a718150bb5a","resolution":{"observed_at":"2026-05-10T23:38:47.201403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15807","last_updated":"2023-09-27T17:30:19Z","snapshot_observed_at":"2026-08-02T11:54:13.342379Z","submitted_at":"2023-09-27T17:30:19Z","title":"Emu: Enhancing Image Generation Models Using Photogenic Needles in a Haystack","version":1},"cited_work":{"arxiv_id":"2309.15807","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.15807","snapshot_observed_at":"2026-07-08T05:54:33.464514Z","title":"Emu: Enhancing Image Generation Models Using Photogenic Needles in a Haystack","venue":"cs.CV","work_id":"ae882a46-08bc-4ec0-a38c-72bc9eec3afe","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2309.15807","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:2c77cfa139e189f2b9cd3f074d563ad54f829efda0034bff7c71c55c3c070c2d","observation_id":"74b91a0b-aac7-4316-90e4-3e26a37af673","resolution":{"observed_at":"2026-05-10T23:38:45.377347Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1604.08859","last_updated":"2016-05-27T15:17:34Z","snapshot_observed_at":"2026-07-06T04:54:36.252884Z","submitted_at":"2016-04-29T14:53:00Z","title":"The Z-loss: a shift and scale invariant classification loss belonging to the Spherical Family","version":2},"cited_work":{"arxiv_id":"1604.08859","doi":null,"metadata_source":"pith","pith_arxiv_id":"1604.08859","snapshot_observed_at":"2026-07-02T11:36:55.184529Z","title":"The Z-loss: a shift and scale invariant classification loss belonging to the Spherical Family","venue":"cs.LG","work_id":"2fb3fc57-0a1c-4cb8-a8f8-003d0ede3061","year":2016},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/1604.08859","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:3335476be35747cf4d98db4e7619e7797ca1cca1309f5f70c4cc1ea388b160c2","observation_id":"9a568bc0-fb85-4164-9823-5d8aa4abe361","resolution":{"observed_at":"2026-05-10T23:38:45.394809Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling vision transformers to 22 billion parameters","venue":null,"work_id":"9cb22036-fe67-467a-8c67-f917a88c6a91","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:8bdaa99fbdebd7987b3bc7b267a0e603360642a5b3c335a108e8c4a6a022363b","observation_id":"3e634f34-4f4c-4401-822e-87f9a4f806fc","resolution":{"observed_at":"2026-05-10T23:38:47.218259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14169","last_updated":"2025-03-02T08:09:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T18:59:53Z","title":"Autoregressive Video Generation without Vector Quantization","version":2},"cited_work":{"arxiv_id":"2412.14169","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.14169","snapshot_observed_at":"2026-07-05T11:41:02.772589Z","title":"Autoregressive Video Generation without Vector Quantization","venue":"cs.CV","work_id":"11db2d86-1589-4095-8111-fa80171a943f","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2412.14169","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:66ea228dd3a72aa14dc7d31dcfc272a1cf21cb204638b976319390f86c73d3ef","observation_id":"351ca4d4-d0e0-43e3-b8ea-cdfbfb372e8c","resolution":{"observed_at":"2026-05-17T15:07:39.939813Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"8bd6cc48-2bf3-4401-ad8f-4fe073f683a9","year":2009},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:36ad4778b6868140c2b6f5b93fd5d300459f4b1c8afcc20b681f7737ef0eca22","observation_id":"f0919126-1aa5-4eea-be12-28b9dc668c4b","resolution":{"observed_at":"2026-05-10T23:38:47.226707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Retinaface: Single-stage dense face localisation in the wild.CVPR","venue":null,"work_id":"2363a896-955a-4560-9666-63a5f4969611","year":2020},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:dc22094f134b7695159c94978fda97f61bd86de7ec316b86f4c17af0b2675f86","observation_id":"42020881-2bce-4ab7-86f2-b28455c74624","resolution":{"observed_at":"2026-05-10T23:38:47.231215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Superpoint: Self-supervised interest point detection and description","venue":null,"work_id":"67835d1f-ddc6-417e-a7b2-80d812ac6478","year":2018},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:9280edbbead4474cd82ab85931224ad8f03bd99a0e309b3edfdec672347729b6","observation_id":"131fd15d-901f-48ce-8280-e7f4fbc4bcd0","resolution":{"observed_at":"2026-05-10T23:38:47.240577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03570","last_updated":"2024-10-15T20:56:47Z","snapshot_observed_at":"2026-08-02T12:07:35.477265Z","submitted_at":"2024-02-05T22:43:57Z","title":"Diffusion World Model: Future Modeling Beyond Step-by-Step Rollout for Offline Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2402.03570","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.03570","snapshot_observed_at":"2026-07-03T18:38:49.868506Z","title":"arXiv preprint arXiv:2402.03570 , year=","venue":null,"work_id":"539002ec-5bee-4bd4-ba32-9d068c677cbd","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2402.03570","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:56b449a0de4f9d5c8baaabd367401121024c62d0529139b661e591a0daf4e6f5","observation_id":"5481f156-04b8-48e8-a82e-f270de850db1","resolution":{"observed_at":"2026-05-10T23:38:45.413511Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An image is worth 16x16 words: transformers for image recognition at scale","venue":null,"work_id":"68fce94d-7581-4ac9-9484-4e30f910791a","year":2021},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:c63ee8a70733335e573b6b7da9cd58ffeb021a207fa2795316019ab9a32b3b2f","observation_id":"a97cd7aa-e6e6-4248-a7f3-ae9150f3d901","resolution":{"observed_at":"2026-05-10T23:38:47.251179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning universal policies via text-guided video generation","venue":null,"work_id":"d120c28c-193e-4962-b0a3-166c94fc8c82","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:ec5577615d70517e7717b6e33f42965e9ac4c045372240db742e9ecba9817306","observation_id":"f6fe4fe4-14b2-4d62-b9d3-f0e7f5c79cd4","resolution":{"observed_at":"2026-05-16T01:20:29.447628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:6a447eda0b7bba25ed4feae651a67303b15f3822cb4f854162125d46a7bd048d","observation_id":"b403a2cb-1c99-478b-b0bf-44738389745c","resolution":{"observed_at":"2026-05-10T23:38:45.422498Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bridge data: Boosting generalization of robotic skills with cross-domain datasets","venue":null,"work_id":"39fec523-0d42-4b4c-9a3a-8efdc9d3ae5e","year":2022},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:49b086946a28bd5296ea95df806568f8c231ca1e37b1bbb189bb6f0183dddc2f","observation_id":"585782af-4b38-427a-a647-45a3e5edf30c","resolution":{"observed_at":"2026-05-16T01:20:29.479120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"5531bb02-ea71-47ed-a25c-5989aa0be89e","year":2021},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:40693a55081f86f2ebd75d38f89c3cc356cb5a4d85cf0ba86423c5757a38c006","observation_id":"7692dfdc-dafe-4b03-967c-a37691e03551","resolution":{"observed_at":"2026-05-16T01:20:29.531141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":"62a59bb4-eef4-4b17-bb27-d1f99c170fce","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:cbd0a7db8a4458a086209737b8d9e7d59a944d57624c593c9edf2a20f0e3f50e","observation_id":"3791fcb7-9592-4788-9496-2d62610ab126","resolution":{"observed_at":"2026-05-16T01:20:29.362308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Two-frame motion estimation based on polynomial expansion","venue":null,"work_id":"8a8c30bf-8f8c-450e-8fe8-580c22aa2839","year":2003},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:adcee2b21ca0337d92da0fc32c00a74624c48e59e11f9f145c7d3a977bee946d","observation_id":"1ac09ec0-84e0-4eb0-bcd2-b33870d039a4","resolution":{"observed_at":"2026-05-16T01:20:29.474704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep visual foresight for planning robot motion","venue":null,"work_id":"0bf65ec2-157d-47c4-8277-317fba82fc3a","year":2017},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:3918de00709010cd5af89234f27ad95d9d2cbf8f8dd50103bf9100833367b58d","observation_id":"327fb231-5d79-474e-b826-a73383ac6036","resolution":{"observed_at":"2026-05-16T01:20:29.475477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FLUX.1: Image generation","venue":null,"work_id":"e6eac7a1-cdf9-490f-91f5-8ce272da5772","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:16b14ccdb38addc82a4cbd0f5fd7e566120d709ec37779c72c4a0a1638e6c497","observation_id":"3d79f949-f051-4164-89cf-ba8b3f6329f6","resolution":{"observed_at":"2026-05-16T01:20:29.521517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dreamsim: Learning new dimensions of human visual similarity using synthetic data","venue":null,"work_id":"2434e05b-04e2-4310-bd6e-bc89b02e0040","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:560af1d89039621d63ab6621a0c24894fbf2586a2435096c3d6719eed37075a0","observation_id":"d9c09137-44a6-4317-a1a7-eab79132a116","resolution":{"observed_at":"2026-05-16T01:20:29.366304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Datacomp: In search of the next generation of multimodal datasets","venue":null,"work_id":"5a0480ee-3a05-4523-b881-01895272e8ad","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:a51ee26d36b58688e22a528bc28129905936f04f403d8a4c2d0529499b4630ba","observation_id":"41cc40ae-4f80-4429-98bb-b4268818dce9","resolution":{"observed_at":"2026-05-16T01:20:29.517500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Make-a-scene: Scene-based text-to-image generation with human priors","venue":null,"work_id":"1c2d04b7-4257-4669-8721-d7c15d738703","year":2022},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:6a4b60621edf62de395f8cafc415bbfa00a99015042990b8b6f62794a60e66b3","observation_id":"3e58b3af-452c-48f5-a3fe-33af67801cad","resolution":{"observed_at":"2026-05-16T01:20:29.548648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A new algorithm for data compression.The C Users Journal","venue":null,"work_id":"30f7f08e-1bc1-43d9-b0e5-f26298b3073f","year":1994},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:9ef3fbdf1e2669879496bdf6a35134b7c987ee4ddc07a2054e0271ecd257023a","observation_id":"7e0c643b-a5a5-4b66-b1a7-b77ca8068e58","resolution":{"observed_at":"2026-05-16T01:20:29.427828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Murphy, and Tim Salimans","venue":null,"work_id":"135e025c-bdf4-4d64-9969-2b5d5f2cef4a","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:7ab56965aee9761bef6d462793f08e02e2fb9a8a0c5fdbf7242d081b29de4ce0","observation_id":"a061fda2-7525-411b-b07d-d61826ecd72f","resolution":{"observed_at":"2026-05-16T01:20:29.503457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13807","last_updated":"2025-07-25T02:30:46Z","snapshot_observed_at":"2026-08-08T02:56:46.319344Z","submitted_at":"2024-11-21T03:13:30Z","title":"MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control","version":4},"cited_work":{"arxiv_id":"2411.13807","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.13807","snapshot_observed_at":"2026-07-08T03:24:28.746664Z","title":"MagicDrive-V2: High-resolution long video generation for autonomous driving with adaptive control.arXiv preprint arXiv:2411.13807, 2024a","venue":"cs.CV","work_id":"30a8dda9-0d8d-47c2-aa13-68a7ce5f65dd","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2411.13807","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:441e11b4082ed501b308a3669d81d8ce9f8155bb836e2323fbb3d8ca97c45e80","observation_id":"09e0f4a1-c4a4-45c4-b6c3-c6c62c124c8b","resolution":{"observed_at":"2026-05-10T23:38:45.431062Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Magicdrive: Street view generation with diverse 3d geometry control","venue":null,"work_id":"960d2bc1-f037-4dbf-bcfe-f4facdeb09d9","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:0b569815e7f513874d0de848649b670d8eafd6ad35c2e3584032ba84e78aefc3","observation_id":"052f054b-77b5-40f2-b58d-192145f5dc0e","resolution":{"observed_at":"2026-05-16T01:20:29.499767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vista: A generalizable driving world model with high fidelity and versatile controllability","venue":null,"work_id":"bdf4e201-6122-4854-9cd9-237b75623f2b","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:26cf9465cb9eb3cea364f421205f993f08b9e65b3a655f7d3ef83e6f5af8253a","observation_id":"917ffa15-80ca-4f3e-945d-7ca6ada99ebb","resolution":{"observed_at":"2026-05-16T01:20:29.508533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Image style transfer using convolutional neural networks","venue":null,"work_id":"fc43c6f8-822e-49a7-8bcb-490c4c137df2","year":2016},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:0a6f1e1f536bcc8fc07599a74447e4dd10ef86e1f793d0dc04e8c3ba9ed6a8da","observation_id":"7efcc68e-0777-4923-90dc-da561c561e9a","resolution":{"observed_at":"2026-05-16T01:20:29.491965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Long video generation with time-agnostic vqgan and time-sensitive transformer","venue":null,"work_id":"10fd1b63-ae81-4669-8af8-613b41ecf758","year":2022},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:905c02c3e3970b0ddb3e62a6b92f21954bd319b9b44ace658c7016cd0f2b90fd","observation_id":"8419c0a4-cbfe-435e-b835-8f2cc198a026","resolution":{"observed_at":"2026-05-16T01:20:29.441584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Preserve your own correlation: A noise prior for video diffusion models","venue":null,"work_id":"fcd6d8d8-eea0-43a1-9060-79b21d9b8527","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:60409baf87892ea20958f68830a0ebd53e07cc7357f25d350f79376fc3ef371b","observation_id":"a7b15757-ef00-4560-b4a7-59310c3b1dd4","resolution":{"observed_at":"2026-05-16T01:20:29.471705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual fact checker: Enabling high-fidelity detailed caption generation","venue":null,"work_id":"efc63d72-b66b-46d5-94f5-7b1593170597","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:9fb324f655640429236e15319212cc4971f23e0bf70113c80047772947dbe22c","observation_id":"bb242d0a-a2b3-4b03-9913-3f5b3f4abce5","resolution":{"observed_at":"2026-05-16T01:20:29.420285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05993","last_updated":"2024-09-11T14:42:29Z","snapshot_observed_at":"2026-08-09T05:46:29.961103Z","submitted_at":"2024-04-09T03:54:28Z","title":"AEGIS: Online Adaptive AI Content Safety Moderation with Ensemble of LLM Experts","version":2},"cited_work":{"arxiv_id":"2404.05993","doi":"10.48550/arxiv.2404.05993","metadata_source":"pith","pith_arxiv_id":"2404.05993","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AEGIS: Online Adaptive AI Content Safety Moderation with Ensemble of LLM Experts","venue":"cs.LG","work_id":"1ccd11c8-18f7-4764-989f-140f3f59c730","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2404.05993","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:74a9a0db783316f427a897a5facb7c7dd07c6b3714dbd8dca99a181052293ecd","observation_id":"c38e0513-05f2-4a38-8b44-ff848401c888","resolution":{"observed_at":"2026-05-10T23:38:45.444469Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagebind: One embedding space to bind them all","venue":null,"work_id":"c6afec7b-ae1b-4dec-9d69-feb3d67d41e3","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:7db9f07ecd60c4d970b543b4493aac9ffbd135cdc469f455c9f4cc00e36e090a","observation_id":"f6763656-85ec-4941-81a1-d5b0e763cb35","resolution":{"observed_at":"2026-05-16T01:20:29.556492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emu video: Factorizing text-to-video generation by explicit image conditioning","venue":null,"work_id":"b6a727cf-18f3-4e1f-b41f-6c3dfb4fa7c8","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:5ec0927ec66b6e7fe5505a8d5c5b6f75202d9384e094b92c958e19c9240e6c80","observation_id":"20df0eaf-79b7-4907-8ccb-70d10a214247","resolution":{"observed_at":"2026-05-16T01:20:29.540196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ego-exo4d: Understanding skilled human activity from first-and third-person perspectives","venue":null,"work_id":"ec5d7356-79ac-4b17-92e8-45d16cbe8b58","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:55894a2926dccc9861eb6e97bf0d97c91b65cd82e9511817d84f036cf9e14212","observation_id":"eecd8030-5738-4296-9b79-c6da8741e23a","resolution":{"observed_at":"2026-05-16T01:20:29.495940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":"290479b1-39fc-4f44-9967-68dd771d79d7","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:2f85ef8acb6dd4cbf7fd11ecdffe6a5382003c186dce21e4ef12b6b8d2dbb1c4","observation_id":"d636bb7a-7ddd-4903-a7ee-df722c13e080","resolution":{"observed_at":"2026-05-16T01:20:29.544202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pre-trained text-to-image diffusion models are versatile representation learners for control","venue":null,"work_id":"6397af65-e985-4e1f-b0a5-0182b81eb60a","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:227bb99dfc30b3808133802e6e8ea4ac2b448ab83df52134e578cf81a3a5b3f4","observation_id":"71ac6de8-988a-4710-837c-de74d6a31447","resolution":{"observed_at":"2026-05-16T01:20:29.483224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SPACE:Speech-driven Portrait Animation with Controllable Expression","venue":null,"work_id":"22e8e1a9-4681-4c0b-a182-b0ccbfb02b8a","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:31e413aa178039d83a51fbe517c323994925733fa2081c0746c6fba46ded2f50","observation_id":"01b8d6ca-8679-4bb8-bc57-9d7a95f16fa0","resolution":{"observed_at":"2026-05-16T01:20:29.401003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":"1803.10122","doi":"10.48550/arxiv.1712.00409","metadata_source":"pith","pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"World Models","venue":"cs.LG","work_id":"07227eee-8445-4c98-bce4-c6a6fd5ed907","year":2018},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:71444b431a66840e12ee39283d201aefc558ceb6e7d623ee17dc95551e0726c2","observation_id":"1cd3b051-b359-4c21-991a-c774a606a1f2","resolution":{"observed_at":"2026-05-11T03:08:36.665942Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-09T02:21:17.479736Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"cited_work":{"arxiv_id":"1912.01603","doi":"10.48550/arxiv.1912.01603","metadata_source":"pith","pith_arxiv_id":"1912.01603","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","venue":"cs.LG","work_id":"5103f4be-344a-4139-8504-eaa59f5bac9d","year":2019},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/1912.01603","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:74a8c6f156943b6ec7ae4dc51870fd2c4560d69f6b4429340fe36f332b7a5ed2","observation_id":"4bf1f6d6-0a88-45e8-8516-61591075103a","resolution":{"observed_at":"2026-05-12T01:16:36.618198Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mastering atari with discrete world models","venue":null,"work_id":"8c57042f-cafb-4fb7-99af-c6a2ee592984","year":2021},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:4cfa8a1f3586f1ea5bb71b98ddf4c95c8ed749f3908a510cdc64720891beed77","observation_id":"1b88f61f-2bcd-4d2a-a1ac-a3dad34dff1d","resolution":{"observed_at":"2026-05-16T01:20:29.430428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":"2301.04104","doi":"10.1126/sciadv.adu2488","metadata_source":"pith","pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mastering Diverse Domains through World Models","venue":"cs.AI","work_id":"6aeb260f-8c7c-4f9c-b98b-067cd7c59acd","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:502bc5094d153cd39f1c0e2b3d647d758becbff74664c0f710c5d6d82d059d66","observation_id":"122bdbad-d14d-4b14-9a82-23007c0ebf3b","resolution":{"observed_at":"2026-05-11T09:08:22.800194Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Td-mpc2: Scalable, robust world models for continuous control","venue":null,"work_id":"a300e643-85f3-4395-b3ed-f8ed44527689","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:61458955833de7501566bd4da3fea2923a71cdcc443d463b55c9710e837ee884","observation_id":"edfa3c1e-a956-4442-8e01-695c33dcb755","resolution":{"observed_at":"2026-05-16T01:20:29.453439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cambridge university press","venue":null,"work_id":"313eec90-1c96-42a1-9323-ba7f8d2a9537","year":2003},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:5ae9aa6de4f5c8dce954e3af18bbbbe718114a86ac04152bbbf5a595a3170f57","observation_id":"c884df7d-420d-43b2-b2dc-e9f2dbe0ed98","resolution":{"observed_at":"2026-05-16T01:20:29.525849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-07-06T17:54:39.685251Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":"2404.02101","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-07-10T01:46:41.167891Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","venue":"cs.CV","work_id":"1c05c278-c023-4ef0-a359-25a41f1065eb","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:cb81e3378a56f4e38b03b40ce042cb34e97b48bed540c1781e512b34c6291d8f","observation_id":"11282f87-2687-45a5-a525-cb7e44d96d25","resolution":{"observed_at":"2026-05-13T02:06:24.067006Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning an actionable discrete diffusion policy via large-scale actionless video pre-training","venue":null,"work_id":"f4e1fe1d-e1be-49e4-8d4f-fcdda062152c","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:d1b8b31aac24b77ccfc9f9e4b57fbdd6a369362cb2275e596605477411e28c95","observation_id":"bba45182-89b5-48e0-932b-838544dfd566","resolution":{"observed_at":"2026-05-16T01:20:29.391013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"1e7929d4-6a68-4e3f-b689-6fabd51cfcdb","year":2022},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:ed0019594d3d9b3cff1d5216cec3796f91df6d4318153ede70cd189c58fddf44","observation_id":"0ac13db5-4cf7-4b4e-987b-26417e0e75c1","resolution":{"observed_at":"2026-05-16T01:20:29.484329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":"9472564a-a26b-495c-ae6f-1788d4b9ce9f","year":2017},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:8564c15ee89ad5db15bc5d46b8dc82182141692cef74d7fc59443065fd0249e1","observation_id":"00f28e15-78dc-4604-acd8-d2a850d7f5b5","resolution":{"observed_at":"2026-05-16T01:20:29.535933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"wake-sleep","venue":null,"work_id":"4a70b95c-c546-4098-be97-9c56b4fc2138","year":1995},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:29e6206ee2d626e70454554beab2d6bb333ecdb0b632bb782c37cabbf271aa8d","observation_id":"b959d73d-d7c9-4306-a626-96b50251e9d9","resolution":{"observed_at":"2026-05-16T01:20:29.487460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":"2207.12598","doi":"10.1109/cvpr52733.2024.02494","metadata_source":"pith","pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Classifier-Free Diffusion Guidance","venue":"cs.LG","work_id":"acf2c588-c088-4a6c-938e-150ad7c666d7","year":2022},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:07b9cd65411652a3c83708a63dd86865b8e53cbbf2d32cb3f7035e63e160621f","observation_id":"e9f131af-e71d-402b-8206-6ec61072c4a5","resolution":{"observed_at":"2026-05-10T23:38:45.494382Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":"ddd66d31-0e76-4b44-940e-b777810d0b86","year":2020},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:275e7331140ae72a7eb102e1039e2b44d6dd196e543b7e84d783c9fba5cc8160","observation_id":"c7a204ae-f586-430e-aff6-27a1dac0a726","resolution":{"observed_at":"2026-05-16T01:20:29.436107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video diffusion models","venue":null,"work_id":"0ae8cfc0-a215-4a87-9367-bc10e98ab4ce","year":2022},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:a29343b671b181cfc09a5340c22477c3aa9cfd4f19a17cfc5b673d93be3a741d","observation_id":"e694479b-d138-4d0d-98db-aeadf1da4a02","resolution":{"observed_at":"2026-05-16T01:20:29.462831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cogvideo: Large-scale pretraining for text-to-video generation via transformers","venue":null,"work_id":"1a04fd45-4173-445c-ae75-9aadece2981e","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:c45658184e5518b97f2cc876c86890cd4b97415104cc3993d67309465f51dfcf","observation_id":"8fb25a0f-7222-4691-9deb-742c3600272c","resolution":{"observed_at":"2026-05-16T01:20:29.560558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simple diffusion: End-to-end diffusion for high resolution images","venue":null,"work_id":"c1444676-7486-4110-9f03-a2320eb1f318","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:29035c1077ec38a3e20dfe7923948c3859a50fd412287b01d0c9f4a2f55c662d","observation_id":"162e0e9c-1f84-464a-bd31-c3ede4134fca","resolution":{"observed_at":"2026-05-16T01:20:29.471142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19324","last_updated":"2025-03-22T19:42:20Z","snapshot_observed_at":"2026-07-06T19:39:33.077694Z","submitted_at":"2024-10-25T06:20:06Z","title":"Simpler Diffusion (SiD2): 1.5 FID on ImageNet512 with pixel-space diffusion","version":2},"cited_work":{"arxiv_id":"2410.19324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.19324","snapshot_observed_at":"2026-07-07T18:04:00.512591Z","title":"Simpler diffusion (SiD2): 1.5 FID on ImageNet512 with pixel-space diffusion","venue":"cs.CV","work_id":"745ef26a-c245-4843-a44d-629a12795773","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2410.19324","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:163bab711385d08217ebf78d6375338d6048841899b12c6c1ef1be87ead8a99e","observation_id":"8ffd52d9-526e-4394-99e8-712bbd521c8e","resolution":{"observed_at":"2026-05-10T23:38:45.501344Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2309.17080","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-07-10T11:47:02.949785Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","venue":"cs.CV","work_id":"313484e6-a442-4522-8e19-d07e502844a8","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:19695fa53984e4d406c466a93b7b8cad3dbdf2f6b5e09a5ae03edac6389d0282","observation_id":"eb161c84-38d1-4100-bda3-dab8034346ed","resolution":{"observed_at":"2026-05-12T07:15:10.779550Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":"91560ce3-39dd-451d-b70b-02404050cd22","year":2022},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:a6d922d77ed0f1da6b44d0ad358b666d30017acbbe672248f0493025e555d916","observation_id":"9a07989a-0508-4b42-86d2-5b744b87a199","resolution":{"observed_at":"2026-05-16T01:20:29.451531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03645","last_updated":"2024-10-04T17:51:33Z","snapshot_observed_at":"2026-07-06T19:27:52.298292Z","submitted_at":"2024-10-04T17:51:33Z","title":"GenSim2: Scaling Robot Data Generation with Multi-modal and Reasoning LLMs","version":1},"cited_work":{"arxiv_id":"2410.03645","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03645","snapshot_observed_at":"2026-07-03T11:58:05.915157Z","title":"Gensim2: Scaling robot data generation with multi-modal and reasoning llms.arXiv preprint arXiv:2410.03645","venue":null,"work_id":"68d8b754-1f66-4e21-a31b-65d770c4960d","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2410.03645","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:079d337a1b33df2c7d8059ffa91da1278025e0725b8aa7fd0c731adb1f125e07","observation_id":"6412333a-37af-4624-9afa-a6bef513e673","resolution":{"observed_at":"2026-05-10T23:38:45.524063Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":"13db9a63-93bb-45c0-aaf9-ce44b79acbe5","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:9c78bd856db412ce0cd88129a339898dfdb990b4b5de3caac5fc8b3ccb47afcc","observation_id":"c126c200-4f63-41a8-9780-7af978d91c6d","resolution":{"observed_at":"2026-05-16T01:20:29.564785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:e87cc00a888264da4ca538de230b9673244d37c1f23e370171ff2e7a27df935e","observation_id":"c077c955-8436-4525-b0ca-a0fd153a664d","resolution":{"observed_at":"2026-05-10T23:38:45.530796Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14509","last_updated":"2023-10-04T16:51:13Z","snapshot_observed_at":"2026-08-04T19:27:31.715261Z","submitted_at":"2023-09-25T20:15:57Z","title":"DeepSpeed Ulysses: System Optimizations for Enabling Training of Extreme Long Sequence Transformer Models","version":2},"cited_work":{"arxiv_id":"2309.14509","doi":"10.48550/arxiv.2309.14509","metadata_source":"pith","pith_arxiv_id":"2309.14509","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSpeed Ulysses: System Optimizations for Enabling Training of Extreme Long Sequence Transformer Models","venue":"cs.LG","work_id":"bb119d0b-c7f0-412a-a426-f74bd6949a51","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2309.14509","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:5b2b855f6da1c2e3b5c6e620cc1037219b0fcb7539d6405b6c896c20f29a749f","observation_id":"5cb2648e-9301-4a93-8528-17243aacb2eb","resolution":{"observed_at":"2026-05-13T01:07:22.650116Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13549","last_updated":"2023-11-22T17:44:29Z","snapshot_observed_at":"2026-07-06T16:51:15.252642Z","submitted_at":"2023-11-22T17:44:29Z","title":"ADriver-I: A General World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2311.13549","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.13549","snapshot_observed_at":"2026-07-01T09:55:40.884710Z","title":"Adriver-i: A general world model for autonomous driving","venue":null,"work_id":"e601ca37-4a47-4d11-aefc-857f5ca5501a","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2311.13549","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:b29475b6f15d86753b40482bebfb23d40afe8ed6bc3dbe24339166a32f6e3864","observation_id":"747c2d4e-dcdc-4926-b9f2-09752f00729a","resolution":{"observed_at":"2026-05-10T23:38:45.553921Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":"2310.06825","doi":"10.48550/arxiv.2310.06825","metadata_source":"pith","pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mistral 7B","venue":"cs.CL","work_id":"eb5e1305-ad11-4875-ad8d-ad8b8f697599","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:a1f309c94c9b2a95a57551a4a68aa916527048b560385b0962c08da9c453d32a","observation_id":"8cccda4b-da3c-42a0-a2f1-5dba18b811e7","resolution":{"observed_at":"2026-05-10T23:38:45.559658Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:12.282824+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:12.282824+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02385","last_updated":"2025-06-22T03:30:55Z","snapshot_observed_at":"2026-08-02T22:45:54.982294Z","submitted_at":"2024-11-04T18:53:05Z","title":"How Far is Video Generation from World Model: A Physical Law Perspective","version":2},"cited_work":{"arxiv_id":"2411.02385","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.02385","snapshot_observed_at":"2026-07-08T07:14:45.230404Z","title":"How Far is Video Generation from World Model: A Physical Law Perspective","venue":"cs.CV","work_id":"4459ec7e-7a67-4b25-9c04-e91d87bf1b63","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2411.02385","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:171b653a68d8b998784e02e43fa332b659bea7c5f4d3dfc45c91edbd4341eef8","observation_id":"bf0fded8-bb87-4995-8ca2-da5b34d34525","resolution":{"observed_at":"2026-05-20T11:13:41.491170Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":"2001.08361","doi":"10.1145/3616855.3635845","metadata_source":"pith","pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Laws for Neural Language Models","venue":"cs.LG","work_id":"b7dd8749-9c45-4977-ab9b-64478dce1ae8","year":2020},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:af9616347b4e7579f541c8326e39c63e2f406d6c07a3ed3c38ed5cc57cd23ad8","observation_id":"77c7af6d-1fa0-45e2-a2eb-b79dd46bf9f3","resolution":{"observed_at":"2026-05-10T23:38:45.577077Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Analyzing and improving the image quality of stylegan","venue":null,"work_id":"eb6ed6c6-223d-40d9-8548-a67633b06475","year":2020},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:d9d5d3061260a917ec0efac84cc5e069fd67a355798b87f4e10b9b7a79ade865","observation_id":"cb7d58f3-d100-4925-9604-bc3dbdd0df0c","resolution":{"observed_at":"2026-05-10T23:38:46.219507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Elucidating the design space of diffusion-based generative models","venue":null,"work_id":"b0ccb756-4ca1-4b0e-aab8-5c7de581bb3c","year":2022},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:f93fdaaf86934c80e22f3bd00d0d666488d0bd5760d7f8cd72ffe3f9f0b404f6","observation_id":"eaebe424-dd94-4215-af7e-f4b7ad315ba7","resolution":{"observed_at":"2026-05-10T23:38:46.236004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Analyzing and improving the training dynamics of diffusion models","venue":null,"work_id":"ac54fe4d-683a-4d1e-808e-c2b4942f621a","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:43434f621a4b47613bb4aa48e5511b9e77d063d4ed46cc232853190c9ae701a6","observation_id":"f48f9da6-31ba-4f65-bf5e-34f43a025811","resolution":{"observed_at":"2026-05-10T23:38:46.241534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d diffuser actor: Policy diffusion with 3d scene representations","venue":null,"work_id":"8645d054-7b76-47b8-b531-81578860407a","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:6c2c8a5668e8aaf5fe80d3b49e4e1a9c3a6afa5668db554336f651b1b8eaf427","observation_id":"d0944257-c6c4-4007-ac27-6d8db6044f2f","resolution":{"observed_at":"2026-05-10T23:38:46.253128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d gaussian splatting for real-time radiance field rendering.ACM Transactions on Graphics (TOG)","venue":null,"work_id":"c0419252-f569-48d9-bbd6-2d174a90266b","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:e30e34b5f041a1dc414a99291cfb354f33765f0819780751b8c20a508b0d7c18","observation_id":"1b849c64-4670-4591-82a1-601b4c16b9ae","resolution":{"observed_at":"2026-05-10T23:38:46.261429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17725","last_updated":"2024-10-23T09:55:22Z","snapshot_observed_at":"2026-07-06T19:38:22.461739Z","submitted_at":"2024-10-23T09:55:22Z","title":"YOLOv11: An Overview of the Key Architectural Enhancements","version":1},"cited_work":{"arxiv_id":"2410.17725","doi":"10.48550/arxiv.2410.17725","metadata_source":"pith","pith_arxiv_id":"2410.17725","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"YOLOv11: An Overview of the Key Architectural Enhancements","venue":"cs.CV","work_id":"17e84c13-a2a4-4b25-9b05-ca4ca212abfa","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2410.17725","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:a02481357770db3e1ae5346ead8f6bfc75619edd45ea6d8a1dcd83a744ff1be4","observation_id":"2e255add-5a32-4427-a3be-bab393a1f6fa","resolution":{"observed_at":"2026-05-12T13:29:16.418786Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-16T22:51:55.782635+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-16T22:51:55.782635+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":"2406.09246","doi":"10.18653/v1/2022.naacl-main.68","metadata_source":"pith","pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","venue":"cs.RO","work_id":"3e7e65c5-5aed-4fe9-8414-2092bcb31cc7","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:6ad6936b373368229deac3b9b8288cac2e382d16ecf749628ea0dd6867f8b14d","observation_id":"752045ee-252c-4ac9-8516-4dccea3b3dc9","resolution":{"observed_at":"2026-05-10T23:38:45.595747Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to Simulate Dynamic Environments with GameGAN","venue":null,"work_id":"b7455336-d1ff-43e5-996d-9ebec2dc13db","year":2020},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:ae12683169a0e902f304079366222c1f6191570294cf1c9d21f2a2679b510919","observation_id":"8ee927dc-3969-497a-ae2e-cdfc08a66b50","resolution":{"observed_at":"2026-05-10T23:38:46.295756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DriveGAN: Towards a Controllable High-Quality Neural Simulation","venue":null,"work_id":"c918c58e-fbb1-4f2d-b234-2b6b0509cb5e","year":2021},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:2f72404b3aa5bc026a359642f269bf18637b7b152be9550ad383435f3bf1f050","observation_id":"e36484a6-c7e1-4902-b27b-112c6787ae3c","resolution":{"observed_at":"2026-05-10T23:38:46.308459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":"1312.6114","doi":"10.2139/ssrn.4269703","metadata_source":"pith","pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Auto-Encoding Variational Bayes","venue":"stat.ML","work_id":"97d95295-30e1-42b4-bbf6-85f0fa4edb44","year":2013},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:1983a07a1f78b8f594249a7baf346b80345e3479218fb30b96ca5de865889df8","observation_id":"c8ab99c4-d22a-4efc-8137-a9b8fda50ff8","resolution":{"observed_at":"2026-05-10T23:38:45.606393Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to act from actionless videos through dense correspondences","venue":null,"work_id":"105ae973-4c82-4a98-8c96-fa8102c4cc78","year":2024},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:bf79b360c5909aa045defa0d0c5c6df019a7c1f44e2ed871e04ccb5798ff1f2f","observation_id":"ba229324-e554-46c4-8eea-fb3ec7296d31","resolution":{"observed_at":"2026-05-10T23:38:46.337589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":34,"verified_fuzzy":63},"total_outbound_references":253},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 100 of 253 outbound references and 100 inbound Pith citation observations for arXiv:2501.03575."}