{"as_of":"2026-08-22T00:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:90efe0c73df6ef9642c4c3959d967c4f8289b05140d9baac2ebe9d21cb12f40a","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T00:28:52.368199Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07693/citation-record","integrity":"/paper/2608.07693/integrity","json":"/paper/2608.07693/citation-record.json","paper":"/paper/2608.07693"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.02800","last_updated":"2026-06-23T17:33:32Z","snapshot_observed_at":"2026-07-06T23:43:07.940839Z","submitted_at":"2026-06-01T19:12:30Z","title":"Cosmos 3: Omnimodal World Models for Physical AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.02800","snapshot_observed_at":"2026-08-11T00:28:52.119049Z","title":"arXiv preprint arXiv:2606.02800 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.119049Z"},"links":{"cited_paper":"/paper/2606.02800","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:6becb2d0cf3913660bd97155fb5770ed24ef037ce89b58a366c5a9d149486fe0","observation_id":"5114e2d1-e760-4e48-acb8-8b32b51d7523","resolution":{"observed_at":"2026-08-11T00:28:52.119049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-11T00:28:52.123300Z","title":"arXiv preprint arXiv:2501.03575 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.123300Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:5b5b16145cd47ed943875fde2f2c1f9105b7f051699362add8b12741afbbfd78","observation_id":"bab81321-6972-42f4-8af1-b713f9d49b15","resolution":{"observed_at":"2026-08-11T00:28:52.123300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.00062","last_updated":"2026-02-24T21:52:50Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-10-28T22:44:13Z","title":"World Simulation with Video Foundation Models for Physical AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.00062","snapshot_observed_at":"2026-08-11T00:28:52.127337Z","title":"arXiv preprint arXiv:2511.00062 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.127337Z"},"links":{"cited_paper":"/paper/2511.00062","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:a3614077f1a6a38f77ab9ad4824d57deadd09bd8ac079ed33de9f7dfd099a2d0","observation_id":"53fca354-ddde-4ed5-bc1f-381bcbda9ad2","resolution":{"observed_at":"2026-08-11T00:28:52.127337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-08-15T13:40:01.739055Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09985","snapshot_observed_at":"2026-08-11T00:28:52.132240Z","title":"arXiv preprint arXiv:2506.09985 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.132240Z"},"links":{"cited_paper":"/paper/2506.09985","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:f5a028ba1063cde936a62b0d13434507591a029e43e2ed7026f8029319d7182e","observation_id":"670c768c-4898-4a74-b46a-9b975552bbfd","resolution":{"observed_at":"2026-08-11T00:28:52.132240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08471","last_updated":"2024-02-15T18:59:11Z","snapshot_observed_at":"2026-08-17T22:50:34.371081Z","submitted_at":"2024-02-15T18:59:11Z","title":"Revisiting Feature Prediction for Learning Visual Representations from Video","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08471","snapshot_observed_at":"2026-08-11T00:28:52.137205Z","title":"arXiv preprint arXiv:2404.08471 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.137205Z"},"links":{"cited_paper":"/paper/2404.08471","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:e49ed73153078ef9b9aa68db284eaf63fc934fa8e12b53a12e3f0a62d2fce3d6","observation_id":"7d659554-f610-43d8-9360-8cedd6204624","resolution":{"observed_at":"2026-08-11T00:28:52.137205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.142017Z","title":"In: Forty-first International Conference on Machine Learning (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.142017Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:50bdb293d60ef70e7d8e9c73cc128b182f9baf82f119ce2216f3486cf233ea6c","observation_id":"ea775f49-9686-4f48-a658-e3450dd6c1f2","resolution":{"observed_at":"2026-08-11T00:28:52.142017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:53.122696Z","title":"In: 2025 IEEE/CVF International Conference on Computer Vision (ICCV)","venue":null,"work_id":"dd64b5d1-e934-4361-9a0e-a6c6c36dcffc","year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.146829Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:67404420a3a020f1d4e87e1b9107db80b07dc58e0edda18a9ce17c97009a476c","observation_id":"0c94acfd-76e4-4e3a-881f-f253212dcf20","resolution":{"observed_at":"2026-08-11T00:28:53.126774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:53.110692Z","title":null,"venue":null,"work_id":"a30a912c-7aff-48e3-ab02-bada0bfb1b99","year":2023},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.151343Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:bc862e69b48e97d92140b199500fea98a6d749860618de46bc5eaa8750d03227","observation_id":"b24e5919-05e5-4788-92ed-b433b1da512c","resolution":{"observed_at":"2026-08-11T00:28:53.114636Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:53.099650Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) Workshops","venue":null,"work_id":"bad82d37-5868-4464-bfa9-e80057f6efb8","year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.155526Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:ccc98dda9328c9dd42cc62cc9eef469c8a7a553b05d1ebdd77d1e4f9860b2b30","observation_id":"66eeb85a-51d3-4e5e-aee6-ef6be885b3aa","resolution":{"observed_at":"2026-08-11T00:28:53.103464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:53.088832Z","title":"In: Proceedings of the IEEE/CVF Con- ference on Computer Vision and Pattern Recognition (CVPR) Workshops (2024)","venue":null,"work_id":"6cccb735-76f3-47f2-a868-b9468d107ca7","year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.159818Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:5157d544d66d87ee512e8a39bafa8ef6855e48ccad226a739852748746427cbb","observation_id":"492bc989-037c-4a5f-9cb7-46cff9a6953a","resolution":{"observed_at":"2026-08-11T00:28:53.092557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.00568","last_updated":"2018-12-03T06:06:25Z","snapshot_observed_at":"2026-08-21T02:01:36.833225Z","submitted_at":"2018-12-03T06:06:25Z","title":"Visual Foresight: Model-Based Deep Reinforcement Learning for Vision-Based Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.00568","snapshot_observed_at":"2026-08-11T00:28:52.164114Z","title":"arXiv preprint arXiv:1812.00568 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.164114Z"},"links":{"cited_paper":"/paper/1812.00568","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:a0be95bc579b8b7ec5813cdb8eea24ccab30187a4d1aec434116b907473b4f13","observation_id":"026093d5-85da-49b8-a918-ccf99902662f","resolution":{"observed_at":"2026-08-11T00:28:52.164114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.168603Z","title":"In: Scott, D., Bel, N., Zong, C","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.168603Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:e58017fd84bc9a8c388682f97726cfd0d24cfc9f4db3177427044e01ab92a390","observation_id":"d9d8f766-832b-43d5-871d-abb1d9a8409d","resolution":{"observed_at":"2026-08-11T00:28:52.168603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.172367Z","title":"Advances in Neural Information Processing Systems37, 91560–91596 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.172367Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:1e75425bc4f2422bd1c2ae313967cda060c11f4e37fe749592243e5b2ab4800e","observation_id":"ca702a8c-f055-4e9b-8c7e-b6342615838f","resolution":{"observed_at":"2026-08-11T00:28:52.172367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-08-18T07:04:58.690133Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-11T00:28:52.175473Z","title":"arXiv preprint arXiv:1803.101222(3), 440 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.175473Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:68b1be94d05dc0bb5281e111cf05bd2103b2dff0cbbde4d9c30c4903b50fcade","observation_id":"c564d5f2-ffb7-46b9-bef3-ad3b8701a8a6","resolution":{"observed_at":"2026-08-11T00:28:52.175473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-20T13:32:55.916408Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01603","snapshot_observed_at":"2026-08-11T00:28:52.178821Z","title":"arXiv preprint arXiv:1912.01603 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.178821Z"},"links":{"cited_paper":"/paper/1912.01603","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:1e60723a7011f25895a4e5bea892b5c1580a8141d4d906c0fc2e7e9a523a4bcf","observation_id":"d4606d31-95a8-42de-a39b-876956dbb865","resolution":{"observed_at":"2026-08-11T00:28:52.178821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.182698Z","title":"In: International conference on machine learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.182698Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:51324387f1cd8d6f19a3bb60d5263b065fc71c6b1f2e50daeb74f5e87f356416","observation_id":"9bc85d5f-fcfd-4132-b970-b5d3fd4b2fc1","resolution":{"observed_at":"2026-08-11T00:28:52.182698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.186103Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.186103Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:1fef35e5ca9eb14ca996480247ac78ebb379678e19e786da5ac0812464eb3b7d","observation_id":"fcef585c-b50d-4ff8-9cb2-bf7c5e3d5db8","resolution":{"observed_at":"2026-08-11T00:28:52.186103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08718","last_updated":"2022-03-23T19:47:21Z","snapshot_observed_at":"2026-07-06T11:01:02.207193Z","submitted_at":"2021-04-18T05:00:29Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08718","snapshot_observed_at":"2026-08-11T00:28:52.189450Z","title":"ArXivabs/2104.08718(2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.189450Z"},"links":{"cited_paper":"/paper/2104.08718","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:ec8edaa3bac194671378378712db15791f0e739ae2e0f104c03e0c1fb392421b","observation_id":"0ebc8c3e-9285-411f-ba57-44f7e333479d","resolution":{"observed_at":"2026-08-11T00:28:52.189450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.08500","last_updated":"2018-01-12T14:05:44Z","snapshot_observed_at":"2026-08-14T20:51:33.836666Z","submitted_at":"2017-06-26T17:45:23Z","title":"GANs Trained by a Two Time-Scale Update Rule Converge to a Local Nash Equilibrium","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.08500","snapshot_observed_at":"2026-08-11T00:28:52.193180Z","title":"ArXivabs/1706.08500(2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.193180Z"},"links":{"cited_paper":"/paper/1706.08500","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:8ba913bf36bd06e8daf2d3ce07995724b989c00eeeb9ab6f606d1592db833ebb","observation_id":"1bfc4238-772c-4ac9-b885-e35e69e9262b","resolution":{"observed_at":"2026-08-11T00:28:52.193180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.197338Z","title":"In: NeurIPS (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.197338Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:1f216f746ac87f7291dddb8077a3c4669006e886f3ed306011b9e8622a28530c","observation_id":"499d24d8-4abf-4ef9-95c3-07b0bf47171d","resolution":{"observed_at":"2026-08-11T00:28:52.197338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-08-11T00:28:52.201807Z","title":"URL https://arxiv","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.201807Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:17ac596000489b2a1e675d24b5167b19d324f3453136a41d3861d0dc6ee2a95a","observation_id":"07c2bde5-a90c-4463-b5fc-5d7ef8b8c303","resolution":{"observed_at":"2026-08-11T00:28:52.201807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.206297Z","title":"In: ICLR (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.206297Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:f5f299dd4b413f2546ba06a2cb5a19b78e8ed25efe0fba2908eb000095d1f000","observation_id":"a0e5a582-8d29-4018-a5fd-efc920c5c9de","resolution":{"observed_at":"2026-08-11T00:28:52.206297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-17T12:36:13.030381Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-08-11T00:28:52.210464Z","title":"arXiv preprint arXiv:2412.19505 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.210464Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:8dd96183bef04c5b8d22b786d5f91f56cd30e1f4155b6f37b94226f1c4105960","observation_id":"90a528d6-e066-47c5-a81c-0a10ad410c84","resolution":{"observed_at":"2026-08-11T00:28:52.210464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:53.045427Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV) Workshops (2025)","venue":null,"work_id":"103a93e3-3629-4179-b859-fb4f054cd4be","year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.214811Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:dd81cad244d924b3d2fb096850bcc0b4159e4c377856d3ce994bec2c9b2b9240","observation_id":"d3c2f1db-57c6-46c8-9107-af61d175e183","resolution":{"observed_at":"2026-08-11T00:28:53.049116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-73116-7_1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:03:20.376878Z","title":"In: ECCV","venue":"Lecture notes in computer science","work_id":"302ca0e3-526c-46c1-b459-87a251e22012","year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.218667Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:ef1e74032269271374baf7ca9ae1f6a151c54a76194e29cb75629d8c52bc9520","observation_id":"77d8ed14-cdfb-4eda-b88b-7f1899195597","resolution":{"observed_at":"2026-08-11T00:28:52.403705Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-14T22:08:11.505217+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-14T22:08:11.505217+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:53.031804Z","title":"In: Proceedings of the Human Language Technology Conference of the North American Chapter of the Association for Computational Linguistics: HLT- NAACL 2004","venue":null,"work_id":"e74d618d-e8c0-4eee-bd58-1f98626dabe7","year":2004},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.222656Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:7e948d580cec9d207c80c8bb54e4818ed5d4ee902c2b33bc9a144cf12b9ee663","observation_id":"9ed75762-20ba-4231-8413-b5261cf1a217","resolution":{"observed_at":"2026-08-11T00:28:53.036474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.226534Z","title":"2, 2022-06-27","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.226534Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:0b483d3f635f2d358904616d7845ff6f48c34992cde46f2018ea82d81a6a8559","observation_id":"432cf58b-1384-4fb9-abc8-3deaf806e0a5","resolution":{"observed_at":"2026-08-11T00:28:52.226534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:53.011892Z","title":"In: International Conference on Machine Learning (ICML) (2023) CosmosAlign for Generative Traffic Video Forecasting 17","venue":null,"work_id":"d530449b-2dd7-417b-8019-2dec7cd08dd7","year":2023},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.230472Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:76189cf74c615454edde824b5fcc4394ad3280741c26ae2660b89e45b31fb3cc","observation_id":"f63d909d-d154-4042-835a-e7456b304099","resolution":{"observed_at":"2026-08-11T00:28:53.015993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.16732","last_updated":"2026-06-25T19:54:02Z","snapshot_observed_at":"2026-08-19T23:45:04.716820Z","submitted_at":"2025-10-19T07:12:32Z","title":"A Comprehensive Survey on World Models for Embodied AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.16732","snapshot_observed_at":"2026-08-11T00:28:52.233816Z","title":"arXiv preprint arXiv:2510.16732 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.233816Z"},"links":{"cited_paper":"/paper/2510.16732","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:bdd442f7c1815ce5e0f12525b4faae93ae7625e6f75e01d92a00c77217cd1ac9","observation_id":"86727f29-fd68-4409-92db-66f760aecf07","resolution":{"observed_at":"2026-08-11T00:28:52.233816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.237233Z","title":"In: Advances in Neural Information Processing Systems (NeurIPS) (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.237233Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:e00ce0bc2b8b6a24d4a0a2d2e538a9eb6e178b6de2a4bbcb3eb98e0fb23fb474","observation_id":"ef2ecfab-68a0-46b8-be71-f0181a7225a1","resolution":{"observed_at":"2026-08-11T00:28:52.237233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.240212Z","title":"In: Forty-first International Conference on Machine Learning (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.240212Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:96980202ee919606f712f8b88184b0c00cf4d416fa4519c3c8d2b3b677d8fb2f","observation_id":"ba3ba652-33d9-4782-b43a-9e7dd086627e","resolution":{"observed_at":"2026-08-11T00:28:52.240212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.243212Z","title":"In: Proceedings of the IEEE conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.243212Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:826db636fe28c1c5662f1d3f32fb3c64ace184fe13f9bad9b6cbed72a9d2fb40","observation_id":"2e9fae23-deec-448c-ac5d-d1833d639674","resolution":{"observed_at":"2026-08-11T00:28:52.243212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00438","last_updated":"2023-12-01T09:10:33Z","snapshot_observed_at":"2026-08-19T15:16:18.882142Z","submitted_at":"2023-12-01T09:10:33Z","title":"Dolphins: Multimodal Language Model for Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00438","snapshot_observed_at":"2026-08-11T00:28:52.246338Z","title":"arXiv preprint arXiv:2312.00438 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.246338Z"},"links":{"cited_paper":"/paper/2312.00438","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:ecea367b2664e9c9664e92844f2a84a318ab6230d3d11356b557af4e38fc253d","observation_id":"1baa118f-46e3-49ca-8045-ca67ee201dbf","resolution":{"observed_at":"2026-08-11T00:28:52.246338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.980050Z","title":"In: 2025 IEEE International Conference on Robotics and Automation (ICRA)","venue":null,"work_id":"ac47be84-351b-46c1-956a-baecf82f3c7d","year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.249787Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:1595bd34138824593c4070202d3952697f1035db122af4c1a44c890f9e8ad762","observation_id":"faf063b4-f74a-4a07-b62f-554c22585ed9","resolution":{"observed_at":"2026-08-11T00:28:52.983841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.253674Z","title":"Advances in Neural Information Processing Systems37, 121038–121072 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.253674Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:146175fa0fcf0dd8fae2c2a5ecba2fa55ebfb9228d615b85ff7792d6b0563581","observation_id":"adb16312-9939-4536-8579-8928b7d1ede8","resolution":{"observed_at":"2026-08-11T00:28:52.253674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.961607Z","title":"Advances in Neural Information Processing Systems 37, 42292–42310 (2024)","venue":null,"work_id":"b0377ee1-29dc-4b07-a9c2-e449b7426562","year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.257545Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:0748074dd060235253214c04ac2f29858d08439c2b8f6fff85e11c7cb4642cf2","observation_id":"4ae00270-d073-416f-a5d4-00ec14659ea4","resolution":{"observed_at":"2026-08-11T00:28:52.965789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14718","last_updated":"2025-07-14T09:44:08Z","snapshot_observed_at":"2026-08-16T14:24:19.505069Z","submitted_at":"2024-01-26T08:59:38Z","title":"A Survey on Future Frame Synthesis: Bridging Deterministic and Generative Approaches","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14718","snapshot_observed_at":"2026-08-11T00:28:52.261527Z","title":"arXiv preprint arXiv:2401.14718 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.261527Z"},"links":{"cited_paper":"/paper/2401.14718","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:42d20f5a479214eb4f01ffaf7cf7697df01d31c8b4353d4f262be05c0cf10f90","observation_id":"8a8fafbf-df5c-4388-976b-7e882d93b6f6","resolution":{"observed_at":"2026-08-11T00:28:52.261527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.951454Z","title":"Advances in Neural Information Processing Systems38, 4741–4770 (2026)","venue":null,"work_id":"5519e166-bcea-4738-b3bf-8a8237e98843","year":2026},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.265769Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:6a2ef37455b07d2ef60ff0059bc2d0a9c23a3d0d307193743fa3cbe12d049c6f","observation_id":"11a501dc-de4e-4fbd-8a88-8c3b26f03b85","resolution":{"observed_at":"2026-08-11T00:28:52.954991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.941021Z","title":"In: Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":"b2873375-3f3e-49cb-9c1a-740174618cb0","year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.269755Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:8a6d7aab9207afad5acd587427a2c2d5747b617119d5a2743d5589cbd69ded86","observation_id":"67370f25-8305-40c0-af3f-bf174d555985","resolution":{"observed_at":"2026-08-11T00:28:52.944371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05086","last_updated":"2025-07-24T08:52:22Z","snapshot_observed_at":"2026-08-18T16:10:10.321105Z","submitted_at":"2025-05-08T09:34:15Z","title":"Beyond Low-rank Decomposition: A Shortcut Approach for Efficient On-Device Learning","version":2},"cited_work":{"arxiv_id":"2505.05086","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.05086","snapshot_observed_at":"2026-08-11T00:28:52.602327Z","title":"Beyond Low-rank Decomposition: A Shortcut Approach for Efficient On-Device Learning","venue":"cs.LG","work_id":"b57a8354-86bc-4f4e-8529-e10fb38f089a","year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.273713Z"},"links":{"cited_paper":"/paper/2505.05086","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:4fa9787b8d73986954f40871f7d0ece90720a4a145841ad53db61f3016f31606","observation_id":"13dbacaa-9c10-4f27-99b4-2e07dc892501","resolution":{"observed_at":"2026-08-11T00:28:52.608156Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.929846Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"6c8d3bd0-a4e2-414e-b6fe-4b716d532860","year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.277900Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:df18d8a71997ec660ff45e255fcaa040c0ce469b4e44443082aa81900a16ca58","observation_id":"dec7f2fb-fb33-4ea6-86af-4b6f4cdb0a13","resolution":{"observed_at":"2026-08-11T00:28:52.933691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.917163Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence44(6), 2806–2826 (2020)","venue":null,"work_id":"c9fd5c7a-d961-475b-ae0e-3b9c36c277e7","year":2020},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.281801Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:ca5fc649ac07ef83e66063137e6eb244a6cde7945a0558a1f09babe5e33e5ed1","observation_id":"486b526b-dea3-4da5-b081-0b7ed889b63d","resolution":{"observed_at":"2026-08-11T00:28:52.921931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.285006Z","title":"In: ICML","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.285006Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:9de165e4f3e0e2677cc0f1e3beacd8151cbed391c905f65dc0a2cc922cc85f82","observation_id":"11f2eca1-6fcc-44a2-9a4f-c935533ac97f","resolution":{"observed_at":"2026-08-11T00:28:52.285006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20523","last_updated":"2025-03-26T13:11:35Z","snapshot_observed_at":"2026-08-12T12:54:06.280248Z","submitted_at":"2025-03-26T13:11:35Z","title":"GAIA-2: A Controllable Multi-View Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20523","snapshot_observed_at":"2026-08-11T00:28:52.288327Z","title":"arXiv preprint arXiv:2503.20523 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.288327Z"},"links":{"cited_paper":"/paper/2503.20523","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:fa35b9ac77caac281265e4712a1d7cf78e6cf9220760c4395b4eb3b3b131e18a","observation_id":"f4dcd3a2-18e6-47df-9e3e-2c3c89b84a01","resolution":{"observed_at":"2026-08-11T00:28:52.288327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.898618Z","title":"In: Proceedings of the 18 Q","venue":null,"work_id":"b5260a88-4f12-481d-93af-b36e4ccc0007","year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.292099Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:b2fc1c0bddbe154ffc103997a6af189fb4da210aa0b060e60b8e06ababc787a4","observation_id":"048a291f-2147-487f-b080-3f21c0acd718","resolution":{"observed_at":"2026-08-11T00:28:52.902673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.295175Z","title":"In: Conference on Robot Learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.295175Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:622ae60966ad1b4f06bc7dbb9fdb696bc64e2f564ee6f6ec4aadac435ff79d1d","observation_id":"9af0ebca-82ea-4c86-ad6d-fb25dde39fd1","resolution":{"observed_at":"2026-08-11T00:28:52.295175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.879501Z","title":"In: European Conference on Computer Vision (ECCV) (2024)","venue":null,"work_id":"69aa828d-6197-44a4-92bf-460e93816ae7","year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.298467Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:77591c04b0a8d530a22cb32bfe5372c3f1c0d82bf8105dfaff5371ed84fa7d83","observation_id":"04831eaa-dfbd-435c-932c-92d571c9fbf1","resolution":{"observed_at":"2026-08-11T00:28:52.883363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.868211Z","title":"In: ECCV Workshops","venue":null,"work_id":"fba30f82-c971-40a5-add2-2e2359f192b3","year":2026},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.302481Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:6fda71d531c7b044bbd71219082decdf53f537a236989753b2a7f9dd7c952d6e","observation_id":"99f97a72-2561-4198-b95b-8f045f55731c","resolution":{"observed_at":"2026-08-11T00:28:52.871849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.12039","last_updated":"2020-08-25T15:49:48Z","snapshot_observed_at":"2026-08-21T19:23:10.186450Z","submitted_at":"2020-03-26T17:12:42Z","title":"RAFT: Recurrent All-Pairs Field Transforms for Optical Flow","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.12039","snapshot_observed_at":"2026-08-11T00:28:52.306518Z","title":"ArXivabs/2003.12039(2020),https://api.semanticscholar.org/CorpusID: 214667893","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.306518Z"},"links":{"cited_paper":"/paper/2003.12039","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:e92349ffa1587b92f829cef9236054d8da0d882fb22cfff8cc7bc300e3f2184c","observation_id":"a3bf6748-a639-40f5-97e5-c3c9276331ca","resolution":{"observed_at":"2026-08-11T00:28:52.306518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.857739Z","title":"In: International Conference on Learning Representations Workshop (2019)","venue":null,"work_id":"5e5e5d52-56ba-4d31-9d19-4d06390350f0","year":2019},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.311310Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:55650077905efbf10f756646cba772ef785c6bd8d207dfcdb30587bce3d5827d","observation_id":"96bdde1c-ba32-4f18-ad46-fd407317f277","resolution":{"observed_at":"2026-08-11T00:28:52.861078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-11T00:28:52.315323Z","title":"ArXivabs/2503.20314(2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.315323Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:2de93521025e1613cdf4f450afb25cb462b891affb9748bdbdd2031309075fad","observation_id":"8b585e62-8e24-4fe9-bdce-407cec94b6bf","resolution":{"observed_at":"2026-08-11T00:28:52.315323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04412","last_updated":"2023-05-08T01:39:35Z","snapshot_observed_at":"2026-08-16T15:34:55.842860Z","submitted_at":"2023-05-08T01:39:35Z","title":"Efficient Reinforcement Learning for Autonomous Driving with Parameterized Skills and Priors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04412","snapshot_observed_at":"2026-08-11T00:28:52.319765Z","title":"arXiv preprint arXiv:2305.04412 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.319765Z"},"links":{"cited_paper":"/paper/2305.04412","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:a11c9167f764778444b59a81ae339029c65fce94802e9a44803273187b7537ad","observation_id":"9d0fbb59-76ed-436e-9c7b-3324bd98fe61","resolution":{"observed_at":"2026-08-11T00:28:52.319765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.324407Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.324407Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:55c4a9cd336d6b37dd085fadb96a57c64175f188a4f3de4b71e0507bce0b0edd","observation_id":"93e5d96e-c2e0-4ab6-944c-ec7b8dc7c349","resolution":{"observed_at":"2026-08-11T00:28:52.324407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-08-16T01:49:22.176843Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-11T00:28:52.328031Z","title":"ArXivabs/2203.11171 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.328031Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:ea6229cf9ef1d8770345820dcfbca7dab0cc1ed9ebd85bbecdc46ac939cb5f48","observation_id":"fe90eaeb-0e36-498a-887a-ebda274b6c46","resolution":{"observed_at":"2026-08-11T00:28:52.328031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.840319Z","title":"In: Proceed- ings of the 2022 Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":"e52b3f43-6fd9-48eb-8425-d95c9c7ee203","year":2022},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.332064Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:7847040c8c53dccf2b7e8ee8afa07dd1af572e9d5c56a637f036dde3cdbdc7a1","observation_id":"5bff37ca-b817-4bae-a451-26882352d362","resolution":{"observed_at":"2026-08-11T00:28:52.844067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.334845Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.334845Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:dcf398cd068af893d33a983bda2d657bac35c0c93d06a4bb11b58f659b918616","observation_id":"a5aa59d6-e571-4d10-8e34-64fe9b3f9585","resolution":{"observed_at":"2026-08-11T00:28:52.334845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05332","last_updated":"2023-11-28T09:47:57Z","snapshot_observed_at":"2026-08-16T14:44:40.908781Z","submitted_at":"2023-11-09T12:58:37Z","title":"On the Road with GPT-4V(ision): Early Explorations of Visual-Language Model on Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05332","snapshot_observed_at":"2026-08-11T00:28:52.337702Z","title":"arXiv preprint arXiv:2311.05332 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.337702Z"},"links":{"cited_paper":"/paper/2311.05332","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:cf52514b34e9ed02069afdd448dece8a61af491e3588d84bcff96b457f9593d6","observation_id":"a478f21f-5dca-4d8c-ae85-f7da1984b8a2","resolution":{"observed_at":"2026-08-11T00:28:52.337702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05538","last_updated":"2019-04-11T05:20:57Z","snapshot_observed_at":"2026-08-14T16:48:15.102723Z","submitted_at":"2019-04-11T05:20:57Z","title":"Improvisation through Physical Understanding: Using Novel Objects as Tools with Visual Foresight","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.05538","snapshot_observed_at":"2026-08-11T00:28:52.340700Z","title":"arXiv preprint arXiv:1904.05538 (2019) CosmosAlign for Generative Traffic Video Forecasting 19","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.340700Z"},"links":{"cited_paper":"/paper/1904.05538","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:14d7a9e66a254c638d5de6a9d7b15ffda7925ff17258ccd2f678a1a64106b462","observation_id":"f21a5695-d1a8-440a-9ee7-e6e0bf231239","resolution":{"observed_at":"2026-08-11T00:28:52.340700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.821893Z","title":"IEEE Robotics and Automation Letters (2024)","venue":null,"work_id":"6ad74084-65ac-42ed-82ff-a7c594f87dd4","year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.343814Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:661a21a53a33a87ae2b3cf8ab115781f6328e431188a18fba1e92d1c612d688c","observation_id":"274845e0-296f-44ad-b264-6d3bcb410945","resolution":{"observed_at":"2026-08-11T00:28:52.826024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.346757Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) (June 2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.346757Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:2c52f50a10a15568e08a1fdcc74ba245f0455354e66bdf50512ad3740edd2547","observation_id":"8b7bae63-a6b0-43ed-a3de-53aaf89f7947","resolution":{"observed_at":"2026-08-11T00:28:52.346757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.349991Z","title":"In: CVPR","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.349991Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:b28ce0190ff7e77748178790c2adc5b84b59a50ba6015d525dc9c774714f5ed6","observation_id":"81b5d2f5-b83c-4b33-9d95-ac2a4a3e4a15","resolution":{"observed_at":"2026-08-11T00:28:52.349991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.353642Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.353642Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:e3d554040ff5a0e721c4ad9ac90159e6f082f414a38cef58f0c5259edb43de40","observation_id":"fee7f6a9-c78a-4306-9866-cd4ec206b9a6","resolution":{"observed_at":"2026-08-11T00:28:52.353642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03507","last_updated":"2024-06-02T21:24:12Z","snapshot_observed_at":"2026-08-20T02:45:07.091553Z","submitted_at":"2024-03-06T07:29:57Z","title":"GaLore: Memory-Efficient LLM Training by Gradient Low-Rank Projection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03507","snapshot_observed_at":"2026-08-11T00:28:52.357358Z","title":"arXiv preprint arXiv:2403.03507 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.357358Z"},"links":{"cited_paper":"/paper/2403.03507","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:a5fb214c7a85af8c4cae45ee6ef128e5c3546a58481dd908ec380e8cf476b372","observation_id":"2c7e0ba6-6cc0-43e6-9ce4-ff760042fb4c","resolution":{"observed_at":"2026-08-11T00:28:52.357358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.788938Z","title":"In: Thirty-seventh Conference on Neural Information Processing Systems (2023),https://openreview.net/forum? id=hrkmlPhp1u","venue":null,"work_id":"29905b63-8538-4901-8fd6-29af79b5d7db","year":2023},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.361186Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:f44befca4447b841c1048220e283d979433fa71e371ef9f456c378e9e9d455cf","observation_id":"7a29efc2-28f9-4242-99b3-cb9e9c52650e","resolution":{"observed_at":"2026-08-11T00:28:52.793138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.776916Z","title":"Transactions of the Association for Com- putational Linguistics12, 525–542 (2024)","venue":null,"work_id":"9e1c8f13-d3d0-4a6a-8a82-9440db91f243","year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.364690Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:c107aab5d3f1293a679d59d3e8478060dabbb9b2b722cffed5533922df326939","observation_id":"22940223-ebd4-4e5d-8134-1b14e5ad0f27","resolution":{"observed_at":"2026-08-11T00:28:52.781146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.368199Z","title":"arXiv preprint arXiv:2601.01528 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.368199Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:dcc4778f35c3d7516a0b26a14d7b6cc626472facd497f90e1306c99398755fc4","observation_id":"78ac1796-b5cc-442b-92bd-182e28ec1f49","resolution":{"observed_at":"2026-08-11T00:28:52.368199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-21T11:31:13.069090Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":44,"verified_exact":1,"verified_fuzzy":20},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 0 inbound Pith citation observations for arXiv:2608.07693."}