{"as_of":"2026-08-19T03:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:768b9df0eaff146a8f0510bfc3c0265f36b98e3c575048435efc98f0f171f046","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:26:02.680989Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.10439/citation-record","integrity":"/paper/2608.10439/integrity","json":"/paper/2608.10439/citation-record.json","paper":"/paper/2608.10439"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.565926Z","title":"Logistic-normal distribu- tions: Some properties and uses.Biometrika, 67(2):261–272,","venue":null,"work_id":"88fd60a1-6d51-4f92-9f24-2f3a7324076b","year":null},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.420783Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:b691cfe47a75e847a8e279bd336c66e3991599fffac552ba2caad0b3963fd636","observation_id":"7507d4bc-2c94-4fb3-b3f0-958b30409cfa","resolution":{"observed_at":"2026-08-15T14:26:03.569440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-17T12:45:30.627161Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-15T14:26:02.425302Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.arXiv preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.425302Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:74077096ac0e0825fbb203efc3cb36c24e0b92be11f490b8c9bd52096774a738","observation_id":"dbced537-461b-45fd-96cb-84a87dd07eda","resolution":{"observed_at":"2026-08-15T14:26:02.425302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:02.429622Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.429622Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:cd73d274e6ff9d98a0c11dc2af148ce22b82749bdbb15fcee0dca58969dbbf63","observation_id":"ca3b3a7b-5e18-4878-bab6-8fd7039f786b","resolution":{"observed_at":"2026-08-15T14:26:02.429622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.549006Z","title":"nuscenes: A multi- modal dataset for autonomous driving","venue":null,"work_id":"c36ba6cf-5833-47cd-854e-bd74d94eb11e","year":2020},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.433556Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:b8952c86b98bc5d7e111cf10a28ac6ae613a73abe2ada1abcfa45850310614b3","observation_id":"f95b4c39-94a1-473e-b97f-f64ed25192e0","resolution":{"observed_at":"2026-08-15T14:26:03.552753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11810","last_updated":"2022-02-04T02:50:02Z","snapshot_observed_at":"2026-08-13T09:27:32.843417Z","submitted_at":"2021-06-22T14:24:55Z","title":"NuPlan: A closed-loop ML-based planning benchmark for autonomous vehicles","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.11810","snapshot_observed_at":"2026-08-15T14:26:02.438250Z","title":"nuplan: A closed-loop ml-based plan- ning benchmark for autonomous vehicles.arXiv preprint arXiv:2106.11810, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.438250Z"},"links":{"cited_paper":"/paper/2106.11810","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:bdda7fe5268fbf51e8d327819a41151c2a23136297e40f631c47b5b1df814c32","observation_id":"5ed62311-3189-4fa9-a949-309ebdf15ddd","resolution":{"observed_at":"2026-08-15T14:26:02.438250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.538018Z","title":"Diffusion forcing: Next-token prediction meets full-sequence diffu- sion.Advances in Neural Information Processing Systems, 37:24081–24125, 2024","venue":null,"work_id":"0743d25b-3837-4266-a4c3-5d81b091abdc","year":2024},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.442859Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:f211353e81a5d3f33d6bedaf0a45b136a36715a0e24c49970133745007679392","observation_id":"713c5b4c-5f71-415c-85f9-a68a5ec44112","resolution":{"observed_at":"2026-08-15T14:26:03.541812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.526550Z","title":"Deep compres- sion autoencoder for efficient high-resolution diffusion mod- els","venue":null,"work_id":"d30aa72c-fef7-45e6-ad9f-50d40bed6cb8","year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.446682Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:944fef01d1bcdbf75cd469a2ad05e45ee59e83f294870d8e145ee95a44ddeebc","observation_id":"875d36ed-4801-486d-8b7f-667501cc210b","resolution":{"observed_at":"2026-08-15T14:26:03.530966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.512339Z","title":"Empower- ing world models with reflection for embodied video predic- tion","venue":null,"work_id":"c3c788f2-8565-47ed-956e-540c9fd1393f","year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.450479Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:295467f72d8fa1cdf3d252dd5f1e0d1313cf38cc6268fe1fbae45c6d84336281","observation_id":"311850ca-fa2e-479a-be63-795fe10dd11e","resolution":{"observed_at":"2026-08-15T14:26:03.516418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.02283","last_updated":"2025-10-02T17:55:42Z","snapshot_observed_at":"2026-08-13T04:00:21.942422Z","submitted_at":"2025-10-02T17:55:42Z","title":"Self-Forcing++: Towards Minute-Scale High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.02283","snapshot_observed_at":"2026-08-15T14:26:02.454509Z","title":"Self- forcing++: Towards minute-scale high-quality video genera- tion.arXiv preprint arXiv:2510.02283, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.454509Z"},"links":{"cited_paper":"/paper/2510.02283","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:2399028a3cc6a07d0e08ac5e38109d0aaa79235e676088815dedac1679640562","observation_id":"32dde14e-8a1c-45e6-ab7b-2e99c775244c","resolution":{"observed_at":"2026-08-15T14:26:02.454509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:02.458350Z","title":"Scaling recti- fied flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.458350Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:afc1672cae44f36043dc2ef582bfc56aeafad6cab75a544274331f3095cccd1a","observation_id":"734e817d-2238-4e9e-87fe-22644f72b0bd","resolution":{"observed_at":"2026-08-15T14:26:02.458350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.15308","last_updated":"2026-04-16T17:59:44Z","snapshot_observed_at":"2026-08-11T11:39:21.579764Z","submitted_at":"2026-04-16T17:59:44Z","title":"RAD-2: Scaling Reinforcement Learning in a Generator-Discriminator Framework","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.15308","snapshot_observed_at":"2026-08-15T14:26:02.461466Z","title":"Rad-2: Scaling rein- forcement learning in a generator-discriminator framework","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.461466Z"},"links":{"cited_paper":"/paper/2604.15308","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:7493ada5915dc9dec63c7383c141b7eb787df0e10c810720560dfccf10404474","observation_id":"9dfcf6d3-a709-4501-9bd7-176361c2412f","resolution":{"observed_at":"2026-08-15T14:26:02.461466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-08-15T14:26:02.465168Z","title":"Ca2-vdm: Efficient autoregres- sive video diffusion model with causal generation and cache sharing.arXiv preprint arXiv:2411.16375, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.465168Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:b4fa8a19b2dab392c2de19d35c4e47e172d118dd12a084ad83183d27938c1225","observation_id":"9826d9b3-6cff-4d49-b97a-d4a3a2b57671","resolution":{"observed_at":"2026-08-15T14:26:02.465168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19325","last_updated":"2025-05-18T02:27:31Z","snapshot_observed_at":"2026-08-15T15:00:19.916941Z","submitted_at":"2025-03-25T03:38:06Z","title":"Long-Context Autoregressive Video Modeling with Next-Frame Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19325","snapshot_observed_at":"2026-08-15T14:26:02.469094Z","title":"Long- context autoregressive video modeling with next-frame pre- diction.arXiv preprint arXiv:2503.19325, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.469094Z"},"links":{"cited_paper":"/paper/2503.19325","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:3c324846fb6dbece07a1cdff0f2f7c4e42d2dc7f1cc9d66ae20bc4487947497e","observation_id":"ba72e877-d7e5-47b0-b880-3858f12f8b06","resolution":{"observed_at":"2026-08-15T14:26:02.469094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10589","last_updated":"2025-03-13T17:40:07Z","snapshot_observed_at":"2026-08-16T12:50:17.497627Z","submitted_at":"2025-03-13T17:40:07Z","title":"Long Context Tuning for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10589","snapshot_observed_at":"2026-08-15T14:26:02.472802Z","title":"Long context tuning for video generation.arXiv preprint arXiv:2503.10589, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.472802Z"},"links":{"cited_paper":"/paper/2503.10589","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:729251f92ad7a8e501ac5c8dc294e5257f52ed721898079d7f7ea8a42f9b33ad","observation_id":"f55f291d-2160-4b87-ac01-910f76666944","resolution":{"observed_at":"2026-08-15T14:26:02.472802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-08-18T07:04:58.690133Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-15T14:26:02.479543Z","title":"World models.arXiv preprint arXiv:1803.10122, 2(3), 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.479543Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:fb30fba113413c3381039d8cb194c72390affaa5d8d865154db956c3647abb3f","observation_id":"92618e21-eb9a-4158-ae6b-a8d5df1fbecc","resolution":{"observed_at":"2026-08-15T14:26:02.479543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13221","last_updated":"2023-03-20T17:29:45Z","snapshot_observed_at":"2026-08-17T16:16:01.560363Z","submitted_at":"2022-11-23T18:58:39Z","title":"Latent Video Diffusion Models for High-Fidelity Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13221","snapshot_observed_at":"2026-08-15T14:26:02.483426Z","title":"Latent video diffusion models for high-fidelity long video generation.arXiv preprint arXiv:2211.13221,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.483426Z"},"links":{"cited_paper":"/paper/2211.13221","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:fe8d8fd4faa3f7dd5b0db470acbe5f4e9a2e9efeea52b2468f57c282c90df2ba","observation_id":"ae6d9708-26b8-4a25-bd49-981eb8c36e51","resolution":{"observed_at":"2026-08-15T14:26:02.483426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.493748Z","title":"Streamingt2v: Con- sistent, dynamic, and extendable long video generation from text","venue":null,"work_id":"888e06ca-331b-4f41-84e1-528db5818516","year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.487383Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:34cc3f5d48de15653c02594f6e65783b2a0bc64da83ba982b3ffdeca7c149af4","observation_id":"5f02af1c-541d-4958-a469-9071233c544b","resolution":{"observed_at":"2026-08-15T14:26:03.497341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.483842Z","title":"Video dif- fusion models.Advances in neural information processing systems, 35:8633–8646, 2022","venue":null,"work_id":"19582a80-d1b2-4686-9b75-d40a61c3e515","year":2022},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.491429Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:d975c9192e680b01a60cae96cf4fe4b63df8f58284f40ded4aa247514cf7babc","observation_id":"f78355c6-0dd4-4728-83e8-438b758e6e58","resolution":{"observed_at":"2026-08-15T14:26:03.487275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-08-12T19:21:15.526321Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15868","snapshot_observed_at":"2026-08-15T14:26:02.495666Z","title":"Cogvideo: Large-scale pretraining for text-to-video generation via transformers.arXiv preprint arXiv:2205.15868, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.495666Z"},"links":{"cited_paper":"/paper/2205.15868","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:513fc8fcfe1f13dea11b421435c9dfe074e47643c1ff6d3c4d338b40f6bfc5ce","observation_id":"b998d856-cf35-48b0-b204-ec83b16d9e8a","resolution":{"observed_at":"2026-08-15T14:26:02.495666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:02.499526Z","title":"Acdit: Interpolating autoregressive con- ditional modeling and diffusion transformer.arXiv preprint arXiv:2412.07720, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.499526Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:fa60291286e6fc80ccf11722cf8c7ec4c43aee5c98fa5c031de9944401434332","observation_id":"70cca9d1-ec2c-4532-9a99-d754ebcbbdf9","resolution":{"observed_at":"2026-08-15T14:26:02.499526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-15T15:02:59.826496Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-15T14:26:02.503213Z","title":"Self forcing: Bridging the train- test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.503213Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:b38715c295c843b96501b2087bb274718b05bcf8b7a007d5e5e4e6bb07c9ea3c","observation_id":"278d6f1e-43ca-40fe-b91d-d84d89cb43f2","resolution":{"observed_at":"2026-08-15T14:26:02.503213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.473682Z","title":"Fifo-diffusion: Generating infinite videos from text without training.Advances in Neural Information Processing Sys- tems, 37:89834–89868, 2024","venue":null,"work_id":"654b0161-e3fb-445f-8cab-b554452fc3a7","year":2024},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.507106Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:27ed7dd78b373a41e2389ea08c11ec512a550747b8a5488ec4aa0e459febe9e1","observation_id":"508b3066-8d1b-4522-b760-88edf79e336e","resolution":{"observed_at":"2026-08-15T14:26:03.477314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.463630Z","title":"Hybrid video diffusion models with 2d triplane and 3d wavelet rep- resentation","venue":null,"work_id":"834d372f-015c-494d-9e61-1b4423e0d266","year":2024},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.511330Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:75cb15df3ffc0795bb73f6072ddc7421fd24c291ccfc684e08b5dc22bd022045","observation_id":"b3cbdc72-4bdf-440c-bdae-c9499ee1c83d","resolution":{"observed_at":"2026-08-15T14:26:03.467201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.453696Z","title":"Drivegan: Towards a controllable high-quality neural simulation","venue":null,"work_id":"40bf1678-eead-435c-b127-4ed84557a9fc","year":2021},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.515376Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:56ac061c06a6fd7f69fa8b3a57213f2a533d031fa3a35dc42626d855ede87f8e","observation_id":"fbd2a5c8-cfe5-4598-880f-8e92cf2a1f4b","resolution":{"observed_at":"2026-08-15T14:26:03.457482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.443421Z","title":"Videopoet: A large language model for zero-shot video gen- eration","venue":null,"work_id":"47bc52f1-2bd6-4036-a9e2-506087ecdbf5","year":2024},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.518723Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:f1910cbb5d7ed5aecec4866980a6faf50b9c4a2672e2ed9a8d3cd33411893823","observation_id":"0de8aaaa-05e6-4f27-b509-aa08aca4f191","resolution":{"observed_at":"2026-08-15T14:26:03.447298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.09721","last_updated":"2026-04-18T11:35:45Z","snapshot_observed_at":"2026-08-15T14:57:33.714412Z","submitted_at":"2026-03-10T14:28:32Z","title":"FrameDiT: Diffusion Transformer with Matrix Attention for Efficient Video Generation","version":2},"cited_work":{"arxiv_id":"2603.09721","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.09721","snapshot_observed_at":"2026-08-15T14:26:03.026765Z","title":"FrameDiT: Diffusion Transformer with Matrix Attention for Efficient Video Generation","venue":"cs.CV","work_id":"b938989d-c7d4-4867-8191-1d8b0d680709","year":2026},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.523110Z"},"links":{"cited_paper":"/paper/2603.09721","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:0e92ba391e404254e113f19e53d372a3b699e60b0cbff489b1d3eb8583456bd4","observation_id":"0ea2fbab-5684-478d-9206-5a98e8eb54b5","resolution":{"observed_at":"2026-08-15T14:26:03.031009Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20280","last_updated":"2024-10-26T21:12:32Z","snapshot_observed_at":"2026-08-16T13:05:43.137904Z","submitted_at":"2024-10-26T21:12:32Z","title":"MarDini: Masked Autoregressive Diffusion for Video Generation at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20280","snapshot_observed_at":"2026-08-15T14:26:02.527602Z","title":"Mardini: Masked autoregres- sive diffusion for video generation at scale.arXiv preprint arXiv:2410.20280, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.527602Z"},"links":{"cited_paper":"/paper/2410.20280","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:158950088b43bee7e0c73ae217f8857d801c2dab645ff253728e2511c099e93a","observation_id":"3dfe1268-1b4d-4e56-8308-e43fecba378b","resolution":{"observed_at":"2026-08-15T14:26:02.527602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25161","last_updated":"2025-09-29T17:57:14Z","snapshot_observed_at":"2026-08-09T09:15:39.740119Z","submitted_at":"2025-09-29T17:57:14Z","title":"Rolling Forcing: Autoregressive Long Video Diffusion in Real Time","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.25161","snapshot_observed_at":"2026-08-15T14:26:02.531366Z","title":"Rolling forcing: Autoregressive long video diffusion in real time.arXiv preprint arXiv:2509.25161, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.531366Z"},"links":{"cited_paper":"/paper/2509.25161","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:85566a0026129b71ff541047de573f8edc7dd2b1a52879b0fd71fb67a230d23b","observation_id":"7d52a65e-3568-42c8-92c0-9c769a3eb5e9","resolution":{"observed_at":"2026-08-15T14:26:02.531366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03160","last_updated":"2024-10-04T05:47:39Z","snapshot_observed_at":"2026-08-16T13:12:42.774594Z","submitted_at":"2024-10-04T05:47:39Z","title":"Redefining Temporal Modeling in Video Diffusion: The Vectorized Timestep Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03160","snapshot_observed_at":"2026-08-15T14:26:02.534937Z","title":"Redefining temporal modeling in video dif- fusion: The vectorized timestep approach.arXiv preprint arXiv:2410.03160, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.534937Z"},"links":{"cited_paper":"/paper/2410.03160","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:a9f5d931c27ba45c409baad6458cc1d7b782d36249b49772960a39121e4f462d","observation_id":"b52035fa-11d9-4c53-a7f1-d414ec3df3d1","resolution":{"observed_at":"2026-08-15T14:26:02.534937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.433574Z","title":"Wovogen: World volume-aware diffusion for con- trollable multi-camera driving scene generation","venue":null,"work_id":"c24ab37c-ae56-4590-bdee-4e5dc69086e9","year":2024},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.539033Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:e90a478b1bb47f4b141fcd90b59452b1bc4fc3d496093b34879f93788f3dddf9","observation_id":"81eba023-2930-404d-b39f-4c66f933bc94","resolution":{"observed_at":"2026-08-15T14:26:03.437141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03048","last_updated":"2025-05-01T09:40:21Z","snapshot_observed_at":"2026-08-13T10:28:06.516901Z","submitted_at":"2024-01-05T19:55:15Z","title":"Latte: Latent Diffusion Transformer for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03048","snapshot_observed_at":"2026-08-15T14:26:02.542445Z","title":"Latte: Latent diffusion transformer for video generation.arXiv preprint arXiv:2401.03048, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.542445Z"},"links":{"cited_paper":"/paper/2401.03048","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:0bcacc018439ee881e3f7e4d5632e3cf75c7cbff068d0c21e9a9542c5c2af86a","observation_id":"e84d3339-c294-452c-a73f-06a08e9539e2","resolution":{"observed_at":"2026-08-15T14:26:02.542445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.423167Z","title":"Neural residual diffusion models for deep scalable vision generation.Advances in Neural Information Processing Sys- tems, 37:117456–117480, 2024","venue":null,"work_id":"fb142a00-0522-4d86-8743-ded505f98c00","year":2024},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.546248Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:075887d9dceae059f34a1d65bbf56c7cbc276acd80f08262f5169ca75231ad60","observation_id":"7f819048-faab-4762-8be9-54df4a6a7359","resolution":{"observed_at":"2026-08-15T14:26:03.427050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.412669Z","title":null,"venue":null,"work_id":"6d2a5cad-377b-4467-9fca-8c6862757a05","year":2006},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.549524Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:4288cac892579036d161ef1d2443d90b9d0aa756656f0972b028648ad669968c","observation_id":"133ff387-4f0f-4872-bf8c-bba18b98278b","resolution":{"observed_at":"2026-08-15T14:26:03.416012Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.401582Z","title":"Worldsimbench: Towards video generation models as world simulators","venue":null,"work_id":"677e673c-bd59-4826-a517-5ac1558939f2","year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.553723Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:16e5180becd43b47ebf6bff1d21f2d073ee66129dfdd9a43ed469f65dde0ed7e","observation_id":"f79979a0-7a6a-4168-bad2-dcccd32999b9","resolution":{"observed_at":"2026-08-15T14:26:03.405464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.391314Z","title":"Rolling diffusion models","venue":null,"work_id":"a45e6f17-5c32-4948-bb08-7dc113ff543a","year":null},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.557155Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:eabfec1b51ad0a34c0b7bc5c9daf137cd9b8ff6e8e4bfb2e56ccab39db921d8d","observation_id":"87e15741-c406-4c55-9f77-d4943b9364d3","resolution":{"observed_at":"2026-08-15T14:26:03.394929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14148","last_updated":"2026-04-15T17:59:40Z","snapshot_observed_at":"2026-08-16T18:58:56.056540Z","submitted_at":"2026-04-15T17:59:40Z","title":"Seedance 2.0: Advancing Video Generation for World Complexity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14148","snapshot_observed_at":"2026-08-15T14:26:02.561476Z","title":"Seedance 2.0: Advanc- ing video generation for world complexity.arXiv preprint arXiv:2604.14148, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.561476Z"},"links":{"cited_paper":"/paper/2604.14148","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:8b8ee28eb8a2e192a630ce5b651b451d559dfa6e9dd8175e14563a1e1b09e7d5","observation_id":"8bce7373-1827-4441-ac18-1565d8ca0753","resolution":{"observed_at":"2026-08-15T14:26:02.561476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.379607Z","title":"First order motion model for image animation.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":"bf8ff50e-bcfd-470b-a36c-251fd72b4725","year":2019},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.565248Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:f77fd745d60271d6cc259f8a5cf99f14b44f02273b7db3bdbb643fd556638191","observation_id":"0f09cca8-dbe4-4d30-9057-8edc593ce1a2","resolution":{"observed_at":"2026-08-15T14:26:03.383290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.369363Z","title":"Stylegan-v: A continuous video generator with the price, image quality and perks of stylegan2","venue":null,"work_id":"85e700c2-cbe0-4195-a798-9ff5ee0136cf","year":2022},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.568744Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:1893c81258621704ad509f6174ce1faf7e163798c19c236f426a34f15af6f7d0","observation_id":"3507b367-c34e-4803-aae0-3b7c7a45f4e7","resolution":{"observed_at":"2026-08-15T14:26:03.373005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06764","last_updated":"2025-07-24T03:58:47Z","snapshot_observed_at":"2026-08-13T16:17:52.423891Z","submitted_at":"2025-02-10T18:44:25Z","title":"History-Guided Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06764","snapshot_observed_at":"2026-08-15T14:26:02.572288Z","title":"History-guided video diffusion.arXiv preprint arXiv:2502.06764, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.572288Z"},"links":{"cited_paper":"/paper/2502.06764","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:cf4a2ce53d731d57279e22d6190aace2820c22893a68e0d5729d90abaed49498","observation_id":"515d642c-68d0-4c47-a245-58d5cdf61076","resolution":{"observed_at":"2026-08-15T14:26:02.572288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-08-16T21:21:44.768787Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-15T14:26:02.576180Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild.arXiv preprint arXiv:1212.0402, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.576180Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:929fe756668e2b24876374f8520fe5fedbf36dbdb31ebd77885dddc0031c46ff","observation_id":"54848b73-46be-44fe-8044-aab0c9214344","resolution":{"observed_at":"2026-08-15T14:26:02.576180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.358845Z","title":"Ar-diffusion: Asynchronous video genera- tion with auto-regressive diffusion","venue":null,"work_id":"6208e4d3-8ce1-4bba-a1a8-1d9d4d49b653","year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.580417Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:e621dc95e4abaa841f678ab5e043c08d6bcc61b53b1ff709a58f6f7c2057de85","observation_id":"8f861e6f-24da-4610-b236-fd598462c5f5","resolution":{"observed_at":"2026-08-15T14:26:03.362987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-08-13T22:05:34.844117Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-15T14:26:02.584428Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation.arXiv preprint arXiv:2406.06525, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.584428Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:1d247ad69fe3c64011a875ebada637ca8df22b29ad7ac9bd2fe54a02466d7c18","observation_id":"dab6969d-4248-4ea7-8774-62b4ad11c355","resolution":{"observed_at":"2026-08-15T14:26:02.584428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-08-18T19:56:03.713377Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-15T14:26:02.588355Z","title":"Kling-omni technical report.arXiv preprint arXiv:2512.16776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.588355Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:83c386fbedb6b79c958bed750915ca2d1c9c01fda117f67d1aa03250bb852ed2","observation_id":"b21a855b-5156-4093-85f8-bcb4c29889ce","resolution":{"observed_at":"2026-08-15T14:26:02.588355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13211","last_updated":"2025-05-19T14:58:50Z","snapshot_observed_at":"2026-08-17T23:27:13.017878Z","submitted_at":"2025-05-19T14:58:50Z","title":"MAGI-1: Autoregressive Video Generation at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13211","snapshot_observed_at":"2026-08-15T14:26:02.592103Z","title":"Magi-1: Autoregressive video genera- tion at scale.arXiv preprint arXiv:2505.13211, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.592103Z"},"links":{"cited_paper":"/paper/2505.13211","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:35f8b7ca27e9e4fd757565ca95ac37434652a11d819620b712e015164e9b1208","observation_id":"fb27b2d0-5c8b-4463-a3de-aa8b231546c5","resolution":{"observed_at":"2026-08-15T14:26:02.592103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.348163Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction.Advances in neural in- formation processing systems, 37:84839–84865, 2024","venue":null,"work_id":"1e01de18-1a77-40e5-b87d-11829798084c","year":2024},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.596002Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:30888a73efe80b60434e73805e8e6e504ff17568ea0f250b3ffd396e6e9abb3b","observation_id":"c7a173c4-b824-425d-a18e-3901d098b93a","resolution":{"observed_at":"2026-08-15T14:26:03.351938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-08-18T04:00:09.136122Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-15T14:26:02.599858Z","title":"To- wards accurate generative models of video: A new metric & challenges.arXiv preprint arXiv:1812.01717, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.599858Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:00288550e3b34a59848be715701e90916cb5cfb853a1097fed6ea8c4ce12f41d","observation_id":"9ddcc877-08ff-4eb5-8b6f-35ec1e22dce1","resolution":{"observed_at":"2026-08-15T14:26:02.599858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-15T14:26:02.603534Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.603534Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:420dde7ca94e35b13cf99dbec55fd10c0b84ad01896f1b20e5bd210dda093e61","observation_id":"dde3b2d2-175a-4eea-b64c-8ff579a32bd3","resolution":{"observed_at":"2026-08-15T14:26:02.603534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.336819Z","title":"Drivedreamer: Towards real-world- drive world models for autonomous driving","venue":null,"work_id":"4002ecd8-79f4-4e83-970d-6c9e21062f3d","year":2024},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.607513Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:6b6d6ebcf26ea708fdc110e026e9b6df7f4758f5e7e97e939387ae2f2ffcf283","observation_id":"a9cea4d2-db72-44d3-a933-468098f5259a","resolution":{"observed_at":"2026-08-15T14:26:03.341020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.323893Z","title":"Driving into the future: Multiview visual forecasting and planning with world model for au- tonomous driving","venue":null,"work_id":"d6bc2428-82a0-45d7-b773-62a6fc807a06","year":2024},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.611041Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:8b661762f274c0e9b4049253c750a211a82fcdf16310d694f941ff50e78193c1","observation_id":"c84a4a7a-07da-4b0a-887e-8023696c0e9c","resolution":{"observed_at":"2026-08-15T14:26:03.328206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02757","last_updated":"2025-04-02T07:57:32Z","snapshot_observed_at":"2026-08-16T13:12:51.397672Z","submitted_at":"2024-10-03T17:59:02Z","title":"Loong: Generating Minute-level Long Videos with Autoregressive Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02757","snapshot_observed_at":"2026-08-15T14:26:02.614896Z","title":"Loong: Generating minute-level long videos with autoregressive lan- guage models.arXiv preprint arXiv:2410.02757, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.614896Z"},"links":{"cited_paper":"/paper/2410.02757","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:68b9041a2edea1e574907e7cbccaaeb2823001b7c71fcffa63b1513840cadc36","observation_id":"c4ca32f3-efd9-4ae0-96ae-c2f06e8ce615","resolution":{"observed_at":"2026-08-15T14:26:02.614896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.311782Z","title":"Art-v: Auto-regressive text-to- video generation with diffusion models","venue":null,"work_id":"07e5d6d0-f6c3-4a4d-be01-7f7ebf360774","year":2024},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.618724Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:12ebd6840579eaa602ff4186015e23c309e57a883360c6e31f97bce38b2f5078","observation_id":"0727eddb-1e42-421e-a6f5-c72460d66d46","resolution":{"observed_at":"2026-08-15T14:26:03.315534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.23421","last_updated":"2026-04-17T11:51:10Z","snapshot_observed_at":"2026-08-10T21:24:55.790519Z","submitted_at":"2025-12-29T12:32:27Z","title":"DriveLaW:Unifying Planning and Video Generation in a Latent Driving World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.23421","snapshot_observed_at":"2026-08-15T14:26:02.621824Z","title":"Drivelaw: Unifying planning and video generation in a latent driving world.arXiv preprint arXiv:2512.23421, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.621824Z"},"links":{"cited_paper":"/paper/2512.23421","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:0d9cf0058441c1700482b11b37ca93605d706cdeb7a25f1a268e075b0f1c0949","observation_id":"3ed7562c-a6cc-442a-9c94-dae78728772c","resolution":{"observed_at":"2026-08-15T14:26:02.621824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.300848Z","title":"Progressive au- toregressive video diffusion models","venue":null,"work_id":"157cb1d4-e465-41ea-8d6b-8b1f67485f71","year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.625613Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:6760be3975141a935e9325329aac2f7e3ddb7e8f5a141d43adcd8cefd89cf8a5","observation_id":"9976166b-9a98-4f52-a814-f6cf666e4807","resolution":{"observed_at":"2026-08-15T14:26:03.304990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10157","last_updated":"2021-09-14T21:20:06Z","snapshot_observed_at":"2026-08-17T06:54:13.493934Z","submitted_at":"2021-04-20T17:58:03Z","title":"VideoGPT: Video Generation using VQ-VAE and Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10157","snapshot_observed_at":"2026-08-15T14:26:02.629364Z","title":"Videogpt: Video generation using vq-vae and trans- formers.arXiv preprint arXiv:2104.10157, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.629364Z"},"links":{"cited_paper":"/paper/2104.10157","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:f430986338d58d2a59063a49061c4d1804a2939ac258f23689c8735c553256cc","observation_id":"fada23ee-3a57-48e8-8d52-67554c6cf6f0","resolution":{"observed_at":"2026-08-15T14:26:02.629364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16400","last_updated":"2025-05-23T19:01:04Z","snapshot_observed_at":"2026-08-16T12:48:10.858294Z","submitted_at":"2025-03-20T17:54:37Z","title":"ScalingNoise: Scaling Inference-Time Search for Generating Infinite Videos","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16400","snapshot_observed_at":"2026-08-15T14:26:02.633214Z","title":"Scalingnoise: Scaling inference-time search for generating infinite videos.arXiv preprint arXiv:2503.16400,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.633214Z"},"links":{"cited_paper":"/paper/2503.16400","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:edf919797ffd96e6ebc112f3919515d947972a156b679479f8c2fdb83e35f6ba","observation_id":"76402fd4-576f-4152-a0c6-7091c0d4e2d0","resolution":{"observed_at":"2026-08-15T14:26:02.633214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.289506Z","title":"Generalized predictive model for autonomous driving","venue":null,"work_id":"fbe86358-2811-484b-b9d4-ad240ff493e5","year":2024},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.637063Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:ab71e12d71ff05c251fd722d543ebe031626daed85d793925db15b252e3c3756","observation_id":"0ae22453-057e-48b1-9075-2cf324f40566","resolution":{"observed_at":"2026-08-15T14:26:03.293428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.278743Z","title":"From slow bidirectional to fast autoregressive video diffusion mod- els","venue":null,"work_id":"1cae66cd-6c38-425e-860b-0398ddb41ae4","year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.640590Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:e0f57a5626d45945b044b5446c92952c59ae3d6e079a72e920d6a417199f7513","observation_id":"31eecef5-21f9-4535-89ce-f8a646767345","resolution":{"observed_at":"2026-08-15T14:26:03.282534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.267486Z","title":"An image is worth 32 tokens for reconstruction and generation.Advances in Neural Information Processing Systems, 37:128940– 128966, 2024","venue":null,"work_id":"7fcad51f-5d56-40d4-93f6-856f595911c7","year":2024},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.644428Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:40baddcfc5dce78c20845c8f9edceb1415f61dedad16b6313d3b6cacaf4340ec","observation_id":"e037b9ae-b72f-4ae2-b4ec-3d1973179d53","resolution":{"observed_at":"2026-08-15T14:26:03.271611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.10571","last_updated":"2022-02-21T23:24:01Z","snapshot_observed_at":"2026-08-16T17:19:40.831695Z","submitted_at":"2022-02-21T23:24:01Z","title":"Generating Videos with Dynamics-aware Implicit Generative Adversarial Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.10571","snapshot_observed_at":"2026-08-15T14:26:02.647906Z","title":"Generating videos with dynamics-aware implicit generative adversarial net- works.arXiv preprint arXiv:2202.10571, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.647906Z"},"links":{"cited_paper":"/paper/2202.10571","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:5bb892497d5dd80dcacc9da503c1493a82ae65395bd5bd4999e733f6f4f49d1b","observation_id":"cb2c62fa-bc57-44f9-8842-e6dadd6af07f","resolution":{"observed_at":"2026-08-15T14:26:02.647906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:02.651489Z","title":"Video probabilistic diffusion models in projected latent space","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.651489Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:c4050dbb68276842706882ae51750583bb622a6b67cc40f79726cbb2fa908663","observation_id":"1f44a1b4-2e9c-4e3d-8c80-073af1abc404","resolution":{"observed_at":"2026-08-15T14:26:02.651489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:02.654805Z","title":"Packing input frame context in next-frame prediction models for video genera- tion.arXiv preprint arXiv:2504.12626, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.654805Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:705362038aba89f5c32a6192dad933e191fccb90be6f600302ad2df956153616","observation_id":"9ae81d7a-4993-4897-a157-d0017672f904","resolution":{"observed_at":"2026-08-15T14:26:02.654805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.23851","last_updated":"2026-06-20T17:45:12Z","snapshot_observed_at":"2026-08-15T05:46:16.274051Z","submitted_at":"2025-12-29T20:29:21Z","title":"TinyHistory: Lightweight Video History Embeddings via Two-Stage Context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.23851","snapshot_observed_at":"2026-08-15T14:26:02.658299Z","title":"Pretraining frame preservation in au- toregressive video memory compression.arXiv preprint arXiv:2512.23851, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.658299Z"},"links":{"cited_paper":"/paper/2512.23851","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:92c531e54a5e2dd3b1af0677759c0dc52df11ffb721ab68fef9271e6a5c4030d","observation_id":"94a56f42-165d-4c8b-9e7a-0a95c2429051","resolution":{"observed_at":"2026-08-15T14:26:02.658299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.21475","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:02.772020Z","title":"Mobilei2v: Fast and high-resolution image-to- video on mobile devices.arXiv preprint arXiv:2511.21475,","venue":null,"work_id":"b123e639-f268-4fe7-8b2f-2ed40ef08447","year":null},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.662698Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:7ecdbd0fd24d3200210287ca8ad364a6ac5213f5e43507066c81c797f65f1d05","observation_id":"4891d23b-0b96-431d-8930-8d184f0740d5","resolution":{"observed_at":"2026-08-15T14:26:02.779497Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.249861Z","title":"Taming teacher forcing for masked autoregressive video gen- eration","venue":null,"work_id":"188e9cc5-f49f-483c-8f38-2153e6e8fdd9","year":2025},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.666108Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:6bc37df93efd3852a74ca0a5c5621bfdf5b9901fb97d3191338c15aed9f9e364","observation_id":"330d539b-d012-480e-9869-37228cae2ec7","resolution":{"observed_at":"2026-08-15T14:26:03.253536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.239017Z","title":"Abrupt changes in the sampling distribution may introduce sud- den shifts in training difficulty and destabilize the cur- riculum","venue":null,"work_id":"8d0ab5e5-0aa6-4d4a-afe9-c1ad8c278d3a","year":null},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.669477Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:0b7cee5403514c2b7322fdcfc0e3e19aaf1c1e412d7ff8ee844501a39f887f99","observation_id":"cbb231e2-d06f-4c63-b6d0-825dd8bf7957","resolution":{"observed_at":"2026-08-15T14:26:03.242794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.228576Z","title":null,"venue":null,"work_id":"bfcf0d11-a2e2-4472-9649-bc14e048729d","year":null},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.673184Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:96e5a36f4e3809ee8bc90dc21f8bccd5b39ac51987b9a5750c3031570dba9176","observation_id":"9e8d7cd0-1e21-44a7-abbf-cb1af5562d7f","resolution":{"observed_at":"2026-08-15T14:26:03.232347Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.217163Z","title":"In contrast, inference follows an or- dered denoising process in which the noise levels of ad- jacent frames are strongly correlated","venue":null,"work_id":"32ec106a-fb78-429b-8a2d-2d922beaa05e","year":null},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.676500Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:cfce5a45d60c95e4227f8dc140b542440320bb78e5d48e4098679cbd4292f6a4","observation_id":"cb06a336-df76-4c5b-848b-c48a26b33a11","resolution":{"observed_at":"2026-08-15T14:26:03.221138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:26:03.205681Z","title":"All methods generate videos at 256×256 resolution and 16 frames","venue":null,"work_id":"b141ef30-a0cd-4799-9a79-054e2f50ae3d","year":null},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.680989Z"},"links":{"citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:d23fa46dd962cd4d474ffa44a796197970685fc7fcfc74483a7b7e02a1ab6fc3","observation_id":"6f60e16a-1fba-4e4a-88ce-10b0a1203c3c","resolution":{"observed_at":"2026-08-15T14:26:03.209731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T22:57:14.833976Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":2,"verified_fuzzy":30},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 0 inbound Pith citation observations for arXiv:2608.10439."}