{"as_of":"2026-08-18T07:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:363b2b6e5ee56195b798e910dda02465b2761b9a52c9c52eaf438a069c0198c5","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:45:28.834534Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.21070/citation-record","integrity":"/paper/2505.21070/integrity","json":"/paper/2505.21070/citation-record.json","paper":"/paper/2505.21070"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:31.433613Z","title":"Block diffusion: Interpolating between autoregressive and diffusion language models","venue":null,"work_id":"c52e0f0d-19b2-4a9f-a327-f2ed8f7a1cc8","year":2025},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:26.871786Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:44b6ea39e802f4fa33e00628efb3373d1d3b658c863eba1f9587540d4fc9395f","observation_id":"51c00cee-45eb-49f5-9bc9-48dfa9f2e2d0","resolution":{"observed_at":"2026-08-07T13:45:31.503682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:31.289480Z","title":"All are worth words: A vit backbone for diffusion models","venue":null,"work_id":"3c969784-78f9-4996-9313-943626b08f08","year":2023},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:26.925869Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:9c2f6ec59856c8d02293043536125ab851ac2835d420b32a5dbecccf0422cd05","observation_id":"ff4af4ea-8194-45b7-9961-d30e7bc1b404","resolution":{"observed_at":"2026-08-07T13:45:31.353496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:26.996822Z","title":"Videocrafter1: Open diffusion models for high-quality video generation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:26.996822Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:b397dc13d1aaa9ac50c4e589e7bfa1f33c9f62155736e05c9948cfd45b76cba2","observation_id":"01359bea-e730-4d5b-835a-c139a1e7ebf4","resolution":{"observed_at":"2026-08-07T13:45:26.996822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:31.130191Z","title":"Videocrafter2: Overcoming data limitations for high-quality video diffusion models","venue":null,"work_id":"15a066c1-f468-4d8f-99bd-0b9d5037f013","year":2024},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:27.084254Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:4e90c82ecd994aed5410f3e75f7c1ca2781576cc195ce552c825774a8401a86d","observation_id":"22dc709b-07dc-49ea-9b00-48e187093ce0","resolution":{"observed_at":"2026-08-07T13:45:31.181767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01738","last_updated":"2024-11-04T01:40:38Z","snapshot_observed_at":"2026-08-16T13:03:20.618441Z","submitted_at":"2024-11-04T01:40:38Z","title":"xDiT: an Inference Engine for Diffusion Transformers (DiTs) with Massive Parallelism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01738","snapshot_observed_at":"2026-08-07T13:45:27.138943Z","title":"xdit: an inference engine for diffusion transformers (dits) with massive parallelism.arXiv preprint arXiv:2411.01738, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:27.138943Z"},"links":{"cited_paper":"/paper/2411.01738","citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:90c5d52384c53318bc1d42160d972bccbe473eee80827a19a427f65afdc0da0d","observation_id":"7a03318c-a321-4bdf-94b4-7a63581dd382","resolution":{"observed_at":"2026-08-07T13:45:27.138943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14430","last_updated":"2025-12-03T10:59:23Z","snapshot_observed_at":"2026-08-16T19:24:02.063445Z","submitted_at":"2024-05-23T11:00:07Z","title":"PipeFusion: Patch-level Pipeline Parallelism for Diffusion Transformers Inference","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14430","snapshot_observed_at":"2026-08-07T13:45:27.198549Z","title":"Pipefusion: Patch-level pipeline parallelism for diffusion transformers inference.arXiv preprint arXiv:2405.14430, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:27.198549Z"},"links":{"cited_paper":"/paper/2405.14430","citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:f1e7060abee8c31ced5f541356db8ef18ba28c22db9856fa049fef1789183538","observation_id":"78fdaa28-44c8-426a-b085-67d4cf611067","resolution":{"observed_at":"2026-08-07T13:45:27.198549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:27.250535Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:27.250535Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:752aec6be7342fd559b2910bf9e30e373dee4f87f0b34285137eb98a7d74d5ae","observation_id":"06f53c24-e72c-425d-bf15-82599715ce59","resolution":{"observed_at":"2026-08-07T13:45:27.250535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:30.987643Z","title":"Cogvideo: Large-scale pretraining for text-to-video generation via transformers","venue":null,"work_id":"ce8dde68-42d7-42a9-9054-d9fa2b4aa799","year":2023},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:27.311001Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:a012063c92d60110687727d90196b4fa13409e5a09af755f492ba984e9151281","observation_id":"bed4473b-4274-433a-b82c-17209224877f","resolution":{"observed_at":"2026-08-07T13:45:31.050086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:30.847606Z","title":"Gpipe: Efficient training of giant neural networks using pipeline parallelism","venue":null,"work_id":"d30113f4-2c58-4cc2-854b-adb73e6079d9","year":2019},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:27.366494Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:8790a52693f5351abee3d03b224bb1f8fbd566aa38050450f1cc7074db762447","observation_id":"4a0866f3-ecac-4575-9b70-7eb9789c21fa","resolution":{"observed_at":"2026-08-07T13:45:30.895833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:27.439067Z","title":"VBench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:27.439067Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:816066c9c1121242bb89b0348aba185d4a6765854b6aff430eaf73970ee96d16","observation_id":"b3feba87-8545-428c-aafd-fda62ae7a666","resolution":{"observed_at":"2026-08-07T13:45:27.439067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14509","last_updated":"2023-10-04T16:51:13Z","snapshot_observed_at":"2026-08-13T22:49:56.824755Z","submitted_at":"2023-09-25T20:15:57Z","title":"DeepSpeed Ulysses: System Optimizations for Enabling Training of Extreme Long Sequence Transformer Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14509","snapshot_observed_at":"2026-08-07T13:45:27.503078Z","title":"Deepspeed ulysses: System optimizations for enabling training of extreme long sequence transformer models.arXiv preprint arXiv:2309.14509, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:27.503078Z"},"links":{"cited_paper":"/paper/2309.14509","citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:7394cf188747e76e34da0d40598c4e66b014e65b381056069571941c8317165e","observation_id":"c80ae0b7-2ca4-4c79-97a9-e3237c7ed67e","resolution":{"observed_at":"2026-08-07T13:45:27.503078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:30.665913Z","title":"Fifo-diffusion: Generating infinite videos from text without training","venue":null,"work_id":"d2b88f78-108f-4e9e-bdbe-d432a2225c56","year":2024},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:27.553782Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:144c6e04007c758415fd41435593b493b93de34f189e0a74d2b157ef2951be13","observation_id":"ea15885b-467e-4456-88d6-62a0a2ae2ea6","resolution":{"observed_at":"2026-08-07T13:45:30.742932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-17T07:44:10.213698Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-07T13:45:27.624670Z","title":"Hunyuanvideo: A systematic framework for large video generative models.arXiv preprint arXiv:2412.03603, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:27.624670Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:4c66a9b934ff7481ba32bcfecb9f9d1300f2148dc40f9829adc290248c529fef","observation_id":"6d58535e-b2b3-4bfe-ba15-85702bb57a68","resolution":{"observed_at":"2026-08-07T13:45:27.624670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:30.500212Z","title":"T2v-turbo: Breaking the quality bottleneck of video consistency model with mixed reward feedback","venue":null,"work_id":"1d110237-274d-4676-99c6-181a574bcaed","year":2024},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:27.690239Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:41dfdd2a031e9e879384c55fea3be820efc8d3d99fdd430a6b61574191f7080c","observation_id":"4c7a99e7-ca41-49cb-ab31-c6cfa78cd3f6","resolution":{"observed_at":"2026-08-07T13:45:30.576901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:30.355169Z","title":"T2v-turbo-v2: Enhancing video generation model post-training through data, reward, and conditional guidance design","venue":null,"work_id":"4ae3e9fa-ee5f-4497-bf15-fcd595706af9","year":2025},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:27.744974Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:b465070f3567586cacff8c58833db6ddf9586bd09ed7b8663a7ff0ea9fd335b3","observation_id":"87e36d89-bd69-4968-a874-ab0e2b9e3419","resolution":{"observed_at":"2026-08-07T13:45:30.439169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:30.222400Z","title":"Terapipe: Token-level pipeline parallelism for training large-scale language models","venue":null,"work_id":"d62e291d-9ff0-4fdb-bb5e-d880b6b87461","year":2021},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:27.842456Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:d25459921f94d27ab6775b28e2fc10e7defbe1fea31e799e450ef8cee0834e49","observation_id":"d12c7c96-f88c-4e95-ba7d-998d5c7205c8","resolution":{"observed_at":"2026-08-07T13:45:30.270214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01889","last_updated":"2023-11-27T06:38:47Z","snapshot_observed_at":"2026-08-14T10:14:18.862721Z","submitted_at":"2023-10-03T08:44:50Z","title":"Ring Attention with Blockwise Transformers for Near-Infinite Context","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01889","snapshot_observed_at":"2026-08-07T13:45:27.910056Z","title":"Ring attention with blockwise transformers for near-infinite context.arXiv preprint arXiv:2310.01889, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:27.910056Z"},"links":{"cited_paper":"/paper/2310.01889","citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:9f1bb5a4c38a9574bdcf20c12be2ea7c5c10747b93506e5f2ccf59b783872fde","observation_id":"243e9872-d7e3-4df0-93d3-9ee414c14d82","resolution":{"observed_at":"2026-08-07T13:45:27.910056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:27.980773Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:27.980773Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:70cacefd5c8ac64e70c40ba450501b807c7b547efccca764647a7c97ffcf72af","observation_id":"0bf4c706-e724-448c-975e-e3618d5d9549","resolution":{"observed_at":"2026-08-07T13:45:27.980773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-14T22:40:32.716624Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-08-07T13:45:28.060326Z","title":"Open-sora 2.0: Training a commercial-level video generation model in 200k.arXiv preprint arXiv:2503.09642, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:28.060326Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:a2319b540a4c02f7c1b2c27a15bf26e344283765fdd0eb923eb63f0483dc3cb0","observation_id":"2e5a897e-57a6-4b54-862e-e9c1df1ae115","resolution":{"observed_at":"2026-08-07T13:45:28.060326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:30.020409Z","title":"Zero bubble (almost) pipeline parallelism","venue":null,"work_id":"94e7d04d-4ea2-4743-b935-7417130c9005","year":2024},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:28.134238Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:0db4dc9c8c50781dadb1ae63f68892e07bdbc2d3cbeeecd87d93ce08d0af3b92","observation_id":"6f483f4b-a9af-4c53-80d5-3094463be792","resolution":{"observed_at":"2026-08-07T13:45:30.130147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:29.844001Z","title":"Freenoise: Tuning-free longer video diffusion via noise rescheduling","venue":null,"work_id":"cfc67f4b-ce3b-4db9-b8e5-aa9dae39f52c","year":2024},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:28.211950Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:8f92d2790b0da70867f9a22603f518df9c6d77a8907dba36d47b5264a6aacf86","observation_id":"de7cfed2-61e4-4b04-b27e-2ceffcf8bb94","resolution":{"observed_at":"2026-08-07T13:45:29.954717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:29.710165Z","title":"Rolling diffusion models","venue":null,"work_id":"03906a37-5b2e-4cb8-a854-6463919abaee","year":2024},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:28.293059Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:4fe7051a5bd30b78b9df8a81372ba0a65798b400d5dde553733815b2ba1458d1","observation_id":"96b5cd7a-cf6f-43e3-b66b-aa925253a59c","resolution":{"observed_at":"2026-08-07T13:45:29.745132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:28.354570Z","title":"Magi-1: Autoregressive video generation at scale, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:28.354570Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:3385d2feb3cb77bffe69592cd083557644cdb6755ea26eec3435dddf635294ec","observation_id":"707d5c50-9b0a-4232-99e6-e5a16a5d9608","resolution":{"observed_at":"2026-08-07T13:45:28.354570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:28.429065Z","title":"Megatron-lm: Training multi-billion parameter language models using model parallelism, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:28.429065Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:0be0b204db758c6d3986727dfb9966d4fde95769074b26a5e59b04447de79645","observation_id":"eb28f25d-233d-4ce2-bf24-ec788f30317c","resolution":{"observed_at":"2026-08-07T13:45:28.429065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16260","last_updated":"2024-06-24T01:56:12Z","snapshot_observed_at":"2026-08-16T13:40:19.376262Z","submitted_at":"2024-06-24T01:56:12Z","title":"Video-Infinity: Distributed Long Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16260","snapshot_observed_at":"2026-08-07T13:45:28.480508Z","title":"Video-infinity: Distributed long video generation.arXiv preprint arXiv:2406.16260, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:28.480508Z"},"links":{"cited_paper":"/paper/2406.16260","citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:0fce9bc746acac5b1531bdda1fa0de5ee26cdee8d7943e09b606e9a414206577","observation_id":"f274b9db-7396-4107-b29e-ff9e647aadd9","resolution":{"observed_at":"2026-08-07T13:45:28.480508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:29.498447Z","title":"Attention is all you need","venue":null,"work_id":"b6ace187-d39e-4020-b84e-935cf4763984","year":2017},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:28.553468Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:a3001bdd2cafa90e272d5b770a498e69469f0f7c7fcc771bcf1aad41823b41f4","observation_id":"a785b0a2-d4c6-41d1-87c4-16cf1806ee4a","resolution":{"observed_at":"2026-08-07T13:45:29.567804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:29.352542Z","title":"Wan: Open and advanced large-scale video generative models, 2025","venue":null,"work_id":"b312efe4-4199-426f-9f64-874e7dace141","year":2025},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:28.627505Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:ebea75beed6e6d84136e8b3e5aec37ae58e84df9911e073df0611abc991028b2","observation_id":"5f01cfa0-ecad-4f7e-b1fc-0a7dfc54f6a1","resolution":{"observed_at":"2026-08-07T13:45:29.397490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:29.220898Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":"7b270890-3516-4402-9474-03994a5bd66e","year":2025},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:28.695280Z"},"links":{"citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:e01647429719871b9a6a6146b44ea573703420255cfdac4e121d2d7cac36b8d2","observation_id":"776649de-6ff1-42e4-a669-9043ecb76cf9","resolution":{"observed_at":"2026-08-07T13:45:29.249558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09926","last_updated":"2025-03-13T00:47:59Z","snapshot_observed_at":"2026-08-16T12:50:33.508775Z","submitted_at":"2025-03-13T00:47:59Z","title":"VideoMerge: Towards Training-free Long Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09926","snapshot_observed_at":"2026-08-07T13:45:28.775696Z","title":"Videomerge: Towards training-free long video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:28.775696Z"},"links":{"cited_paper":"/paper/2503.09926","citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:7a28fd196a13c3a12e32ce264eee73df720c8890f42eaa39312c8d183ac803ea","observation_id":"668457ec-3fe6-450b-ac49-16570d0d76c8","resolution":{"observed_at":"2026-08-07T13:45:28.775696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-07T13:45:28.834534Z","title":"Open-sora: Democratizing efficient video production for all.arXiv preprint arXiv:2412.20404, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:28.834534Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2505.21070"},"observation_digest":"sha256:40a95fe21c48aeeb91f77a9cc5882c13f653126c228749762e2de6e49a52afe8","observation_id":"c46993f9-da4a-4aad-864d-d00016a162c2","resolution":{"observed_at":"2026-08-07T13:45:28.834534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.21070","last_updated":"2025-05-29T01:34:08Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T02:57:48.373850Z","submitted_at":"2025-05-27T11:55:22Z","title":"Minute-Long Videos with Dual Parallelisms"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":15},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2505.21070."}