{"as_of":"2026-08-20T11:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9dbf084370fea26e6bc8f8e2db0ed92903a57c70ea36a68c2f76c6116180018a","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:52:25.436180Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:07:43.813266Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T18:14:17.475967Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14470","snapshot_observed_at":"2026-08-06T18:08:50.769871Z","title":"Turbo2k: Towards ultra-efficient and high-quality 2k video synthesis.arXiv preprint arXiv:2504.14470, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09168","last_updated":"2025-07-12T07:14:00Z","snapshot_observed_at":"2026-08-19T15:25:59.174075Z","submitted_at":"2025-07-12T07:14:00Z","title":"Stable Score Distillation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:08:50.769871Z"},"links":{"cited_paper":"/paper/2504.14470","citing_paper":"/paper/2507.09168"},"observation_digest":"sha256:e70301a45a504f42443ca1b8d6300a6329bdf88c5dda1caf4fc58cfab89bf55d","observation_id":"7be738f9-1eb0-4ae8-b293-2838ccf047ea","resolution":{"observed_at":"2026-08-06T18:08:50.769871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14470","snapshot_observed_at":"2026-08-15T18:07:43.813266Z","title":"Turbo2k: Towards ultra-efficient and high-quality 2k video synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19071","last_updated":"2025-07-25T08:45:02Z","snapshot_observed_at":"2026-08-17T23:09:38.353172Z","submitted_at":"2025-07-25T08:45:02Z","title":"Cross-Subject Mind Decoding from Inaccurate Representations","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T18:07:43.813266Z"},"links":{"cited_paper":"/paper/2504.14470","citing_paper":"/paper/2507.19071"},"observation_digest":"sha256:d58ebc08b5ae81dfc93b140b4af78c7747c5e380634e6b46d15d6650a20e1026","observation_id":"f425b96d-16b4-466a-8f82-ebdbc6850b15","resolution":{"observed_at":"2026-08-15T18:07:43.813266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14470","snapshot_observed_at":"2026-08-05T17:46:35.877850Z","title":"Turbo2k: Towards ultra-efficient and high- quality 2k video synthesis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.15774","last_updated":"2025-08-21T17:59:57Z","snapshot_observed_at":"2026-08-17T04:10:52.927125Z","submitted_at":"2025-08-21T17:59:57Z","title":"CineScale: Free Lunch in High-Resolution Cinematic Visual Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T17:46:35.877850Z"},"links":{"cited_paper":"/paper/2504.14470","citing_paper":"/paper/2508.15774"},"observation_digest":"sha256:cacb6025c810e7a00ba82d6c355459ba1bcb5e27b32bdcece8b5b67239552ac0","observation_id":"d51b0411-ba73-4b4a-aa81-71c9e221ebe0","resolution":{"observed_at":"2026-08-05T17:46:35.877850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"cited_work":{"arxiv_id":"2504.14470","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.14470","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Turbo2k: Towards ultra-efficient and high-quality 2k video synthesis","venue":null,"work_id":"cd9ab608-3394-482e-99ca-c18947537e1c","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-08-16T13:02:11.364989Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2504.14470","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:0ffb3b1d2f15aed230975d5285f26f34902c9d75d2fe07344e47c5b954704bfb","observation_id":"8ac90f75-9251-4c56-b33c-46dec4595a7e","resolution":{"observed_at":"2026-05-21T18:14:17.489304Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.14470/citation-record","integrity":"/paper/2504.14470/integrity","json":"/paper/2504.14470/citation-record.json","paper":"/paper/2504.14470"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-16T11:52:25.239587Z","title":"Cosmos world foun- dation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.239587Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:5ac99ddb4763ff56fdb6f0d14f458154ca04c91f25152c5cc045302b35305ce0","observation_id":"eb3e67f0-a71f-485a-8d2c-f7ae65945ebd","resolution":{"observed_at":"2026-08-16T11:52:25.239587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:26.109445Z","title":"Investigating tradeoffs in real-world video super-resolution","venue":null,"work_id":"aaefa96f-c446-47b1-a915-97c2163e3edf","year":2022},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.245085Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:6404a67044cc5c677ba455040de572cd63a099ec350816e61e4c053d6105fa0c","observation_id":"ebb77c4b-dd2d-4388-9a52-2faf032d13aa","resolution":{"observed_at":"2026-08-16T11:52:26.114310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10733","last_updated":"2025-05-18T21:17:22Z","snapshot_observed_at":"2026-08-18T11:02:33.658704Z","submitted_at":"2024-10-14T17:15:07Z","title":"Deep Compression Autoencoder for Efficient High-Resolution Diffusion Models","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10733","snapshot_observed_at":"2026-08-16T11:52:25.250224Z","title":"Deep compression autoencoder for efficient high-resolution diffu- sion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.250224Z"},"links":{"cited_paper":"/paper/2410.10733","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:59796f52f4225c5279bccbeff1157a468981fad5c474b4a88ba7adf09960d0ff","observation_id":"48184b11-7357-41b9-a0a9-30fda1ef4b80","resolution":{"observed_at":"2026-08-16T11:52:25.250224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:26.095634Z","title":"Pixart- σ: Weak-to-strong training of diffusion transformer for 4k text-to-image generation","venue":null,"work_id":"a0037939-4fca-4e24-b9fe-1cd7fe6f9e4a","year":2025},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.255716Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:3bc7b1ef063bfb26eee979c456388ef70f828a708de1bfe747d6f71fe67128a0","observation_id":"41b2b7ef-95c1-486d-a692-7fe129baabe1","resolution":{"observed_at":"2026-08-16T11:52:26.100079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04325","last_updated":"2024-06-06T17:58:54Z","snapshot_observed_at":"2026-08-16T13:45:24.844176Z","submitted_at":"2024-06-06T17:58:54Z","title":"ShareGPT4Video: Improving Video Understanding and Generation with Better Captions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04325","snapshot_observed_at":"2026-08-16T11:52:25.260944Z","title":"Sharegpt4video: Improving video understand- ing and generation with better captions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.260944Z"},"links":{"cited_paper":"/paper/2406.04325","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:0f2370484e14637a72a96f3f585267c91fec96c9a2a8212a36388314931c33b2","observation_id":"8a3d83d8-9cee-4397-a0ce-37873dbe3792","resolution":{"observed_at":"2026-08-16T11:52:25.260944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02084","last_updated":"2025-03-09T09:36:28Z","snapshot_observed_at":"2026-08-19T17:23:41.422722Z","submitted_at":"2024-03-04T14:36:56Z","title":"ResAdapter: Domain Consistent Resolution Adapter for Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02084","snapshot_observed_at":"2026-08-16T11:52:25.266940Z","title":"Resadapter: Domain consistent resolution adapter for diffu- sion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.266940Z"},"links":{"cited_paper":"/paper/2403.02084","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:5228f150eb836a109b4a5f310721d4bfb99e168012ea6a4c02cd740b97fa2269","observation_id":"d241eff4-eb38-42ca-a7fc-f2aa10d9b3b2","resolution":{"observed_at":"2026-08-16T11:52:25.266940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:26.081459Z","title":"Demofusion: Democratising high- resolution image generation with no $$$","venue":null,"work_id":"1292fb8d-3306-498e-9736-0eb733ca51c1","year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.272184Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:70a3062231f0cef51fcf0438cae6581069fc8894e874d692352cd8159915f63e","observation_id":"0a551235-2a97-4fa1-82b0-1a6d551d7d02","resolution":{"observed_at":"2026-08-16T11:52:26.086229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:25.276439Z","title":"Scaling recti- fied flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.276439Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:a33f90dbfe8216e38cc6b864dc8f309b8707f577384d1482746b00beb9744513","observation_id":"c01d0a9c-31fa-43c0-91c9-431b3284342d","resolution":{"observed_at":"2026-08-16T11:52:25.276439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:26.057817Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"5cca036f-cdbc-4e18-9d16-e71335eb2c1b","year":2021},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.280636Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:cfe0cf2422e9c1ca2839bd9e81d3589f499a5963907fce9458248a22c03b154c","observation_id":"8b306e8b-a25b-4ef8-ae67-05d1313a971c","resolution":{"observed_at":"2026-08-16T11:52:26.062854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-08-16T12:58:55.502275Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-08-16T11:52:25.284765Z","title":"Vchitect-2.0: Parallel trans- former for scaling up video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.284765Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:ed26d4ce318dd0987a0d78bb5eb554c13d6e3162d05561e1814b36457edf2af6","observation_id":"32ea8a0b-5f11-4b58-9fd0-efdeb7c72adb","resolution":{"observed_at":"2026-08-16T11:52:25.284765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:26.042629Z","title":"Make a cheap scaling: A self-cascade diffusion model for higher-resolution adapta- tion","venue":null,"work_id":"eda906d7-3ddc-49f0-a0af-6204b6530c4e","year":2025},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.289578Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:bc5bf68448bf4785583b7851de2cb888a6ef9c42f7b10d404522b046476e7623","observation_id":"e803a928-f4d9-4b00-9068-e4449384221c","resolution":{"observed_at":"2026-08-16T11:52:26.047826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-16T11:52:25.293823Z","title":"Ltx-video: Realtime video latent diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.293823Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:2076626faa5f2927168d56241bdc3f7853caa9a99c74651da58ac4ec264df626","observation_id":"bf677e31-8fb6-484b-a3fa-8e0279d75832","resolution":{"observed_at":"2026-08-16T11:52:25.293823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07667","last_updated":"2024-07-10T13:46:08Z","snapshot_observed_at":"2026-08-16T13:35:25.799845Z","submitted_at":"2024-07-10T13:46:08Z","title":"VEnhancer: Generative Space-Time Enhancement for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07667","snapshot_observed_at":"2026-08-16T11:52:25.298226Z","title":"Venhancer: Generative space-time enhancement for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.298226Z"},"links":{"cited_paper":"/paper/2407.07667","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:b42d3acc42643cab140ce53cb436e46fb04ba89d317477d3f288e1ec6c81804c","observation_id":"25294acf-7614-490c-9c19-5d73532448a2","resolution":{"observed_at":"2026-08-16T11:52:25.298226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:26.028474Z","title":"Scalecrafter: Tuning-free higher- resolution visual generation with diffusion models","venue":null,"work_id":"bba3722f-c2e7-492c-bde6-888c1acf8382","year":2023},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.302691Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:5e89a2e6fa5c2028a1ef17a047765f7864626e52690fff3f07c5037ded22a1b7","observation_id":"32d9103b-30d9-4757-91b8-2922e15dc849","resolution":{"observed_at":"2026-08-16T11:52:26.033221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-08-12T19:21:15.526321Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15868","snapshot_observed_at":"2026-08-16T11:52:25.307052Z","title":"Cogvideo: Large-scale pretraining for text-to-video generation via transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.307052Z"},"links":{"cited_paper":"/paper/2205.15868","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:f255318edba5c8078a22f3112bbc198e04419715dc817450b3d00c5c89e59c49","observation_id":"0fa5043f-3fb7-4914-9d79-c24c5f8beaab","resolution":{"observed_at":"2026-08-16T11:52:25.307052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:25.311579Z","title":"Vbench: Comprehensive bench- mark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.311579Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:9466a7b017cd506322280ce7715068bf6140710c7e4b0205036e22b14ec1eff8","observation_id":"a07cc765-e7d1-4673-a3a9-46930eed3e0f","resolution":{"observed_at":"2026-08-16T11:52:25.311579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:25.315547Z","title":"Musiq: Multi-scale image quality transformer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.315547Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:96302feaaad87a8fc6a55fd075a58bfe48dc751493583b79d8cfcba0032b5bce","observation_id":"12f5a03f-cfcc-41f3-8d8f-79c3d4180a5a","resolution":{"observed_at":"2026-08-16T11:52:25.315547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-16T11:52:25.319751Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.319751Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:a2554b9dc012792017388906bce9b9e0451966091175c77ee5d17aa570823328","observation_id":"33b56541-3f47-4dfc-b28e-2413fd3c58d5","resolution":{"observed_at":"2026-08-16T11:52:25.319751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-17T07:44:10.213698Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-16T11:52:25.324287Z","title":"Hunyuanvideo: A systematic framework for large video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.324287Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:4a1d9544899bf36252de05022cfcf75ae71c9daaad5608552e98c1d7f1bdedbb","observation_id":"82a99748-89b1-4e0c-aedc-af37a12bdda8","resolution":{"observed_at":"2026-08-16T11:52:25.324287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00131","last_updated":"2024-11-28T14:07:45Z","snapshot_observed_at":"2026-08-13T21:19:07.777045Z","submitted_at":"2024-11-28T14:07:45Z","title":"Open-Sora Plan: Open-Source Large Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00131","snapshot_observed_at":"2026-08-16T11:52:25.328720Z","title":"Open-sora plan: Open-source large video generation model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.328720Z"},"links":{"cited_paper":"/paper/2412.00131","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:6c5ff1c00e3f6b5efe13715173cbb58ea9dfa69d8cc498b523e5d4e8fd1c5ebe","observation_id":"875c36a9-0f13-4923-8adb-bf89bfc9a43c","resolution":{"observed_at":"2026-08-16T11:52:25.328720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16112","last_updated":"2024-12-20T17:57:09Z","snapshot_observed_at":"2026-08-15T20:19:47.193159Z","submitted_at":"2024-12-20T17:57:09Z","title":"CLEAR: Conv-Like Linearization Revs Pre-Trained Diffusion Transformers Up","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16112","snapshot_observed_at":"2026-08-16T11:52:25.333118Z","title":"Clear: Conv-like linearization revs pre-trained diffusion transform- ers up","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.333118Z"},"links":{"cited_paper":"/paper/2412.16112","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:e4e1a52d42c15509a70f68b82c4f65c35685aab679b90ae02beebab5709c4ae8","observation_id":"9bd96dac-1d45-4a55-a7bb-3afa37166922","resolution":{"observed_at":"2026-08-16T11:52:25.333118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","snapshot_observed_at":"2026-08-18T07:06:04.890772Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02097","snapshot_observed_at":"2026-08-16T11:52:25.338444Z","title":"Linfusion: 1 gpu, 1 minute, 16k image.arXiv preprint arXiv:2409.02097, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.338444Z"},"links":{"cited_paper":"/paper/2409.02097","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:c3c17e3237d6bcd7af8967784e56c64bde27b62877a527a5946ed5236360e5f1","observation_id":"0a5f403d-ccf1-4369-8efd-ea393381b59f","resolution":{"observed_at":"2026-08-16T11:52:25.338444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02919","last_updated":"2024-09-09T09:11:28Z","snapshot_observed_at":"2026-08-16T13:21:19.654977Z","submitted_at":"2024-09-04T17:58:08Z","title":"HiPrompt: Tuning-free Higher-Resolution Generation with Hierarchical MLLM Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02919","snapshot_observed_at":"2026-08-16T11:52:25.343065Z","title":"Hiprompt: Tuning-free higher-resolution gen- eration with hierarchical mllm prompts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.343065Z"},"links":{"cited_paper":"/paper/2409.02919","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:ea5d7e3261e13822080769fc91a3e06130c3a3d067c57ed7cc629f4c1e53d50c","observation_id":"04b26326-5a01-4e76-9135-d69df349448b","resolution":{"observed_at":"2026-08-16T11:52:25.343065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:25.347133Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.347133Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:01d09fbddba409eb3e0c0553071a24c085764b013106b13d8492aa07bbd61fa5","observation_id":"77518c5b-b9e8-4d1a-9450-1808e0219a9d","resolution":{"observed_at":"2026-08-16T11:52:25.347133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:25.989376Z","title":"completely blind","venue":null,"work_id":"45bdd3c9-741f-4129-80ec-c48487dd65bf","year":2012},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.351524Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:1d8214d568aed2cb49800d4c22268175813bd37796fda11e975ee12ddc57cfe1","observation_id":"38b62bd2-d9d5-4926-b224-bc062bc98743","resolution":{"observed_at":"2026-08-16T11:52:25.993537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:25.356090Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.356090Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:3044125553e6d35a4ac2756ef5fc4cff40d8f50e2c4d47aeda865866fd97d493","observation_id":"2a9ad8cb-bbd1-47f3-b43c-5ad1ef9d4b60","resolution":{"observed_at":"2026-08-16T11:52:25.356090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-16T11:52:25.360875Z","title":"W ¨urstchen: An efficient architecture for large-scale text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.360875Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:6aa12a84bb831c4da2d8744dddcc30455ca8249c3d1213de7a223b90f2f24e40","observation_id":"18f93a58-db4d-4094-bac1-17e8287198d4","resolution":{"observed_at":"2026-08-16T11:52:25.360875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02158","last_updated":"2024-07-04T08:11:19Z","snapshot_observed_at":"2026-08-16T13:37:48.106145Z","submitted_at":"2024-07-02T11:02:19Z","title":"UltraPixel: Advancing Ultra-High-Resolution Image Synthesis to New Peaks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02158","snapshot_observed_at":"2026-08-16T11:52:25.365345Z","title":"Ultrapixel: Advancing ultra-high-resolution image synthesis to new peaks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.365345Z"},"links":{"cited_paper":"/paper/2407.02158","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:8fbc92fe591862b8d41a7fb23f7273df5653afda5ce87d2b76c95f3c211ccded","observation_id":"300d904a-0c5f-4b0b-8a80-46531af3a348","resolution":{"observed_at":"2026-08-16T11:52:25.365345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:25.966884Z","title":null,"venue":null,"work_id":"99fb0a20-cd17-4da9-9e21-c36fee2c04d1","year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.369873Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:07732d854c6f6787f493f5b15ff017d059c148504d5b3784da519bb80ac35b1e","observation_id":"3a728de1-999d-4d01-9542-9b1ff8f710ea","resolution":{"observed_at":"2026-08-16T11:52:25.971058Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:25.952230Z","title":"Ex- ploring clip for assessing the look and feel of images","venue":null,"work_id":"ca1f0b65-089f-4f7a-b0ad-fa15a9b98279","year":2023},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.373851Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:d29e7a0cea38e54594c909656dca73f1dee476e284f947d71358f116305e7ffa","observation_id":"329c4048-17cf-4bc1-9f91-49ff7e25b8f7","resolution":{"observed_at":"2026-08-16T11:52:25.957389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01320","last_updated":"2025-03-22T07:44:02Z","snapshot_observed_at":"2026-08-17T16:11:59.326855Z","submitted_at":"2025-01-02T16:19:48Z","title":"SeedVR: Seeding Infinity in Diffusion Transformer Towards Generic Video Restoration","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01320","snapshot_observed_at":"2026-08-16T11:52:25.378257Z","title":"Seedvr: Seeding in- finity in diffusion transformer towards generic video restora- tion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.378257Z"},"links":{"cited_paper":"/paper/2501.01320","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:c2e44452847387e1bb410de945af1c01eae061930fe16fde44b0057704c64088","observation_id":"d1950a46-d4a7-433c-a2c3-a70752f6b632","resolution":{"observed_at":"2026-08-16T11:52:25.378257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:25.382602Z","title":"Exploiting diffusion prior for real-world image super-resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.382602Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:65cabdd9e547f1f95356bd2a3f6b5fc500894f9b59f5a29274e5f0e7b9ba24fe","observation_id":"6bdfc631-902e-4f18-b179-80c62c494247","resolution":{"observed_at":"2026-08-16T11:52:25.382602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:25.927552Z","title":"Exploring video quality assessment on user gener- ated contents from aesthetic and technical perspectives","venue":null,"work_id":"973e0277-6663-4953-bc19-b58639c53450","year":2023},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.386856Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:837ad9df4a52649a333b2bcf5903023ae8fc8bd5428d0ab218c6bd9ac51bc147","observation_id":"3052eb01-8f55-4eee-ba50-3a6b128a27bf","resolution":{"observed_at":"2026-08-16T11:52:25.932289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:25.912649Z","title":"Seesr: Towards semantics- aware real-world image super-resolution","venue":null,"work_id":"32dd8273-03c9-423b-8eff-a307b8bc3fe5","year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.392334Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:7a33c2742b99c1e407ed0c9fb6d86dee9d095174b9ec5fe50dae2da189265cbc","observation_id":"5d7fe0ee-fa4d-42e5-8221-851c1b857b07","resolution":{"observed_at":"2026-08-16T11:52:25.918208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10629","last_updated":"2024-10-20T14:35:31Z","snapshot_observed_at":"2026-08-20T10:31:24.549119Z","submitted_at":"2024-10-14T15:36:42Z","title":"SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10629","snapshot_observed_at":"2026-08-16T11:52:25.396743Z","title":"Sana: Efficient high-resolution image syn- thesis with linear diffusion transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.396743Z"},"links":{"cited_paper":"/paper/2410.10629","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:fb2656c3a4cab429b83976bab2f443dda3a8ad189567e9f577557001741022e2","observation_id":"6ed8d188-f308-4a84-9bac-4460ecc9bb1a","resolution":{"observed_at":"2026-08-16T11:52:25.396743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02976","last_updated":"2025-01-06T12:36:21Z","snapshot_observed_at":"2026-08-19T22:21:53.510433Z","submitted_at":"2025-01-06T12:36:21Z","title":"STAR: Spatial-Temporal Augmentation with Text-to-Video Models for Real-World Video Super-Resolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02976","snapshot_observed_at":"2026-08-16T11:52:25.400947Z","title":"Star: Spatial-temporal augmentation with text-to- video models for real-world video super-resolution","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.400947Z"},"links":{"cited_paper":"/paper/2501.02976","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:1256742937ae4144831fb8464c1a4f29a705555591d9cf528c38ea51aa6aebf0","observation_id":"bab01413-31c5-4a6b-afa6-023c3ae30dcc","resolution":{"observed_at":"2026-08-16T11:52:25.400947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-08-15T19:52:28.153954Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-16T11:52:25.405339Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.405339Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:dbd35d7c940a59775fc3d78a9bbd867f0acac2e2cdd9e862a64f6352dc9c93f0","observation_id":"a8c9398d-8f37-4125-96f9-df8d7648c39e","resolution":{"observed_at":"2026-08-16T11:52:25.405339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:25.898165Z","title":"Scaling up to excellence: Practicing model scaling for photo- realistic image restoration in the wild","venue":null,"work_id":"7b193dc6-bbb6-42e8-8300-7ece293a21cd","year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.409958Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:c30f6f459871291463324f20558b583150e67fa1bbbb23c629ee5805dbc8e3e7","observation_id":"bcdb269e-a2b3-4685-9754-937bf1586de6","resolution":{"observed_at":"2026-08-16T11:52:25.902874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:25.414280Z","title":"Sageattention2: Efficient attention with thorough outlier smoothing and per-thread int4 quanti- zation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.414280Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:c0779a23d72e2cb4baabfb13ecd7984f820e667343c711b98dfc6ee139c6072f","observation_id":"445deef2-5bdb-4e68-a445-8ace75c8d906","resolution":{"observed_at":"2026-08-16T11:52:25.414280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17528","last_updated":"2024-04-29T09:26:36Z","snapshot_observed_at":"2026-08-18T20:45:42.873656Z","submitted_at":"2023-11-29T11:01:38Z","title":"HiDiffusion: Unlocking Higher-Resolution Creativity and Efficiency in Pretrained Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17528","snapshot_observed_at":"2026-08-16T11:52:25.418566Z","title":"Hidiffusion: Unlocking high-resolution creativity and effi- ciency in low-resolution trained diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.418566Z"},"links":{"cited_paper":"/paper/2311.17528","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:add9d4c752aa3e4b603c2f12a4d3265384c742baebcd6405b4b40fb8d7ef2ad3","observation_id":"17ab6008-7f4c-4f0c-8d09-74f6b5b6081f","resolution":{"observed_at":"2026-08-16T11:52:25.418566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-16T11:52:25.423010Z","title":"Open-sora: Democratizing efficient video production for all","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.423010Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:a62fc17e2724529adfd8aed33ba55f70627490d3e61f7bab582deee4c7b5651f","observation_id":"64cc803b-595e-4997-84fb-36a7b8e78e40","resolution":{"observed_at":"2026-08-16T11:52:25.423010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:25.882989Z","title":"Upscale-a-video: Temporal- consistent diffusion model for real-world video super- resolution","venue":null,"work_id":"614219f3-2b5b-46d2-8d51-21c2aec40d47","year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.427260Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:c50db1393d01e656da2a7a187ee7818d82f6dd224afd053e51593584ed97b344","observation_id":"35246f51-e103-4651-86f5-287086d10bbd","resolution":{"observed_at":"2026-08-16T11:52:25.888133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18583","last_updated":"2024-06-05T17:53:26Z","snapshot_observed_at":"2026-08-16T13:45:47.270039Z","submitted_at":"2024-06-05T17:53:26Z","title":"Lumina-Next: Making Lumina-T2X Stronger and Faster with Next-DiT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18583","snapshot_observed_at":"2026-08-16T11:52:25.431774Z","title":"Lumina-next: Making lumina-t2x stronger and faster with next-dit","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.431774Z"},"links":{"cited_paper":"/paper/2406.18583","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:ebfe4ce968c73bdf9846e98e1e149d96c53130741d9ece1bfd7be03d34462073","observation_id":"1504b808-2145-4624-8f8b-085f8bacdb75","resolution":{"observed_at":"2026-08-16T11:52:25.431774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:52:25.866537Z","title":"This supplementary document provides addi- tional implementation details in Sec","venue":null,"work_id":"084f58bd-d590-4755-8518-679fc9328b63","year":null},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.436180Z"},"links":{"citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:acf8cda9e0f2057407426bfa7cd3239105af3c683c749ca1cad93aecbf42836b","observation_id":"ab92185b-e817-443b-9f66-b06a14f13606","resolution":{"observed_at":"2026-08-16T11:52:25.872752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 4 inbound Pith citation observations for arXiv:2504.14470."}