{"as_of":"2026-08-17T23:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e2bd7a49fc416e74a858594c565a79b63056748f17a7fb18b53ee7a518ae3f4e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":61,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:38:39.465001Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T08:49:41.578583Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2405.14430","last_updated":"2025-12-03T10:59:23Z","snapshot_observed_at":"2026-08-16T19:24:02.063445Z","submitted_at":"2024-05-23T11:00:07Z","title":"PipeFusion: Patch-level Pipeline Parallelism for Diffusion Transformers Inference","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-24T01:17:11.261301Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2405.14430"},"observation_digest":"sha256:f862083c906179ec735137895933ad5d7312a2d76f0d4fef76d0b838aaa9dbcd","observation_id":"e010d170-4e2b-4d2b-9aff-50ddd3b83e72","resolution":{"observed_at":"2026-05-24T01:18:42.451669Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-17T10:09:03.767186Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-11T14:16:18.521699Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2410.13720"},"observation_digest":"sha256:e1b2796e76baa70354b093679ddbb111443cdbbe312186953f1ad47c0325368f","observation_id":"068449c1-770e-4e67-ab01-2487027d9d06","resolution":{"observed_at":"2026-05-11T14:16:20.266812Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-12T19:47:54.469023Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10510","last_updated":"2025-05-21T20:52:59Z","snapshot_observed_at":"2026-08-13T20:37:50.084817Z","submitted_at":"2024-11-15T16:24:02Z","title":"SmoothCache: A Universal Inference Acceleration Technique for Diffusion Transformers","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T19:47:54.469023Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2411.10510"},"observation_digest":"sha256:d4ffcbf9d78500e5778bc65d1728547e2dfbabb21cb441684213e63500ccf1e7","observation_id":"cee3c71a-f9f1-4e0d-8d45-d9a4c857d519","resolution":{"observed_at":"2026-08-12T19:47:54.469023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-12T18:47:22.621472Z","title":"Real-time video generation with pyramid attention broadcast","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13588","last_updated":"2024-11-18T02:49:23Z","snapshot_observed_at":"2026-08-13T14:59:12.832950Z","submitted_at":"2024-11-18T02:49:23Z","title":"Unveiling Redundancy in Diffusion Transformers (DiTs): A Systematic Study","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T18:47:22.621472Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2411.13588"},"observation_digest":"sha256:66223d15569918944a13ddd3ce74490af5cd6b861d732d7a5c8807a021702ddf","observation_id":"ce6e9dfb-a30d-44af-8c5d-c5d39ae81a75","resolution":{"observed_at":"2026-08-12T18:47:22.621472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-12T14:24:43.840731Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16720","last_updated":"2025-04-24T21:37:00Z","snapshot_observed_at":"2026-08-17T13:41:18.242726Z","submitted_at":"2024-11-23T02:01:49Z","title":"Importance-Based Token Merging for Efficient Image and Video Generation","version":2},"reference_index":116,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:43.840731Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2411.16720"},"observation_digest":"sha256:ffda99427a305d2fa6b4816885377de498bfeb117d9517354ffc06bd447d73dc","observation_id":"46fe8d79-f749-4c89-9565-3b448c4eb1f2","resolution":{"observed_at":"2026-08-12T14:24:43.840731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-12T12:06:01.203068Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17787","last_updated":"2024-11-26T15:13:15Z","snapshot_observed_at":"2026-08-16T17:43:59.643693Z","submitted_at":"2024-11-26T15:13:15Z","title":"Collaborative Decoding Makes Visual Auto-Regressive Modeling Efficient","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T12:06:01.203068Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2411.17787"},"observation_digest":"sha256:c7ecfc920c481245f52235765941e0cdcb166eb27201b5e11d228d7e676a741f","observation_id":"672a973f-3971-48f5-8845-8eee16213a04","resolution":{"observed_at":"2026-08-12T12:06:01.203068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-12T10:35:25.317720Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19108","last_updated":"2025-03-18T04:49:23Z","snapshot_observed_at":"2026-08-12T10:29:40.066151Z","submitted_at":"2024-11-28T12:50:05Z","title":"Timestep Embedding Tells: It's Time to Cache for Video Diffusion Model","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T10:35:25.317720Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2411.19108"},"observation_digest":"sha256:b9bdd7b127b9ef5cb479364448bb41fec9bbfbe18e2ebd8d9e15ad0bc6ba01c4","observation_id":"1f632e71-6d94-470b-b1bc-91110b680118","resolution":{"observed_at":"2026-08-12T10:35:25.317720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-12T04:40:19.618708Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01199","last_updated":"2024-12-02T07:05:39Z","snapshot_observed_at":"2026-08-17T18:54:15.379489Z","submitted_at":"2024-12-02T07:05:39Z","title":"TinyFusion: Diffusion Transformers Learned Shallow","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T04:40:19.618708Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2412.01199"},"observation_digest":"sha256:dfde6faa93c78b8cd743bce3735ba684d55068dc4166e855ac600177d2dd9061","observation_id":"75e8dcef-507e-4fe9-83d0-8d63de4a5069","resolution":{"observed_at":"2026-08-12T04:40:19.618708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-17T07:44:10.213698Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-05-23T07:41:58.617477Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2412.03603"},"observation_digest":"sha256:fa3cc342ee91d938fdb6b3532c2afc0344965c6ac6bebc968e07e8dcd5a29e21","observation_id":"b70e556b-5831-460d-97b5-4b46cd980b7c","resolution":{"observed_at":"2026-05-23T07:42:43.448393Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-11T14:44:17.681387Z","title":"Real-time video generation with pyramid attention broadcast","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11706","last_updated":"2025-05-24T17:39:32Z","snapshot_observed_at":"2026-08-15T13:09:10.090692Z","submitted_at":"2024-12-16T12:28:22Z","title":"AsymRnR: Video Diffusion Transformers Acceleration with Asymmetric Reduction and Restoration","version":3},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-11T14:44:17.681387Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2412.11706"},"observation_digest":"sha256:44a34e65fcd7a52707febde4f4f2ffd074c041f50654f36477a95242313b6dff","observation_id":"073c8912-cab0-4b02-b246-79031ed54629","resolution":{"observed_at":"2026-08-11T14:44:17.681387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-11T14:39:28.442561Z","title":"Real-time video generation with pyramid attention broadcast","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11767","last_updated":"2024-12-16T13:39:32Z","snapshot_observed_at":"2026-08-15T13:50:39.126462Z","submitted_at":"2024-12-16T13:39:32Z","title":"IDEA-Bench: How Far are Generative Models from Professional Designing?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T14:39:28.442561Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2412.11767"},"observation_digest":"sha256:84fd36cd795a7937381a0ced99f3e1a58915997e5a99d073ce4f50dfac5b25b2","observation_id":"5e7d53d8-7a6c-42d1-91c4-4c58c204d380","resolution":{"observed_at":"2026-08-11T14:39:28.442561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-09T20:53:59.507624Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19243","last_updated":"2025-07-18T01:49:36Z","snapshot_observed_at":"2026-08-17T19:28:49.853597Z","submitted_at":"2025-01-31T15:58:15Z","title":"Accelerating Diffusion Transformer via Error-Optimized Cache","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-09T20:53:59.507624Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2501.19243"},"observation_digest":"sha256:be9cc8f06fc54d057935f03f18ca01729c129fa2ab7593444c266174c4938478","observation_id":"b0844f17-2e4e-47b9-b686-c70c90f1498c","resolution":{"observed_at":"2026-08-09T20:53:59.507624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-09T14:35:10.694822Z","title":"Real-time video generation with pyramid attention broadcast, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-16T05:47:34.106216Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-09T14:35:10.694822Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2502.01776"},"observation_digest":"sha256:85cf5f8be433c057ac7a160b881eb2f70df768915533af366c2e29d03020336f","observation_id":"ab7559ef-dab5-4f84-a086-e5305e5ff3ba","resolution":{"observed_at":"2026-08-09T14:35:10.694822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-08T16:36:00.856578Z","title":"Real-time video generation with pyramid attention broadcast","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06155","last_updated":"2025-02-17T07:08:23Z","snapshot_observed_at":"2026-08-17T12:25:57.382548Z","submitted_at":"2025-02-10T05:00:56Z","title":"Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-08T16:36:00.856578Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2502.06155"},"observation_digest":"sha256:225148836d9f2750fa43c0695a8eb765214ed3564dfe2466698f7cba9f618bbf","observation_id":"66cc62c7-cdbc-4ebc-a43a-82c162f99ce3","resolution":{"observed_at":"2026-08-08T16:36:00.856578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-16T12:38:39.465001Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.12259","last_updated":"2025-04-16T17:09:13Z","snapshot_observed_at":"2026-08-16T12:31:46.037159Z","submitted_at":"2025-04-16T17:09:13Z","title":"VGDFR: Diffusion-based Video Generation with Dynamic Latent Frame Rate","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T12:38:39.465001Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2504.12259"},"observation_digest":"sha256:bb41079c3cc2e1c8a016c472a2083f8c8e3f16176012d4b202d30e97f02ce065","observation_id":"b35e6825-cabb-467f-9470-c2af8496806b","resolution":{"observed_at":"2026-08-16T12:38:39.465001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-15T21:35:46.800014Z","title":"Shangchen Zhou, Chongyi Li, Kelvin C.K Chan, and Chen Change Loy","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10584","last_updated":"2025-05-14T13:39:53Z","snapshot_observed_at":"2026-08-16T20:41:19.523433Z","submitted_at":"2025-05-14T13:39:53Z","title":"Aquarius: A Family of Industry-Level Video Generation Models for Marketing Scenarios","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T21:35:46.800014Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2505.10584"},"observation_digest":"sha256:ea4dd5d1c0d53504f1016aecb1210dbcaffdd50741cc333a02cc80e8f4b6abcd","observation_id":"4f66b2f5-b20b-4c08-9b75-e089b1d87516","resolution":{"observed_at":"2026-08-15T21:35:46.800014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-07T15:17:11.838283Z","title":"Real-time video generation with pyramid attention broadcast","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-11T13:17:41.186341Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:11.838283Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2505.15781"},"observation_digest":"sha256:878ac0fa4b6894c40633ac72e9f5c1f1c1b88cbfa93682c07ff6f8d59a9f9467","observation_id":"7bc723fc-7583-491e-bcb1-8fd552838521","resolution":{"observed_at":"2026-08-07T15:17:11.838283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-07T14:23:19.267997Z","title":"Real-time video generation with pyramid attention broadcast.arXiv preprint arXiv:2408.12588, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19151","last_updated":"2025-05-25T13:58:52Z","snapshot_observed_at":"2026-08-13T20:45:13.454382Z","submitted_at":"2025-05-25T13:58:52Z","title":"SRDiffusion: Accelerate Video Diffusion Inference via Sketching-Rendering Cooperation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:19.267997Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2505.19151"},"observation_digest":"sha256:eecf43e6fd81a9b36ff4fd6b45cb865075f4dcac85e996ab924144b76ba58f00","observation_id":"7657eb02-3f05-4b87-9b56-aa67632c1233","resolution":{"observed_at":"2026-08-07T14:23:19.267997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-07T14:16:20.706471Z","title":"Real-time video generation with pyramid attention broadcast.arXiv preprint arXiv:2408.12588, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.706471Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:c146576e926ef051e845200972818a2b6b90a6807709ff51479d0a360fca936e","observation_id":"30e5a746-e8e1-4266-af0e-8df43ff5936d","resolution":{"observed_at":"2026-08-07T14:16:20.706471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-07T11:15:18.510621Z","title":"Real-time video generation with pyramid attention broadcast.arXiv preprint arXiv:2408.12588, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03065","last_updated":"2025-06-03T16:42:37Z","snapshot_observed_at":"2026-08-17T07:34:53.340755Z","submitted_at":"2025-06-03T16:42:37Z","title":"Sparse-vDiT: Unleashing the Power of Sparse Attention to Accelerate Video Diffusion Transformers","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:15:18.510621Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2506.03065"},"observation_digest":"sha256:f8c4aebe30859f57cbd9d31f62cad08f9913348b5c3209569cf8fc8b909d95f1","observation_id":"7785b33f-34ad-4b07-b343-b05afabecfbd","resolution":{"observed_at":"2026-08-07T11:15:18.510621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-07T11:14:10.807899Z","title":"Real-time video generation with pyramid attention broad- cast.arXiv preprint arXiv:2408.12588, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03123","last_updated":"2025-08-06T03:03:38Z","snapshot_observed_at":"2026-08-17T03:45:27.435414Z","submitted_at":"2025-06-03T17:55:04Z","title":"Dual-Expert Consistency Model for Efficient and High-Quality Video Generation","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:10.807899Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2506.03123"},"observation_digest":"sha256:22d91862993ce1ca904b27de10f9f300ae2be76b325ca78ed5f516cdf70dd34f","observation_id":"a29a636d-498e-411d-97d0-6021e513c632","resolution":{"observed_at":"2026-08-07T11:14:10.807899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-15T20:05:06.557898Z","title":"Real-time video generation with pyramid attention broadcast.arXiv preprint arXiv:2408.12588, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-16T19:24:53.226264Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.557898Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:06fa0720c67b3d4adb5b69a2fba25456eec85369255d4d30e10592ae819a2f02","observation_id":"84245383-cba9-4a01-a43b-05d640fb7874","resolution":{"observed_at":"2026-08-15T20:05:06.557898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-06T19:01:33.101681Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06739","last_updated":"2025-07-09T10:53:05Z","snapshot_observed_at":"2026-08-12T09:17:27.867545Z","submitted_at":"2025-07-09T10:53:05Z","title":"PromptTea: Let Prompts Tell TeaCache the Optimal Threshold","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T19:01:33.101681Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2507.06739"},"observation_digest":"sha256:a0bc7f01813ae09a735bb6779a3ca44f39e0585eca2b76d422155744fbccbc5f","observation_id":"3980b98c-70c9-4aeb-8e45-b794432a471d","resolution":{"observed_at":"2026-08-06T19:01:33.101681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-06T17:05:45.031105Z","title":"Real-time video generation with pyramid attention broadcast","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11980","last_updated":"2025-07-16T07:23:14Z","snapshot_observed_at":"2026-08-17T13:21:54.796613Z","submitted_at":"2025-07-16T07:23:14Z","title":"EC-Diff: Fast and High-Quality Edge-Cloud Collaborative Inference for Diffusion Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:45.031105Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2507.11980"},"observation_digest":"sha256:ddf7b5d771ed981e33fd1ad74ff6d80b51db90db02b653cab6550b7ae2bc5aca","observation_id":"edd3f45b-cc1b-4de1-9d62-6b5636f36a25","resolution":{"observed_at":"2026-08-06T17:05:45.031105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-15T17:33:44.581158Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08978","last_updated":"2025-08-12T14:40:36Z","snapshot_observed_at":"2026-08-17T01:57:14.090873Z","submitted_at":"2025-08-12T14:40:36Z","title":"TaoCache: Structure-Maintained Video Generation Acceleration","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T17:33:44.581158Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2508.08978"},"observation_digest":"sha256:81f08cdc3cdd36a622560253986f8b67c89b5a88831bae3ff23d2bd4c3ed3b3d","observation_id":"8ef35527-f37a-4f1b-a32b-511092a18b0b","resolution":{"observed_at":"2026-08-15T17:33:44.581158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-05T17:31:13.099733Z","title":"arXiv preprint arXiv:2408.12588","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.16211","last_updated":"2025-08-22T08:34:03Z","snapshot_observed_at":"2026-08-17T04:26:24.384790Z","submitted_at":"2025-08-22T08:34:03Z","title":"Forecast then Calibrate: Feature Caching as ODE for Efficient Diffusion Transformers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T17:31:13.099733Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2508.16211"},"observation_digest":"sha256:4c7db7a87a347b596ced0f064471f5b2389480917833a245b463e1f2e3582feb","observation_id":"a1faab66-0305-46d0-a4c1-b0635b35f7ac","resolution":{"observed_at":"2026-08-05T17:31:13.099733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-05T17:42:59.655799Z","title":"Pab: Pyramid attention broadcast for real-time video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.16212","last_updated":"2025-08-25T03:07:02Z","snapshot_observed_at":"2026-08-16T13:58:24.756532Z","submitted_at":"2025-08-22T08:36:58Z","title":"OmniCache: A Trajectory-Oriented Global Perspective on Training-Free Cache Reuse for Diffusion Transformer Models","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-05T17:42:59.655799Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2508.16212"},"observation_digest":"sha256:f25cab32b787c9605f16e2fac94e81f395681d7f0ced5e170ea594b462694fd6","observation_id":"c388957f-a811-4dc3-b526-d985494b933b","resolution":{"observed_at":"2026-08-05T17:42:59.655799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-04T19:11:59.615094Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09748","last_updated":"2025-09-11T12:32:08Z","snapshot_observed_at":"2026-08-16T14:03:25.998004Z","submitted_at":"2025-09-11T12:32:08Z","title":"DiTReducio: A Training-Free Acceleration for DiT-Based TTS via Progressive Calibration","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-04T19:11:59.615094Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2509.09748"},"observation_digest":"sha256:165e6164f84d407bfaa3f88c4e8e3305f8fe87474a7708151f351b4b22b55bb7","observation_id":"4e0dc6b6-da1c-4072-aaba-7b008e3e1c19","resolution":{"observed_at":"2026-08-04T19:11:59.615094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-15T16:00:04.705327Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10312","last_updated":"2025-09-12T14:53:45Z","snapshot_observed_at":"2026-08-16T01:17:58.579534Z","submitted_at":"2025-09-12T14:53:45Z","title":"Compute Only 16 Tokens in One Timestep: Accelerating Diffusion Transformers with Cluster-Driven Feature Caching","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T16:00:04.705327Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2509.10312"},"observation_digest":"sha256:adca3e89b16446a197bc711c216e27490b7a4dc3536a385c36af1ee8c1df6fd7","observation_id":"8b8c803f-53b2-4c72-bd44-bc0f096d354a","resolution":{"observed_at":"2026-08-15T16:00:04.705327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2509.24527","last_updated":"2025-09-29T09:42:27Z","snapshot_observed_at":"2026-08-13T03:00:49.988137Z","submitted_at":"2025-09-29T09:42:27Z","title":"Training Agents Inside of Scalable World Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-15T02:05:52.431747Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2509.24527"},"observation_digest":"sha256:8f2aaf10104c0ed0449387820e0a5436d51dfadd411ef9640f34907875fccb2e","observation_id":"213073bc-1f5e-48e7-a2a7-c5985a481b39","resolution":{"observed_at":"2026-05-15T02:05:52.585310Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-03T22:12:45.658267Z","title":"Real-time video generation with pyramid attention broad- cast.arXiv preprint arXiv:2408.12588, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.12035","last_updated":"2026-07-21T06:26:07Z","snapshot_observed_at":"2026-08-15T03:11:37.451369Z","submitted_at":"2025-11-15T05:07:31Z","title":"Timeripple: Accelerating vDiTs by Understanding the Spatio-Temporal Correlations in Latent Space","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T22:12:45.658267Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2511.12035"},"observation_digest":"sha256:7685e006c00dfc9e1a61288d15069c6c7fa10e9c0e304b0080a5984ca74de2d0","observation_id":"eaecef53-ef6a-4cd7-b6e1-7c7510dedc9a","resolution":{"observed_at":"2026-08-03T22:12:45.658267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-03T10:35:06.656770Z","title":"Real-time video generation with pyramid at- tention broadcast.arXiv preprint arXiv:2408.12588, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.09881","last_updated":"2026-07-09T22:49:12Z","snapshot_observed_at":"2026-08-09T17:44:11.904091Z","submitted_at":"2026-01-14T21:30:03Z","title":"Transition Matching Distillation for Fast Video Generation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-03T10:35:06.656770Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2601.09881"},"observation_digest":"sha256:3fc7fda513b551ff7ddbf49402b9f150cff8eb78e88f34b18d5cff96b938140f","observation_id":"02255014-b988-4b05-a6a1-cc89ab91f82e","resolution":{"observed_at":"2026-08-03T10:35:06.656770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2602.05449","last_updated":"2026-04-20T12:18:51Z","snapshot_observed_at":"2026-08-14T07:12:47.116788Z","submitted_at":"2026-02-05T08:45:08Z","title":"DisCa: Accelerating Video Diffusion Transformers with Distillation-Compatible Learnable Feature Caching","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-16T07:28:08.873654Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2602.05449"},"observation_digest":"sha256:979a25983a555d5241c0ef2c63b5cc39322679f5eeada908526ec4d442334466","observation_id":"8b01f8fe-0205-4c2f-9326-9a82cef5fa74","resolution":{"observed_at":"2026-05-16T07:30:44.419653Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2604.02979","last_updated":"2026-08-08T11:11:40Z","snapshot_observed_at":"2026-08-14T15:11:50.657655Z","submitted_at":"2026-04-03T11:34:47Z","title":"Not All Frames Deserve Full Computation: Accelerating Autoregressive Video Generation via Selective Computation and Predictive Extrapolation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-13T20:43:39.554490Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2604.02979"},"observation_digest":"sha256:0fd787ea6e2e034e8ab8ddfb3957dededf1231dd254fd25cc6ed14c9519a435b","observation_id":"d78a80ee-8e15-4364-9189-f156b577fc84","resolution":{"observed_at":"2026-05-13T20:48:15.800455Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2604.15911","last_updated":"2026-04-17T10:11:39Z","snapshot_observed_at":"2026-08-11T06:56:48.614928Z","submitted_at":"2026-04-17T10:11:39Z","title":"Efficient Video Diffusion Models: Advancements and Challenges","version":1},"reference_index":195,"source":"pdf_text","source_observed_at":"2026-05-10T08:28:29.706249Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2604.15911"},"observation_digest":"sha256:f71f478a5226c88707f96036c3105ea49a1ab350ff53edf39573d8db5e16b24c","observation_id":"b0a3a65f-1623-4fba-8c91-6d93e22dcc3b","resolution":{"observed_at":"2026-05-10T09:03:26.198899Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2604.16492","last_updated":"2026-04-13T15:44:24Z","snapshot_observed_at":"2026-08-15T23:05:55.388568Z","submitted_at":"2026-04-13T15:44:24Z","title":"LayerCache: Exploiting Layer-wise Velocity Heterogeneity for Efficient Flow Matching Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:42.201352Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2604.16492"},"observation_digest":"sha256:0b28ff83e2d9d2600a421aa20e306ace41580eeb4a84623b18ffd31f1143feba","observation_id":"eb461fd8-b479-4d47-8b89-be873c7378a5","resolution":{"observed_at":"2026-05-11T10:56:05.102208Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2604.18348","last_updated":"2026-04-20T14:43:36Z","snapshot_observed_at":"2026-08-12T15:33:21.961041Z","submitted_at":"2026-04-20T14:43:36Z","title":"AdaCluster: Adaptive Query-Key Clustering for Sparse Attention in Video Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-10T05:09:46.155328Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2604.18348"},"observation_digest":"sha256:c2404f4b7df4fdd8fa42cea04b1ef2820e5e99181a2ce7fd2d9bb10d023d7a59","observation_id":"12344ac0-8d9f-4568-9f14-9af0a6bd1d70","resolution":{"observed_at":"2026-05-10T09:43:49.766913Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2604.20470","last_updated":"2026-04-22T11:56:29Z","snapshot_observed_at":"2026-08-14T22:50:30.122145Z","submitted_at":"2026-04-22T11:56:29Z","title":"DynamicRad: Content-Adaptive Sparse Attention for Long Video Diffusion","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-10T01:25:27.819753Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2604.20470"},"observation_digest":"sha256:425724377aa2c8dadeb29941c7b8e7677db8a1f3e19765eee208784c578557a5","observation_id":"1f827d4c-fafe-42bb-9bfa-b52346df6e5d","resolution":{"observed_at":"2026-05-11T13:36:07.894784Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2604.24447","last_updated":"2026-04-27T13:12:16Z","snapshot_observed_at":"2026-08-11T15:37:05.363567Z","submitted_at":"2026-04-27T13:12:16Z","title":"Characterizing Vision-Language-Action Models across XPUs: Constraints and Acceleration for On-Robot Deployment","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-08T03:04:46.460069Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2604.24447"},"observation_digest":"sha256:be992a7fc689d76d13fb8509eaa41e68ca0b576bcac8fd484dbc3989d6106b45","observation_id":"f83863ed-fd8f-49ce-b954-9ff1cc1234e8","resolution":{"observed_at":"2026-05-11T22:16:50.598532Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-08-16T23:20:27.163699Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T15:40:03.605239Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:d7a050218fb03d12ec7016c3c5a841ae058e2b93c31cb940d13269ad610dcaf1","observation_id":"e5fdcba2-958b-4d91-99d8-f9350e9dce32","resolution":{"observed_at":"2026-05-11T10:06:01.702813Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-08-16T23:20:27.163699Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:35451a6afaeb531d5b293bd70d27c3ca77ff324a8e1692dc2b74251dbfd11d41","observation_id":"4e019637-7fa0-41b1-8de5-06c55e604d95","resolution":{"observed_at":"2026-05-15T07:19:49.942745Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2605.22015","last_updated":"2026-05-21T05:23:21Z","snapshot_observed_at":"2026-08-15T01:27:45.858725Z","submitted_at":"2026-05-21T05:23:21Z","title":"ORBIS: Output-Guided Token Reduction with Distribution-Aware Matching for Video Diffusion Acceleration","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-22T07:21:16.861996Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2605.22015"},"observation_digest":"sha256:33da95217a18cef7cb4f0dc7e907d07dc413868ff38b49b36019cc658aca34a4","observation_id":"c6299bef-1d0e-44fc-b694-a5a54f283cb3","resolution":{"observed_at":"2026-05-22T07:24:43.387273Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2605.23381","last_updated":"2026-05-22T08:50:10Z","snapshot_observed_at":"2026-07-06T23:33:34.409634Z","submitted_at":"2026-05-22T08:50:10Z","title":"VDE: Training-Free Accelerating Rectified Flow Model via Velocity Decomposition and Estimation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-25T04:57:03.913813Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2605.23381"},"observation_digest":"sha256:48c9296f4018678e6e22b9a6ff7e4d482d1a27e12322e17f6ae95045c8b4dc11","observation_id":"6af77109-ee12-42cb-b6a4-fe3a47666843","resolution":{"observed_at":"2026-05-25T05:00:22.465253Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2605.27336","last_updated":"2026-05-26T17:43:25Z","snapshot_observed_at":"2026-08-12T09:27:59.655768Z","submitted_at":"2026-05-26T17:43:25Z","title":"PARE: Pruning and Adaptive Routing for Efficient Video Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-29T18:07:59.247022Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2605.27336"},"observation_digest":"sha256:0a8af485cb1032d296cdd5c91c93bd69eaccd9e3226c2bd11f29c1a190b5ea83","observation_id":"bbb4e3e7-53d3-4596-8fa5-d6c474d32df8","resolution":{"observed_at":"2026-06-29T18:13:48.832340Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2605.31158","last_updated":"2026-06-18T05:06:04Z","snapshot_observed_at":"2026-07-06T23:40:22.583302Z","submitted_at":"2026-05-29T11:06:03Z","title":"Light Interaction: Training-Free Inference Acceleration for Interactive Video World Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T22:43:32.749425Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2605.31158"},"observation_digest":"sha256:a8ba252adcc4a21a8b9da8bccb41d48426c86312e76025791853e5846a2d5d6b","observation_id":"c68db5b6-5e09-463e-89ce-b040355a21c6","resolution":{"observed_at":"2026-07-01T19:26:00.150469Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2606.02586","last_updated":"2026-05-11T16:42:10Z","snapshot_observed_at":"2026-08-05T10:31:48.098328Z","submitted_at":"2026-05-11T16:42:10Z","title":"Fewer, Better Frames: A Compute-Normalized Proof of Concept for Coherence-First World-Model Rendering with Model-Guided FSR4 Frame Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T22:23:32.586583Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2606.02586"},"observation_digest":"sha256:9d4373c24daa6f65058a5a41f930f7244e90b93ffae1ae0086bf9cfc345a0fb1","observation_id":"842281c1-60fc-4780-8e29-aba43cb49549","resolution":{"observed_at":"2026-06-30T22:25:06.902572Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2606.06309","last_updated":"2026-06-04T15:49:37Z","snapshot_observed_at":"2026-08-12T12:55:14.826506Z","submitted_at":"2026-06-04T15:49:37Z","title":"RhymeFlow: Training-Free Acceleration for Video Generation with Asynchronous Denoising Flow Scheduling","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-28T02:08:44.257127Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2606.06309"},"observation_digest":"sha256:71712b669df5c72133458a51ad11d54765f47e2b35d0e59e94ec67287a74a452","observation_id":"cac81f9f-2acf-4e1a-9bf3-2a3ee63dd643","resolution":{"observed_at":"2026-07-02T12:26:56.756036Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2606.23743","last_updated":"2026-06-24T14:59:15Z","snapshot_observed_at":"2026-08-15T08:01:53.312756Z","submitted_at":"2026-06-21T17:23:20Z","title":"Sol Video Inference Engine: Agent-Native Full-Stack Acceleration Framework for Efficient Video Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T11:05:44.972128Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2606.23743"},"observation_digest":"sha256:ddc76fa9e4fc7a1c990dd2e1bffebbc3eeea3e67a08a6616d6a0fa0681a2804b","observation_id":"9d7d5444-7977-45f9-b025-9ba02baa1513","resolution":{"observed_at":"2026-07-04T08:49:41.580040Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2606.31026","last_updated":"2026-06-30T01:46:54Z","snapshot_observed_at":"2026-08-12T12:47:06.701026Z","submitted_at":"2026-06-30T01:46:54Z","title":"OTCache: Optimal Transport for Geometry-Aware Caching in Diffusion Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-01T06:21:22.905093Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2606.31026"},"observation_digest":"sha256:6f0f411969a160f614cf6c97f10585579190b199edd42e0b026fcc1ce22b2ba3","observation_id":"006a01c5-e1d3-44b8-b593-fc918bc26bab","resolution":{"observed_at":"2026-07-01T09:45:39.499644Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-02T06:40:17.660809Z","title":"Real-time video generation with pyramid attention broadcast.arXiv preprint arXiv:2408.12588, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12358","last_updated":"2026-07-16T04:34:12Z","snapshot_observed_at":"2026-08-17T22:13:41.170664Z","submitted_at":"2026-07-14T05:17:24Z","title":"ACID: Adaptive Caching for vIDeo generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T06:40:17.660809Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2607.12358"},"observation_digest":"sha256:7fc06c7864498c5bb1224a3b89b60fe3fb9ac116c83ac228f405f5520693fdd8","observation_id":"01887001-f51b-4e49-9ffa-6418cc2abb74","resolution":{"observed_at":"2026-08-02T06:40:17.660809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-02T03:51:53.756730Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13770","last_updated":"2026-07-15T12:31:19Z","snapshot_observed_at":"2026-08-17T11:15:02.457531Z","submitted_at":"2026-07-15T12:31:19Z","title":"Kaleido: Algorithm-Hardware Co-Design for Video Diffusion Transformers by Exploiting Latent Space Correlations","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-02T03:51:53.756730Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2607.13770"},"observation_digest":"sha256:c03b374ad5c8e76f2ea9bd858add80df96f7b2a0ea07a068b3d69b5a528732ec","observation_id":"ad384f00-2226-461c-99bf-5e69ebc8d22a","resolution":{"observed_at":"2026-08-02T03:51:53.756730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-01T22:45:29.268782Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-16T19:49:27.263506Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:29.268782Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:657296af0d8166e07f0626b148742c72a9b28e6fb0033402276e63cf57da1163","observation_id":"2dafe89c-a4cc-4487-9aa1-3e3919d928b3","resolution":{"observed_at":"2026-08-01T22:45:29.268782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-01T17:41:03.776113Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17572","last_updated":"2026-07-25T08:59:31Z","snapshot_observed_at":"2026-08-16T00:54:17.207217Z","submitted_at":"2026-07-20T05:30:40Z","title":"JAGG: Jacobian-Aggregated Group Gradient for Efficient GRPO Training of Diffusion Models","version":3},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-01T17:41:03.776113Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2607.17572"},"observation_digest":"sha256:4839b87703699ebd53cc4892ca102a9d2ccf955cc5669de9089ddf27ba38875f","observation_id":"64fb3c06-070c-44dc-bdec-10ebe130ec50","resolution":{"observed_at":"2026-08-01T17:41:03.776113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-01T10:59:55.303447Z","title":"Real-time video generation with pyramid attention broadcast,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20048","last_updated":"2026-07-22T11:42:42Z","snapshot_observed_at":"2026-08-05T09:15:47.648858Z","submitted_at":"2026-07-22T11:42:42Z","title":"Importance-Aware OBS Pruning for Diffusion Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-01T10:59:55.303447Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2607.20048"},"observation_digest":"sha256:57c8acf5848c908f11702195007cec6135bc47ccb35efb2e8807050ce12138cd","observation_id":"03d1f7ac-5ffe-4123-aad8-7aaf29ac69ac","resolution":{"observed_at":"2026-08-01T10:59:55.303447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-01T03:30:26.623742Z","title":"Real-time video generation with pyramid attention broadcast","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23159","last_updated":"2026-07-30T17:05:25Z","snapshot_observed_at":"2026-08-17T17:26:10.662682Z","submitted_at":"2026-07-25T11:30:59Z","title":"CachedSearch: Training-Free Cached Exploration for Test-Time Search in Video Diffusion","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T03:30:26.623742Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2607.23159"},"observation_digest":"sha256:008d082e3278eda7fb0eeef2022db2834bc2b9f9a097933a1436cff530fb59bb","observation_id":"4e2b6289-1421-4c2c-9b1b-867bc50fb1c8","resolution":{"observed_at":"2026-08-01T03:30:26.623742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-30T10:48:16.511850Z","title":"Real-time video generation with pyramid attention broadcast, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23844","last_updated":"2026-07-26T21:14:48Z","snapshot_observed_at":"2026-08-17T04:38:38.580253Z","submitted_at":"2026-07-26T21:14:48Z","title":"OmniCache: Multidimensional Hierarchical Feature Caching For Diffusion Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-30T10:48:16.511850Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2607.23844"},"observation_digest":"sha256:28d1020066bf2e52de8e229fde2f48324737039ad0c137e4588a385642d73e45","observation_id":"d7c537c2-74be-4508-8119-22a9dbd5111e","resolution":{"observed_at":"2026-07-30T10:48:16.511850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-31T16:32:51.924964Z","title":"Real-time video generation with pyramid attention broadcast,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24377","last_updated":"2026-07-27T12:53:22Z","snapshot_observed_at":"2026-08-13T16:58:15.773596Z","submitted_at":"2026-07-27T12:53:22Z","title":"MXAttention: Data-Free Optimal Scaling and Pre-Normalization Quantization for MXFP4 Attention","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-31T16:32:51.924964Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2607.24377"},"observation_digest":"sha256:f360325b3ed53fa52d780a948a8ea0a05527a10d960fa3e1df8eae37b5ba53aa","observation_id":"3458ba6d-8838-4a3d-b5e5-9e1b77ccafd6","resolution":{"observed_at":"2026-07-31T16:32:51.924964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-04T06:45:50.046478Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02474","last_updated":"2026-08-12T03:12:13Z","snapshot_observed_at":"2026-08-15T23:09:36.449539Z","submitted_at":"2026-08-03T16:42:54Z","title":"EchoCache: Energy-Guided Cross-Modal Caching for Efficient Audio-Driven Video Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T06:45:50.046478Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2608.02474"},"observation_digest":"sha256:2ca92a8d4f1c0c78b97d8fbf9f4a94380071e9e2d67ae26b34279c1d9cc1bb61","observation_id":"48a79f2f-3cef-4e21-8e90-78734aad181c","resolution":{"observed_at":"2026-08-04T06:45:50.046478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-04T06:03:07.410471Z","title":"arXiv preprint arXiv:2408.12588 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02504","last_updated":"2026-08-03T17:05:15Z","snapshot_observed_at":"2026-08-15T09:04:12.226421Z","submitted_at":"2026-08-03T17:05:15Z","title":"Token Radius Attention for Efficient Video Generation","version":1},"reference_index":108,"source":"arxiv_source","source_observed_at":"2026-08-04T06:03:07.410471Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2608.02504"},"observation_digest":"sha256:68c28f7093bd7c446427357142f38632367a1b920e5ae378f4e1537407bd1aee","observation_id":"fce78ba5-26da-44d5-a3a7-ff24274c5ae2","resolution":{"observed_at":"2026-08-04T06:03:07.410471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-15T14:46:04.362474Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04428","last_updated":"2026-08-05T04:17:03Z","snapshot_observed_at":"2026-08-16T01:42:08.131327Z","submitted_at":"2026-08-05T04:17:03Z","title":"Deltoris: Enabling Real-time VLA Inference in Embodied AI via Bit-level Sparsity and Speculative Inference","version":1},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-08-15T14:46:04.362474Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2608.04428"},"observation_digest":"sha256:e690985ca31eb8b9aa437dbc31a304b53ed21767011c82f6958ecdcfe85ba11a","observation_id":"335452dc-9705-4d37-9bf0-6bf1cf147e36","resolution":{"observed_at":"2026-08-15T14:46:04.362474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-11T00:40:50.022316Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07572","last_updated":"2026-08-04T11:24:53Z","snapshot_observed_at":"2026-08-14T01:58:25.699315Z","submitted_at":"2026-08-04T11:24:53Z","title":"BRACE: Taming Sharp Irregularities via Barycentric Rational Forecasting for Fast Diffusion Transformers Inference","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T00:40:50.022316Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2608.07572"},"observation_digest":"sha256:dd578879b661c20484945c19ade143eeb2731cdca48ea2508873880b89f96108","observation_id":"a37a188b-8371-436b-a28c-e209c62bb7b9","resolution":{"observed_at":"2026-08-11T00:40:50.022316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2408.12588/citation-record","integrity":"/paper/2408.12588/integrity","json":"/paper/2408.12588/citation-record.json","paper":"/paper/2408.12588"},"outbound":[],"paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 61 inbound Pith citation observations for arXiv:2408.12588."}