{"as_of":"2026-08-05T19:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fdd81b8d4b0a493354f702883465b5d7f5d875f09d8c803fa89206c5f915dc53","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T06:10:41.082951Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T03:30:23.764753Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.17397","snapshot_observed_at":"2026-08-01T03:30:23.764753Z","title":"Speculative decoding for autoregressive video generation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23159","last_updated":"2026-07-30T17:05:25Z","snapshot_observed_at":"2026-08-03T00:00:18.111734Z","submitted_at":"2026-07-25T11:30:59Z","title":"CachedSearch: Training-Free Cached Exploration for Test-Time Search in Video Diffusion","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T03:30:23.764753Z"},"links":{"cited_paper":"/paper/2604.17397","citing_paper":"/paper/2607.23159"},"observation_digest":"sha256:fdc7599bc8eab5b474b1b6937665530b21be860d6189325ae33126caaaa303dc","observation_id":"badbe333-5422-43ef-a764-19e33f611c45","resolution":{"observed_at":"2026-08-01T03:30:23.764753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.17397/citation-record","integrity":"/paper/2604.17397/integrity","json":"/paper/2604.17397/citation-record.json","paper":"/paper/2604.17397"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Brooks, B","venue":null,"work_id":"b97f74d9-a4e7-4f3c-8921-48453742d0c0","year":2024},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:2884e4bfa0b8a8d5b92046e51f74fae19e655d0d9fa09b53b4d82343ecf1e7cd","observation_id":"478bb72a-e9fe-4ac2-b123-aba71b078b2e","resolution":{"observed_at":"2026-05-21T17:30:26.654142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":"2302.01318","doi":"10.48550/arxiv.2302.01318","metadata_source":"pith","pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","venue":"cs.CL","work_id":"b53b11e5-8613-439d-9d9d-0e2a9090d79f","year":2023},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:ebc7d998c16d72be73413b455042a9be2c269e12497dab9284dbd4db43699be3","observation_id":"792560f3-5146-4b47-8fac-a01838f320fa","resolution":{"observed_at":"2026-05-11T07:29:36.391032Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19151","last_updated":"2025-05-25T13:58:52Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T13:58:52Z","title":"SRDiffusion: Accelerate Video Diffusion Inference via Sketching-Rendering Cooperation","version":1},"cited_work":{"arxiv_id":"2505.19151","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19151","snapshot_observed_at":"2026-06-30T07:14:22.098727Z","title":"Srdiffusion: Accelerate video diffu- sion inference via sketching-rendering cooperation","venue":null,"work_id":"0c9f6c32-40e9-403f-9dcc-71d7568f16e9","year":2025},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"cited_paper":"/paper/2505.19151","citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:6f18d3f4969dcb615497596b8b383c68fa36bdc1dcc36d3562bec0728f284f20","observation_id":"c059232e-c269-4869-92ae-151f26ba830d","resolution":{"observed_at":"2026-05-10T06:11:20.048799Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d7426a50-7ba4-4e56-bf48-a17b71f5f4d4","year":null},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:e23bd7bdf32c83454fd952b899bafed9ad66a3c1c49b8e3cc0ad5355e875c393","observation_id":"06fa8bd9-b7e4-4923-869b-fdbcbd52b9b5","resolution":{"observed_at":"2026-05-21T17:30:26.644821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03458","last_updated":"2022-06-22T20:22:29Z","snapshot_observed_at":"2026-07-06T12:57:51.108636Z","submitted_at":"2022-04-07T14:08:02Z","title":"Video Diffusion Models","version":2},"cited_work":{"arxiv_id":"2204.03458","doi":"10.48550/arxiv.2204.03458","metadata_source":"pith","pith_arxiv_id":"2204.03458","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Video Diffusion Models","venue":"cs.CV","work_id":"02e03469-549e-4b5a-9bf0-ac6617a89882","year":2022},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"cited_paper":"/paper/2204.03458","citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:72dc1330431edcebb65bcffc12747b0fc66a4b5adddc948936a69803a512764a","observation_id":"1a06eec3-5bca-4643-8e4b-293750cae8fe","resolution":{"observed_at":"2026-05-13T14:38:28.190773Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:e8b16c69d5bdffe24439d05c6d39bb07f1363e9c4c2423b1e198fa1a8198018c","observation_id":"f1aae549-6382-4a31-8eec-c09459df0f6f","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.17192","last_updated":"2023-05-18T20:28:20Z","snapshot_observed_at":"2026-07-06T14:25:12.946406Z","submitted_at":"2022-11-30T17:33:28Z","title":"Fast Inference from Transformers via Speculative Decoding","version":2},"cited_work":{"arxiv_id":"2211.17192","doi":"10.48550/arxiv.2211.17192","metadata_source":"pith","pith_arxiv_id":"2211.17192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fast Inference from Transformers via Speculative Decoding","venue":"cs.LG","work_id":"a17596db-fb15-4793-9ce6-fc620a92ae36","year":2022},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"cited_paper":"/paper/2211.17192","citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:c3d1bd10b9fda01956996de104d2961c1d7f0585f81823698b0c4492046b4b5b","observation_id":"208c2013-59ac-4c8b-b894-feb3ebd9339f","resolution":{"observed_at":"2026-05-17T22:52:00.384886Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fb9c149a-e92c-4ef3-99df-050e59f55aa8","year":2025},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:0064f391b84740757f27136f3feabc065a4bc7b38e1f1d49386a707e788ffe28","observation_id":"e89d319a-d603-4ead-8391-be5acff2599a","resolution":{"observed_at":"2026-05-21T17:30:26.657312Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"25143e15-d4aa-4a95-917a-7a002720026b","year":2025},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:105d7674d8d7f7a5b150994d31679de69c6a11efa26dd0e7f9c2900ea3c9c5a3","observation_id":"3eb0117d-c18f-4ad2-a9f4-1d12eff3b2d2","resolution":{"observed_at":"2026-05-21T17:30:26.668856Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14167","last_updated":"2024-02-21T23:08:54Z","snapshot_observed_at":"2026-07-06T17:33:41.634820Z","submitted_at":"2024-02-21T23:08:54Z","title":"T-Stitch: Accelerating Sampling in Pre-Trained Diffusion Models with Trajectory Stitching","version":1},"cited_work":{"arxiv_id":"2402.14167","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.14167","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"T-stitch: Accelerating sampling in pre-trained diffusion models with trajectory stitching","venue":null,"work_id":"b1157f38-e293-4261-ba51-56337cab6f89","year":2024},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"cited_paper":"/paper/2402.14167","citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:004f825329c7c9c61cbd0421888f425bb3344cdd95f117b7b99f2ece2e47b12f","observation_id":"21f07ef5-3a67-472e-8701-3b25f48d0001","resolution":{"observed_at":"2026-05-10T06:11:20.077686Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":"2410.13720","doi":"10.48550/arxiv.2410.13720","metadata_source":"pith","pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Movie Gen: A Cast of Media Foundation Models","venue":"cs.CV","work_id":"a6a118b0-002f-4b19-881f-7f1183e0d7d8","year":2024},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:9eda32f0def808eb686683ea54ed43a8e8d942d415109d84a1bfab80f2f09720","observation_id":"6cc3fac6-2899-4610-958e-8d0a1b755192","resolution":{"observed_at":"2026-05-11T14:16:26.778393Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.07815","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"675e4dde-83df-4ed7-8b3b-57ff397669c9","year":2026},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:3e24f381827381f5757bb163363e2d9c81a36cba3086f7726804c555a4951e5c","observation_id":"ec89cbb3-b0b9-43b3-a7d6-00609b4142ed","resolution":{"observed_at":"2026-05-10T06:11:20.072881Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:80a15ae8022aa6c141c9f118b2d7b5648bc0c9927dcbf4ccb7d210a5f0e936dd","observation_id":"09e46870-e98e-4d63-8f95-0f5514a498ab","resolution":{"observed_at":"2026-05-10T06:11:20.060637Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"204da93e-b75a-4028-94d7-124fe83986af","year":2024},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:f55db5bfe943dab5d3e9a54fc92c7c7a765fb88450b4f0d595d200819515b017","observation_id":"fbd16d73-4e96-44d3-bad8-9a799340202d","resolution":{"observed_at":"2026-05-21T17:30:26.663214Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d062d420-3f8c-49ad-9da1-0188efbab327","year":2025},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:9b58280f50498ce24fdf99932a7e8ecf6c2a29682202e2e31fd342a7dc19e58b","observation_id":"f15d1fb8-7383-48bc-9d61-c98bfafbf62a","resolution":{"observed_at":"2026-05-21T17:30:26.660137Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05977","last_updated":"2023-12-28T14:13:35Z","snapshot_observed_at":"2026-07-06T15:14:55.628493Z","submitted_at":"2023-04-12T16:58:13Z","title":"ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2304.05977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05977","snapshot_observed_at":"2026-07-04T08:59:43.031755Z","title":"(page 13)","venue":null,"work_id":"578102d7-413d-4e1e-b8a7-a532ef75f1a6","year":2023},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"cited_paper":"/paper/2304.05977","citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:dce8208956d3bd65a39f9ca2076d70fcac1d22619075455cbcec2dbae348b3d1","observation_id":"1abba70d-0279-4911-8d03-f199056eeed9","resolution":{"observed_at":"2026-05-10T06:11:20.043771Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21059","last_updated":"2026-01-05T02:39:01Z","snapshot_observed_at":"2026-08-03T02:30:08.318253Z","submitted_at":"2024-12-30T16:24:09Z","title":"VisionReward: Fine-Grained Multi-Dimensional Human Preference Learning for Image and Video Generation","version":4},"cited_work":{"arxiv_id":"2412.21059","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.21059","snapshot_observed_at":"2026-07-03T00:07:27.977777Z","title":"VisionReward: Fine-Grained Multi-Dimensional Human Preference Learning for Image and Video Generation","venue":"cs.CV","work_id":"63f252a7-e52d-4e87-b849-d1375bee5b37","year":2024},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"cited_paper":"/paper/2412.21059","citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:d57c3b796663eb9c2fe6040d2c52e7d0730aa1a99f7f1b4810e12180d3445415","observation_id":"8af6f9a5-bb05-4960-bfb8-1b40c861cfa8","resolution":{"observed_at":"2026-05-16T11:49:14.981353Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"62f613a1-0da9-43df-a41a-15d2103c344e","year":2024},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:ad7e422314306e3cb434fd94379449e38de9c6ae7dac95bd39967947d8c646e0","observation_id":"a4271437-f2f5-450a-8e4f-d5ca73060b7e","resolution":{"observed_at":"2026-05-21T17:30:26.627952Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zhang, H","venue":null,"work_id":"c74cd4cf-30f8-4363-b380-dd835b4ee684","year":2025},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:088359641e339079eebaff6fa3b1407e8881c9c4a2f97997c28d665fd5463b9e","observation_id":"12a001e6-4251-41e6-b019-ed9847488ecf","resolution":{"observed_at":"2026-05-21T17:30:26.647824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.24006","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T01:07:44.716756Z","title":"Gonzalez, Jun Zhu, and Jianfei Chen","venue":null,"work_id":"1e0775fb-c356-4c8a-89b3-aa194ebc07f7","year":2025},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:4f95e3965b6b45a639224a9ae928ea9947418a7c14c4192ac7b4b6edcf6c2890","observation_id":"c0565917-a61a-48c7-b6a4-b4e91a80f821","resolution":{"observed_at":"2026-05-10T06:11:20.053420Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.11594","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T08:49:41.560255Z","title":"Sageattention3: Microscaling FP4 attention for inference and an exploration of 8-bit training","venue":null,"work_id":"3d422053-251f-482d-b243-6e1f979556bd","year":2025},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:6e131cfc56bdb4e4657e9e0b16e446335a5737da8e09b7cbf690e7f4eefc3b1b","observation_id":"c4c4cc25-e0af-440b-a521-a8945f378795","resolution":{"observed_at":"2026-05-10T06:11:20.063221Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zhang, J","venue":null,"work_id":"85a1d726-82a8-4393-a5bf-8100ceb4a11a","year":2025},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:03431e4b74f72763cf13d05f1012953dbb07fa001896d7cb38e06955b19b5f2f","observation_id":"27871593-01f5-4a20-b27a-21e3492696e9","resolution":{"observed_at":"2026-05-21T17:30:26.650851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zhang, C","venue":null,"work_id":"820f63cf-152a-47a6-9db1-5d6735b5ac30","year":2025},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:d4266d0273744c986984f1b4fa115952c69300417532f7c1389551d184569a13","observation_id":"c913daac-a01c-40a0-8e34-d2219d313bed","resolution":{"observed_at":"2026-05-21T17:30:26.666309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-03T20:53:26.614738Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"cited_work":{"arxiv_id":"2505.21136","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21136","snapshot_observed_at":"2026-07-02T05:56:40.575048Z","title":"Sageattention2++: A more efficient implementation of sageattention2","venue":null,"work_id":"af6e3a5a-6c80-47f3-a491-7eddd05d31fd","year":2025},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"cited_paper":"/paper/2505.21136","citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:132112e8b83d367316f6af3e87e8525c4fa9dcd505b7733f37796a85533ee769","observation_id":"6e6122e8-db79-4e63-ae4a-0de51bacf2b4","resolution":{"observed_at":"2026-05-10T06:11:20.055714Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.16093","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T01:07:44.853896Z","title":"Turbodiffusion: Accelerating video diffusion models by 100-200 times","venue":null,"work_id":"1be14f87-80de-4b7e-8037-b02a236b845e","year":2025},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:d188c472c6805274513a1dc62cac366f1e71cc6ba867702fdff48ab310ff91d6","observation_id":"a33454f3-038e-480a-b3ca-7a2d523af162","resolution":{"observed_at":"2026-05-10T06:11:20.065465Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":15,"verified_fuzzy":4},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 1 inbound Pith citation observation for arXiv:2604.17397."}