{"as_of":"2026-08-10T02:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c1a4f4bd4b9339c38592e4a9b96cfd44fcd556531d1a5de3ea1195ebedb151d3","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:22:19.245131Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:57:21.407355Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T09:45:40.325116Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22167","snapshot_observed_at":"2026-08-06T19:57:21.407355Z","title":"Q-vdit: Towards accurate quantization and distillation of video-generation diffusion transformers,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04290","last_updated":"2025-07-06T08:16:50Z","snapshot_observed_at":"2026-08-08T08:13:06.170937Z","submitted_at":"2025-07-06T08:16:50Z","title":"MPQ-DMv2: Flexible Residual Mixed Precision Quantization for Low-Bit Diffusion Models with Temporal Distillation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:21.407355Z"},"links":{"cited_paper":"/paper/2505.22167","citing_paper":"/paper/2507.04290"},"observation_digest":"sha256:6fa11b69a9fb8fa9b7730a436178ccde5ce1bb4d912556d6ef67bd0ec8a05b2b","observation_id":"86e26931-433c-4b03-9323-d7a8c20173eb","resolution":{"observed_at":"2026-08-06T19:57:21.407355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22167","snapshot_observed_at":"2026-08-05T15:32:34.035597Z","title":"arXiv preprint arXiv:2505.22167 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02581","last_updated":"2026-06-18T10:35:57Z","snapshot_observed_at":"2026-08-06T21:17:50.512643Z","submitted_at":"2025-08-27T09:46:50Z","title":"Charting the Future of Scholarly Knowledge with AI: A Community Perspective","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T15:32:34.035597Z"},"links":{"cited_paper":"/paper/2505.22167","citing_paper":"/paper/2509.02581"},"observation_digest":"sha256:6e79222bef52b215aa2ae6c0f4352877a1ca3d011051d9af4ef6641351a7e359","observation_id":"70c3ba28-5907-4e58-81f2-9d6de20f1b70","resolution":{"observed_at":"2026-08-05T15:32:34.035597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.22167","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22167","snapshot_observed_at":"2026-07-01T09:45:40.325116Z","title":"Q-vdit: Towards accurate quantization and distillation of video-generation diffusion transformers","venue":null,"work_id":"50b11121-a334-439d-bea9-d77d57d0861f","year":2025},"citing_paper":{"arxiv_id":"2604.15911","last_updated":"2026-04-17T10:11:39Z","snapshot_observed_at":"2026-07-06T23:03:21.422544Z","submitted_at":"2026-04-17T10:11:39Z","title":"Efficient Video Diffusion Models: Advancements and Challenges","version":1},"reference_index":268,"source":"pdf_text","source_observed_at":"2026-05-10T08:28:29.706249Z"},"links":{"cited_paper":"/paper/2505.22167","citing_paper":"/paper/2604.15911"},"observation_digest":"sha256:074c7266c907df82292a371304c04a57684873b77b65fb063dbf147dc05394ad","observation_id":"339c94ae-8a93-4a77-bc8f-8a0a3936726e","resolution":{"observed_at":"2026-05-10T09:03:26.011053Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.22167","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22167","snapshot_observed_at":"2026-07-01T09:45:40.325116Z","title":"Q-vdit: Towards accurate quantization and distillation of video-generation diffusion transformers","venue":null,"work_id":"50b11121-a334-439d-bea9-d77d57d0861f","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T15:40:03.605239Z"},"links":{"cited_paper":"/paper/2505.22167","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:5781c6534400324ff5e88ad442a2fc2dbd39c798c38196421c763c9a08ba51a4","observation_id":"e50a9651-5348-45c8-8bf9-5e9b24e45328","resolution":{"observed_at":"2026-05-11T10:06:01.664270Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.22167","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22167","snapshot_observed_at":"2026-07-01T09:45:40.325116Z","title":"Q-vdit: Towards accurate quantization and distillation of video-generation diffusion transformers","venue":null,"work_id":"50b11121-a334-439d-bea9-d77d57d0861f","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2505.22167","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:e295983e64c290a347c32985827300b62c2b50f00da99ce80fd9e79bde25ae22","observation_id":"c2f1e0ec-12c9-459a-ac92-6bb3a2cbdbc5","resolution":{"observed_at":"2026-05-15T07:19:49.953112Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.22167","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22167","snapshot_observed_at":"2026-07-01T09:45:40.325116Z","title":"Q-vdit: Towards accurate quantization and distillation of video-generation diffusion transformers","venue":null,"work_id":"50b11121-a334-439d-bea9-d77d57d0861f","year":2025},"citing_paper":{"arxiv_id":"2605.12431","last_updated":"2026-05-12T17:27:56Z","snapshot_observed_at":"2026-08-06T07:19:18.552294Z","submitted_at":"2026-05-12T17:27:56Z","title":"GaitProtector: Impersonation-Driven Gait De-Identification via Training-Free Diffusion Latent Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T06:38:08.198271Z"},"links":{"cited_paper":"/paper/2505.22167","citing_paper":"/paper/2605.12431"},"observation_digest":"sha256:9cc90bd53b62e54ee471bae262cf65bb2557f279633f3ac750ae8e45fcce51f6","observation_id":"96c9f718-ccb3-4199-a61b-182df46185dc","resolution":{"observed_at":"2026-05-13T06:42:26.399267Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.22167","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22167","snapshot_observed_at":"2026-07-01T09:45:40.325116Z","title":"Q-vdit: Towards accurate quantization and distillation of video-generation diffusion transformers","venue":null,"work_id":"50b11121-a334-439d-bea9-d77d57d0861f","year":2025},"citing_paper":{"arxiv_id":"2605.16003","last_updated":"2026-05-15T14:33:09Z","snapshot_observed_at":"2026-07-06T23:27:15.745896Z","submitted_at":"2026-05-15T14:33:09Z","title":"Echo-Forcing: A Scene Memory Framework for Interactive Long Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T20:02:45.505404Z"},"links":{"cited_paper":"/paper/2505.22167","citing_paper":"/paper/2605.16003"},"observation_digest":"sha256:77c6e904ed9d3de2442decb71fc73a48f8731b3d7f58af7a381c0bbd13468b83","observation_id":"2a6325cd-d752-4a01-9ac2-00aa73dbf8bd","resolution":{"observed_at":"2026-05-20T20:03:43.577064Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.22167","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22167","snapshot_observed_at":"2026-07-01T09:45:40.325116Z","title":"Q-vdit: Towards accurate quantization and distillation of video-generation diffusion transformers","venue":null,"work_id":"50b11121-a334-439d-bea9-d77d57d0861f","year":2025},"citing_paper":{"arxiv_id":"2606.30849","last_updated":"2026-06-29T19:26:13Z","snapshot_observed_at":"2026-08-02T00:44:38.626792Z","submitted_at":"2026-06-29T19:26:13Z","title":"SyncCache: Exploiting Asymmetric Dynamics for Fast Audio-Driven Portrait Animation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-01T06:13:11.504526Z"},"links":{"cited_paper":"/paper/2505.22167","citing_paper":"/paper/2606.30849"},"observation_digest":"sha256:54cd066d0c2d45e7d5198badd3af2ab6b595b6730e0ba4ce9ab02fc9a7c3f140","observation_id":"d33759d6-44da-41f4-aa79-f6fde75df3c1","resolution":{"observed_at":"2026-07-01T09:45:40.326505Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.22167/citation-record","integrity":"/paper/2505.22167/integrity","json":"/paper/2505.22167/citation-record.json","paper":"/paper/2505.22167"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.00456","last_updated":"2024-10-29T11:09:12Z","snapshot_observed_at":"2026-08-09T17:23:32.399243Z","submitted_at":"2024-03-30T19:20:06Z","title":"QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00456","snapshot_observed_at":"2026-08-07T13:22:14.388940Z","title":"L., Li, B., Cameron, P., Jaggi, M., Alistarh, D., Hoefler, T., and Hensman, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:14.388940Z"},"links":{"cited_paper":"/paper/2404.00456","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:d0865da3d188b2367285b3c2596e6fe1983b4ab0990c224c21dd4611664262de","observation_id":"42d44208-69e9-4fcc-9441-8c13ebb60427","resolution":{"observed_at":"2026-08-07T13:22:14.388940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:24.475315Z","title":"Flux.1, 2024","venue":null,"work_id":"4c56cada-a887-4084-87b0-508caf0c52c9","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:14.478875Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:00298659f01007c2007acd652b6d21d94fe3dcc8d11de97740d6de56fe0f012b","observation_id":"40c4f2ad-234e-4d18-8350-a871dd7ea002","resolution":{"observed_at":"2026-08-07T13:22:24.533266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:24.270201Z","title":"W., Fidler, S., and Kreis, K","venue":null,"work_id":"85c377f7-8436-4d3e-9522-7f270ef67030","year":2023},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:14.595248Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:b52d73757ffa49a574ad9ba535903602a5e35be91a1d44167379402ec2845977","observation_id":"225abec8-677d-4cbd-9e17-2370230b5db9","resolution":{"observed_at":"2026-08-07T13:22:24.371012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17343","last_updated":"2024-11-19T09:58:07Z","snapshot_observed_at":"2026-07-06T18:36:34.369503Z","submitted_at":"2024-06-25T07:57:27Z","title":"Q-DiT: Accurate Post-Training Quantization for Diffusion Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17343","snapshot_observed_at":"2026-08-07T13:22:14.679938Z","title":"Q-dit: Accurate post-training quantization for diffusion transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:14.679938Z"},"links":{"cited_paper":"/paper/2406.17343","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:53a670f73bed41720327101f0eb052f4736c5344a352b6d2ad1d080eb23cb2f5","observation_id":"90373be9-13dd-4fbe-aeaf-99e779030ca8","resolution":{"observed_at":"2026-08-07T13:22:14.679938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:24.122383Z","title":"T., Mittal, S., Emani, M., Vishwanath, V., and Somani, A","venue":null,"work_id":"e8b23dbe-3ca7-418f-9d09-79c61cbfe31f","year":2023},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:14.773041Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:567398d66320ce052aa207840b906d6884887ef81e98f74e35d7e5769743f5ba","observation_id":"99e10386-786a-42a3-bc20-fa9ac6979d47","resolution":{"observed_at":"2026-08-07T13:22:24.195991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:14.879626Z","title":"and Nichol, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:14.879626Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:9e4f07c9c21dfed878deb7a6a8aa1fb2dc3dd20e7ecdbfcc1faa4eb57a6bef58","observation_id":"8b92dc1c-2ac6-4c30-98ef-1d7928aa49b8","resolution":{"observed_at":"2026-08-07T13:22:14.879626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:23.868485Z","title":"Reg-ptq: Regression-specialized post-training quantization for fully quantized object detector","venue":null,"work_id":"d1d6f44e-3f12-4c71-991f-7a55979af7bb","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:14.973295Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:cb561e51947fc672384e1436b0e922f5437452a7ff54b9c0fa10d7301963ceb2","observation_id":"73e66e29-b3e5-4e4a-8028-ce67f7e2491f","resolution":{"observed_at":"2026-08-07T13:22:23.986454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:15.169329Z","title":"Perceptual quality assessment of smartphone photography","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:15.169329Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:357148c61dca50401ca1b2781d0f7888aba831f9761ea1879f7545b84eebacba","observation_id":"9efc581a-8040-4922-967a-61e21c4e9258","resolution":{"observed_at":"2026-08-07T13:22:15.169329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:23.707975Z","title":"Relational diffusion distillation for efficient image generation","venue":null,"work_id":"d325fec4-afd7-4949-9ef8-94847a31a198","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:15.276248Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:6241b85861e30b729e9bf2a841ea24bbb569518a746f471862eabe520ca1f373","observation_id":"f7efd17d-7b02-4aca-85f0-c890982605ed","resolution":{"observed_at":"2026-08-07T13:22:23.769463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:23.532053Z","title":"Mpq-dm: Mixed precision quantization for extremely low bit diffusion models","venue":null,"work_id":"0684c79f-4ccd-44e1-a32f-ea6a4a5aaf3e","year":2025},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:15.443773Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:0ec90b895f12130922ff8acaf4110f336803e7baeb3d31564848fcfc35353fb0","observation_id":"90bfd641-b19e-4967-94b9-43bd724397d4","resolution":{"observed_at":"2026-08-07T13:22:23.620119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:23.369513Z","title":"W., and Keutzer, K","venue":null,"work_id":"82e1de93-4397-4997-9bb9-b09b5dfcb0ca","year":2022},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:15.615845Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:07e38adbdbaa232ba4cf1e5bbed256389435ad8bf6457d4d5061fbbf552c32d3","observation_id":"d3258729-ce03-4162-9886-8b38b4d43b53","resolution":{"observed_at":"2026-08-07T13:22:23.473188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:15.742538Z","title":"Delving deep into rectifiers: Surpassing human-level performance on imagenet classification","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:15.742538Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:a086d5494cc25ed065428d3e1c7f526cf3528545a35fd1c83414948f4cbabbcf","observation_id":"6d9e08ff-bd26-4e8e-ab81-cfdec2384fd8","resolution":{"observed_at":"2026-08-07T13:22:15.742538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03270","last_updated":"2024-04-13T07:33:57Z","snapshot_observed_at":"2026-08-09T06:00:18.288366Z","submitted_at":"2023-10-05T02:51:53Z","title":"EfficientDM: Efficient Quantization-Aware Fine-Tuning of Low-Bit Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03270","snapshot_observed_at":"2026-08-07T13:22:15.860417Z","title":"Efficientdm: Efficient quantization-aware fine-tuning of low-bit diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:15.860417Z"},"links":{"cited_paper":"/paper/2310.03270","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:557f9b1a3cc6b742d067d43a991f58b84d77251ac3d6fceecaaf622e09ef9bc5","observation_id":"52e4babf-c224-4b40-9737-37d8f88dc76d","resolution":{"observed_at":"2026-08-07T13:22:15.860417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:23.170622Z","title":"Ptqd: Accurate post-training quantization for diffusion models","venue":null,"work_id":"b899968a-22a7-4560-8f8a-896bb9aaf72c","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:15.968162Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:7e90f5cbe5c9cdcf873eff831b7fc13c81bae585b05c9e3a23ae5eb0378fa386","observation_id":"eae52490-2fda-4090-9e12-7bfd982d02ef","resolution":{"observed_at":"2026-08-07T13:22:23.240856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:16.117647Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:16.117647Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:c1841d982ab444ca298266992f2926bca2e1881602f96f38850aff8aa1014467","observation_id":"b3a443b6-5165-4796-855c-53475dda801e","resolution":{"observed_at":"2026-08-07T13:22:16.117647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:23.033486Z","title":"Open-sora, 2024","venue":null,"work_id":"7a597827-0488-403e-b0b6-275c7275a09b","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:16.208110Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:3ad03d2230d3121bb00355ba0586691d65a3485065e289eb549dda2d3251479d","observation_id":"323a40c9-3090-4006-b106-74b51a9da9b4","resolution":{"observed_at":"2026-08-07T13:22:23.083920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T13:22:16.361887Z","title":"J., Shen, Y., Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., and Chen, W","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:16.361887Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:9fea1006498fa196fcfbdddcb32e23750d199df65af85fc0f0f15fadd6551283","observation_id":"2d97c5c7-ea68-43b1-be7e-0f6ed0eed961","resolution":{"observed_at":"2026-08-07T13:22:16.361887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:22.851761Z","title":"Tfmq-dm: Temporal feature maintenance quantization for diffusion models","venue":null,"work_id":"ec178f4f-531a-47a4-a407-7c3130af2123","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:16.515893Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:15e75069e7db231740b53089e110320b7485e2053a832b79ba27d3c60faee75f","observation_id":"6d543b78-e708-4246-8000-54d87bda162f","resolution":{"observed_at":"2026-08-07T13:22:22.952337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:22.604442Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":"46f9d4e7-bc77-4a8f-b0c5-bb4fef0b7015","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:16.627765Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:a7f54df26d83616abffbf1f5712f771b8440d27793bed64869ec2ee993bbf1a6","observation_id":"aab944f5-3a73-49af-b2da-dd4fbd82466a","resolution":{"observed_at":"2026-08-07T13:22:22.742449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:16.762681Z","title":"Musiq: Multi-scale image quality transformer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:16.762681Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:6f6c4121fedc6c11873a7765318d301784054f8ab8f71d8961e6f4ffaf831e65","observation_id":"a1a72d73-8869-4817-90fd-b8f191d0d3f1","resolution":{"observed_at":"2026-08-07T13:22:16.762681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:22.387442Z","title":"Aesthetic-predictor, 2022","venue":null,"work_id":"f2df11ab-55b2-4e92-a308-529a0a561000","year":2022},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:16.897187Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:c5a6a6bc81f64777312aa2f0934d3d0bd70f5fc29b2d8c0394323e6da426d829","observation_id":"7bd28cb6-65a6-43ee-8f50-7c8d2285d6c6","resolution":{"observed_at":"2026-08-07T13:22:22.494392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:17.043124Z","title":"Svdqunat: Absorbing outliers by low-rank components for 4-bit diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.043124Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:fb67108248dac3048a93892cbdff314016f46221f966bc0630b9403765fba367","observation_id":"92e45033-8877-45b2-ad9a-d33be3e662cc","resolution":{"observed_at":"2026-08-07T13:22:17.043124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:22.157239Z","title":"Q-diffusion: Quantizing diffusion models","venue":null,"work_id":"2c76a5a0-ac7b-4501-a529-4d7f8f67160c","year":2023},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.149968Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:2d9fe39ff4498d52b55dffa76f0cc5882febe4da00049c800f7e38bdca2a1000","observation_id":"408c8b91-7402-41b8-bae1-7f2d1ac272ae","resolution":{"observed_at":"2026-08-07T13:22:22.248683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:21.965145Z","title":"Q-dm: An efficient low-bit quantized diffusion model","venue":null,"work_id":"9a156367-8797-4137-9618-f6d55493a718","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.254209Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:a91fb9862d695cab241597f55bd542041ba9383664f01b46dc839dd18a42b426","observation_id":"a05a1368-8788-4dd2-b4a5-4ae7cbfc5ad1","resolution":{"observed_at":"2026-08-07T13:22:22.065546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:21.675852Z","title":"Diffbir: Toward blind image restoration with generative diffusion prior","venue":null,"work_id":"855b0ecd-9d7e-4f6a-a415-2bde715c2f77","year":2025},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.404799Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:748ec183164b4b4c45fab2478822f2be5051bf4a90352e2199a659c9e9c020e2","observation_id":"72106f91-22a9-43b2-8c18-76f86e94a4b2","resolution":{"observed_at":"2026-08-07T13:22:21.826663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:21.432379Z","title":"Evalcrafter: Benchmarking and evaluating large video generation models","venue":null,"work_id":"cd626a0a-f144-4006-809f-6290e1b3565c","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.521124Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:a02462311d98bd63159df8a3ace58f0a8c57e9a08852463e0d6014a87537ec98","observation_id":"d0f5f311-aa17-428b-b22d-c72ae042fd5d","resolution":{"observed_at":"2026-08-07T13:22:21.555393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:21.181587Z","title":"Reactnet: Towards precise binary neural network with generalized activation functions","venue":null,"work_id":"8b9b88cd-3d93-4d87-b9c3-342bbca157e9","year":2020},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.638786Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:634e8b6fc6cc53c5be666ab1086b1c6a4daaa6d5b489e3007418dd2604fa5708","observation_id":"37d4edee-b4ad-4b64-9c50-f5b904eff26e","resolution":{"observed_at":"2026-08-07T13:22:21.299496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14854","last_updated":"2025-04-06T10:46:47Z","snapshot_observed_at":"2026-08-04T01:43:39.476803Z","submitted_at":"2024-05-23T17:57:24Z","title":"TerDiT: Ternary Diffusion Models with Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14854","snapshot_observed_at":"2026-08-07T13:22:17.757779Z","title":"Terdit: Ternary diffusion models with transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.757779Z"},"links":{"cited_paper":"/paper/2405.14854","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:30fc4535e3624b4dd760f97ced6c2bff408a5e7781cb1524af40a05d7dce06fa","observation_id":"15fca04d-d514-431a-b9d1-c6a51528e5d3","resolution":{"observed_at":"2026-08-07T13:22:17.757779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03048","last_updated":"2025-05-01T09:40:21Z","snapshot_observed_at":"2026-08-02T13:01:06.918463Z","submitted_at":"2024-01-05T19:55:15Z","title":"Latte: Latent Diffusion Transformer for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03048","snapshot_observed_at":"2026-08-07T13:22:17.824915Z","title":"Latte: Latent diffusion transformer for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.824915Z"},"links":{"cited_paper":"/paper/2401.03048","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:e41eb380890bfa6635337808effa67b8489f3089bc5e76fba41dc6ecd1a6f732","observation_id":"cbdb5888-dff9-421e-be28-64ef064057a5","resolution":{"observed_at":"2026-08-07T13:22:17.824915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:17.905892Z","title":"and Xie, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.905892Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:4862a21019087d1c40fdd29ac2ad4107b978e68057c6f89e0e4ff861a7386f30","observation_id":"4c4a7afb-cf45-486d-b404-0b2e52be06df","resolution":{"observed_at":"2026-08-07T13:22:17.905892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:20.918785Z","title":"Compression of convolutional neural networks: A short survey","venue":null,"work_id":"f0100ff5-c322-4bbf-83b8-92a320f633b3","year":2018},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.964318Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:2480f5da4d08b851111e5b6d40d3a4da39ae9e8a4f653ec887bc146bc41e2b6d","observation_id":"d142ae07-177d-4d20-be8e-4e839ce5207a","resolution":{"observed_at":"2026-08-07T13:22:21.007247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:20.763747Z","title":"Forward and backward information retention for accurate binary neural networks","venue":null,"work_id":"f50016bf-c769-44a8-b8ec-7476db1bcca7","year":2020},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.014265Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:8cb3b5d12b85e6c45a4c20039726ee65fd0afc56c62844b818cedfad99f7be4d","observation_id":"ad7da9c4-8d16-4dfc-b56b-cbed9b599890","resolution":{"observed_at":"2026-08-07T13:22:20.831361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:18.065263Z","title":"W., Hallacy, C., Ramesh, A., Goh, G., Agarwal, S., Sastry, G., Askell, A., Mishkin, P., Clark, J., et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.065263Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:f215e578269b8217ce45cd79ef6689ad456676677cc328bbbfd79fd313e7d6f7","observation_id":"20986bf5-0d0c-4d9a-acb2-97619d7785a8","resolution":{"observed_at":"2026-08-07T13:22:18.065263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:18.138370Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.138370Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:513e447b9c93bdd691b0d9345a85dc252b0b055aeab6753d78720c93b15d411c","observation_id":"3e533fcf-643a-49b7-955c-41e150957a42","resolution":{"observed_at":"2026-08-07T13:22:18.138370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:20.629777Z","title":"Post-training quantization on diffusion models","venue":null,"work_id":"0c075dc6-223e-4571-88c8-4297d67df158","year":1972},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.222690Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:b1955ea72da5f1c04b64f266d00e5c5660ef2c2c32702573a06123e87a229ad1","observation_id":"9dfc85ce-922a-48ab-aaa9-327edbf0e9ef","resolution":{"observed_at":"2026-08-07T13:22:20.687033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-07T13:22:18.279026Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.279026Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:b5ec4fd1c90112f1c2de9a4d79e161559ba73ddb9a31e37303241773ae19d7fe","observation_id":"f2e6ac20-41a5-46cd-87d4-a3c0bb051fe5","resolution":{"observed_at":"2026-08-07T13:22:18.279026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-07T13:22:18.342697Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.342697Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:62ea4a781a88de6f0e8edceaf9b7981334939c7e578a18a27ca709542173244e","observation_id":"0dc5d63a-890d-4b28-815d-add6d080260c","resolution":{"observed_at":"2026-08-07T13:22:18.342697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:18.406400Z","title":"and Deng, J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.406400Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:9ac7287952966c47760c2201036e18cc4da09b19e028aa74e390a9f5c5e3e9b0","observation_id":"dbfd2305-85e4-402a-8188-a3b9bcdc8462","resolution":{"observed_at":"2026-08-07T13:22:18.406400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03666","last_updated":"2025-07-15T15:33:13Z","snapshot_observed_at":"2026-08-09T03:33:46.844193Z","submitted_at":"2024-02-06T03:39:44Z","title":"QuEST: Low-bit Diffusion Model Quantization via Efficient Selective Finetuning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03666","snapshot_observed_at":"2026-08-07T13:22:18.467794Z","title":"Quest: Low-bit diffusion model quantization via efficient selective finetuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.467794Z"},"links":{"cited_paper":"/paper/2402.03666","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:23db2b6536f6817a1620e47cc050ab83dceb8e724c18c1d1a709cb583615e530","observation_id":"3f693415-93eb-4e22-8899-e416ba6e79aa","resolution":{"observed_at":"2026-08-07T13:22:18.467794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:20.484568Z","title":"C., and Loy, C","venue":null,"work_id":"7e5dc4a8-939c-4800-ac4f-2ebea9df226e","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.547599Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:f72870a671be617259e8c10b8037925e2c01ba6d67fd137e67294bca8f22e87f","observation_id":"5f5434b8-0cf7-4697-ba23-6297227cb4bd","resolution":{"observed_at":"2026-08-07T13:22:20.556048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06942","last_updated":"2024-01-04T05:00:34Z","snapshot_observed_at":"2026-07-06T15:53:46.393481Z","submitted_at":"2023-07-13T17:58:32Z","title":"InternVid: A Large-scale Video-Text Dataset for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06942","snapshot_observed_at":"2026-08-07T13:22:18.607441Z","title":"Internvid: A large-scale video-text dataset for multimodal understanding and generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.607441Z"},"links":{"cited_paper":"/paper/2307.06942","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:32de060318d47a2eb75c99f133149b5342068b120acb76fa76cae36da3eb8128","observation_id":"7d3d1fc9-29a7-43ef-ba22-2208dff8b6e8","resolution":{"observed_at":"2026-08-07T13:22:18.607441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:20.298276Z","title":"Exploring video quality assessment on user generated contents from aesthetic and technical perspectives","venue":null,"work_id":"00021da7-123d-403e-a070-74145b13020e","year":2023},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.667166Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:1f2fa26594e6f3088d3ecf94823a38fc10d68d69d586292ae9073395d95e96c6","observation_id":"4e226ceb-9057-44eb-9210-88343ad97e01","resolution":{"observed_at":"2026-08-07T13:22:20.374069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16005","last_updated":"2024-10-17T15:28:15Z","snapshot_observed_at":"2026-08-08T18:38:43.925941Z","submitted_at":"2024-05-25T02:02:08Z","title":"PTQ4DiT: Post-training Quantization for Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16005","snapshot_observed_at":"2026-08-07T13:22:18.742485Z","title":"Ptq4dit: Post-training quantization for diffusion transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.742485Z"},"links":{"cited_paper":"/paper/2405.16005","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:db1d71815d2ab5e6b733d1a5be5a1465dd5d7210c85df0d1a6d9026d639d593b","observation_id":"67ca7b77-e310-4a14-a0ef-dda0cd4b0cf3","resolution":{"observed_at":"2026-08-07T13:22:18.742485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:20.163043Z","title":"Seesr: Towards semantics-aware real-world image super-resolution","venue":null,"work_id":"141f452d-0e97-49e2-a2db-95dce605b148","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.828047Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:1815c5ff2a4485e246c42a70611a632b3114cec1a89404b82a89ac0e370142bc","observation_id":"9be99d43-2628-4b21-87e9-ee4b8becf7bf","resolution":{"observed_at":"2026-08-07T13:22:20.257269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:19.999363Z","title":"Smoothquant: Accurate and efficient post-training quantization for large language models","venue":null,"work_id":"61e29950-0ebb-43e6-8567-417b166be364","year":2023},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.883254Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:c49fde5e9e69d62a1e943a236c830e4dcd08676411aac18eaa85e54ae1017dd0","observation_id":"319346f7-cb07-4548-961e-a5ac96d4e5cc","resolution":{"observed_at":"2026-08-07T13:22:20.070306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:19.826067Z","title":"Cross-image relational knowledge distillation for semantic segmentation","venue":null,"work_id":"b26393a0-5c42-401f-a97f-d51d8ac1be32","year":2022},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.927942Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:b9ff14849222053a4f2147fed0dc31d0b57769d84782e95fd0831e664223a88d","observation_id":"e4478665-50af-4895-a7bc-93f0e3507d7b","resolution":{"observed_at":"2026-08-07T13:22:19.915750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.01428","last_updated":"2025-04-02T12:45:49Z","snapshot_observed_at":"2026-08-07T16:14:46.034578Z","submitted_at":"2025-04-02T12:45:49Z","title":"Multi-party Collaborative Attention Control for Image Customization","version":1},"cited_work":{"arxiv_id":"2505.01428","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.01428","snapshot_observed_at":"2026-08-07T13:22:19.392798Z","title":"Multi-party Collaborative Attention Control for Image Customization","venue":"cs.CV","work_id":"dfe8d002-0a7b-465f-91f4-3fd94d836c9c","year":2025},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:19.008369Z"},"links":{"cited_paper":"/paper/2505.01428","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:3d9a9a52a89c739b9a285c98b0bef52819c12bab22b0eeac6da66c675e9f9527","observation_id":"8647242a-2de7-427f-9024-6d18698c105e","resolution":{"observed_at":"2026-08-07T13:22:19.445271Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02540","last_updated":"2025-02-22T16:29:03Z","snapshot_observed_at":"2026-08-09T01:39:40.569339Z","submitted_at":"2024-06-04T17:57:10Z","title":"ViDiT-Q: Efficient and Accurate Quantization of Diffusion Transformers for Image and Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02540","snapshot_observed_at":"2026-08-07T13:22:19.011966Z","title":"Vidit-q: Efficient and accurate quantization of diffusion transformers for image and video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:19.011966Z"},"links":{"cited_paper":"/paper/2406.02540","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:be0d943980dc721684c9191a249f139d59da809587e81d387649a60c4cebf82a","observation_id":"2d4d10d1-c9d0-4362-90da-73bc24428fa1","resolution":{"observed_at":"2026-08-07T13:22:19.011966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:19.685111Z","title":"Mixdq: Memory-efficient few-step text-to-image diffusion models with metric-decoupled mixed precision quantization","venue":null,"work_id":"63dd8474-ad62-49f2-8b39-f76d70600365","year":2025},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:19.016977Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:2c144fa04a53d363542d4825ae20062005d44a327ba18d12f9b789ecb377dfce","observation_id":"fc47f83c-143d-43d3-941e-21785bf0e418","resolution":{"observed_at":"2026-08-07T13:22:19.779782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05926","last_updated":"2024-12-08T12:45:21Z","snapshot_observed_at":"2026-07-06T20:03:29.510169Z","submitted_at":"2024-12-08T12:45:21Z","title":"BiDM: Pushing the Limit of Quantization for Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05926","snapshot_observed_at":"2026-08-07T13:22:19.082312Z","title":"Bidm: Pushing the limit of quantization for diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:19.082312Z"},"links":{"cited_paper":"/paper/2412.05926","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:17655c611f2a3818ac63c1e5d370d6e2b81b1095ceb740ac5cc6a4e7068d459f","observation_id":"001445c0-a054-4550-9768-f08cd23d8106","resolution":{"observed_at":"2026-08-07T13:22:19.082312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05662","last_updated":"2025-01-31T07:11:43Z","snapshot_observed_at":"2026-07-06T17:57:19.117933Z","submitted_at":"2024-04-08T16:46:25Z","title":"BinaryDM: Accurate Weight Binarization for Efficient Diffusion Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05662","snapshot_observed_at":"2026-08-07T13:22:19.150573Z","title":"Binarydm: Towards accurate binarization of diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:19.150573Z"},"links":{"cited_paper":"/paper/2404.05662","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:0914cba18aa99dda0475e35ff7c6697f4d30e7d728c40faee996238d1935ab87","observation_id":"4ab4c250-2d33-4397-8f28-0e6eaee11392","resolution":{"observed_at":"2026-08-07T13:22:19.150573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:19.245131Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:19.245131Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:d3fe83969165817bfc2d612433bd7be6b15a9de21ab890b139dcf522421d73f4","observation_id":"7fe76973-9da6-49ee-b460-20caadec97c8","resolution":{"observed_at":"2026-08-07T13:22:19.245131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T01:40:06.846267Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":1,"verified_fuzzy":26},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 8 inbound Pith citation observations for arXiv:2505.22167."}