{"as_of":"2026-08-22T08:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ec5901b89240d79b0e915d11e05a9efbd4b29412c85938c79c0d851cb761118b","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:33:12.833852Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:30:07.769382Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T13:45:46.109771Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14687","snapshot_observed_at":"2026-08-10T20:42:59.571181Z","title":"Grouping first, attending smartly: Training- free acceleration for diffusion transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.07730","last_updated":"2025-08-02T07:11:16Z","snapshot_observed_at":"2026-08-17T07:53:14.156204Z","submitted_at":"2025-01-13T22:37:17Z","title":"Democratizing Text-to-Image Masked Generative Models with Compact Text-Aware One-Dimensional Tokens","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T20:42:59.571181Z"},"links":{"cited_paper":"/paper/2505.14687","citing_paper":"/paper/2501.07730"},"observation_digest":"sha256:b5d4ecd732b13ff24330b419ae7c7db03d1735ab0886634151b01fee613b86ee","observation_id":"4f4f36e8-d914-4ce3-ad57-e1bc149db04c","resolution":{"observed_at":"2026-08-10T20:42:59.571181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.14687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14687","snapshot_observed_at":"2026-07-01T13:45:46.109771Z","title":"Grouping first, attending smartly: Training-free acceleration for diffusion transformers","venue":null,"work_id":"4f762038-6842-479f-899f-c369ef580e13","year":2025},"citing_paper":{"arxiv_id":"2603.06351","last_updated":"2026-05-07T16:40:07Z","snapshot_observed_at":"2026-08-11T15:47:08.117539Z","submitted_at":"2026-03-06T14:59:11Z","title":"DC-DiT: Adaptive Compute and Elastic Inference for Visual Generation via Dynamic Chunking","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T15:10:00.146694Z"},"links":{"cited_paper":"/paper/2505.14687","citing_paper":"/paper/2603.06351"},"observation_digest":"sha256:2557ff5c4634c8117e38a46334414796b90820d55f69009f759812206e3feee4","observation_id":"e35993a9-d991-427b-84a6-22aa4778c62d","resolution":{"observed_at":"2026-05-15T15:10:05.851830Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.14687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14687","snapshot_observed_at":"2026-07-01T13:45:46.109771Z","title":"Grouping first, attending smartly: Training-free acceleration for diffusion transformers","venue":null,"work_id":"4f762038-6842-479f-899f-c369ef580e13","year":2025},"citing_paper":{"arxiv_id":"2604.04913","last_updated":"2026-04-06T17:55:05Z","snapshot_observed_at":"2026-08-17T02:35:09.266915Z","submitted_at":"2026-04-06T17:55:05Z","title":"A Frame is Worth One Token: Efficient Generative World Modeling with Delta Tokens","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T19:19:17.796377Z"},"links":{"cited_paper":"/paper/2505.14687","citing_paper":"/paper/2604.04913"},"observation_digest":"sha256:54c4e7df7381950e54b31871ce39527825136a3b1ee167b52134621314da9536","observation_id":"43ca65b5-c884-476c-89eb-9a67ba031992","resolution":{"observed_at":"2026-05-10T23:10:50.174151Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.14687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14687","snapshot_observed_at":"2026-07-01T13:45:46.109771Z","title":"Grouping first, attending smartly: Training-free acceleration for diffusion transformers","venue":null,"work_id":"4f762038-6842-479f-899f-c369ef580e13","year":2025},"citing_paper":{"arxiv_id":"2604.15521","last_updated":"2026-04-16T21:00:41Z","snapshot_observed_at":"2026-08-12T16:18:13.467015Z","submitted_at":"2026-04-16T21:00:41Z","title":"Frequency-Aware Flow Matching for High-Quality Image Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T10:58:05.541289Z"},"links":{"cited_paper":"/paper/2505.14687","citing_paper":"/paper/2604.15521"},"observation_digest":"sha256:9ac51069ff4a49e6f2cf6dd35eca4375c79eb58f8b8f2632f8ec65173c5169d0","observation_id":"b86c1ea3-1ce8-4a08-a0f2-0ad7cacd5cdf","resolution":{"observed_at":"2026-05-10T11:00:04.105673Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.14687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14687","snapshot_observed_at":"2026-07-01T13:45:46.109771Z","title":"Grouping first, attending smartly: Training-free acceleration for diffusion transformers","venue":null,"work_id":"4f762038-6842-479f-899f-c369ef580e13","year":2025},"citing_paper":{"arxiv_id":"2604.15911","last_updated":"2026-04-17T10:11:39Z","snapshot_observed_at":"2026-08-20T15:11:48.430991Z","submitted_at":"2026-04-17T10:11:39Z","title":"Efficient Video Diffusion Models: Advancements and Challenges","version":1},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-05-10T08:28:29.706249Z"},"links":{"cited_paper":"/paper/2505.14687","citing_paper":"/paper/2604.15911"},"observation_digest":"sha256:5d13c1584b173be1144b1d316077232569abaa778be73ad8c573e6338bc1f90e","observation_id":"a1252ef0-c61f-4411-b75a-250093626758","resolution":{"observed_at":"2026-05-10T09:03:25.769904Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.14687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14687","snapshot_observed_at":"2026-07-01T13:45:46.109771Z","title":"Grouping first, attending smartly: Training-free acceleration for diffusion transformers","venue":null,"work_id":"4f762038-6842-479f-899f-c369ef580e13","year":2025},"citing_paper":{"arxiv_id":"2605.09313","last_updated":"2026-06-16T05:24:37Z","snapshot_observed_at":"2026-08-08T23:21:56.577406Z","submitted_at":"2026-05-10T04:14:07Z","title":"Attention Sinks in Diffusion Transformers: A Causal Analysis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T04:18:26.883899Z"},"links":{"cited_paper":"/paper/2505.14687","citing_paper":"/paper/2605.09313"},"observation_digest":"sha256:49625248d1855a7d6815126483d1880e5d8d5def67abe63034b77613a7de6788","observation_id":"46388b3a-5e1a-407a-8fa7-2421d098f3b5","resolution":{"observed_at":"2026-05-12T06:26:24.044397Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.14687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14687","snapshot_observed_at":"2026-07-01T13:45:46.109771Z","title":"Grouping first, attending smartly: Training-free acceleration for diffusion transformers","venue":null,"work_id":"4f762038-6842-479f-899f-c369ef580e13","year":2025},"citing_paper":{"arxiv_id":"2605.09313","last_updated":"2026-06-16T05:24:37Z","snapshot_observed_at":"2026-08-08T23:21:56.577406Z","submitted_at":"2026-05-10T04:14:07Z","title":"Attention Sinks in Diffusion Transformers: A Causal Analysis","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T05:59:16.233848Z"},"links":{"cited_paper":"/paper/2505.14687","citing_paper":"/paper/2605.09313"},"observation_digest":"sha256:6d8df37e95507523acf502434c3f9052043ee175d0961b78fc1f55eaa2b61144","observation_id":"a5fff18d-56e4-433c-a0a9-601a2ebc0192","resolution":{"observed_at":"2026-05-13T06:02:23.283147Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.14687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14687","snapshot_observed_at":"2026-07-01T13:45:46.109771Z","title":"Grouping first, attending smartly: Training-free acceleration for diffusion transformers","venue":null,"work_id":"4f762038-6842-479f-899f-c369ef580e13","year":2025},"citing_paper":{"arxiv_id":"2605.09313","last_updated":"2026-06-16T05:24:37Z","snapshot_observed_at":"2026-08-08T23:21:56.577406Z","submitted_at":"2026-05-10T04:14:07Z","title":"Attention Sinks in Diffusion Transformers: A Causal Analysis","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T22:47:11.360530Z"},"links":{"cited_paper":"/paper/2505.14687","citing_paper":"/paper/2605.09313"},"observation_digest":"sha256:f7835d3576d1026bd0f30482a0bfadca38edce9a4a21f24b044d15202dfd9c32","observation_id":"5a6911fb-01fb-4563-a1ba-bcbc644f8972","resolution":{"observed_at":"2026-07-01T13:45:46.111412Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14687","snapshot_observed_at":"2026-08-02T06:40:16.892454Z","title":"Grouping first, attending smartly: Training-free acceleration for diffusion transformers.arXiv preprint arXiv:2505.14687, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12358","last_updated":"2026-07-16T04:34:12Z","snapshot_observed_at":"2026-08-17T22:13:41.170664Z","submitted_at":"2026-07-14T05:17:24Z","title":"ACID: Adaptive Caching for vIDeo generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T06:40:16.892454Z"},"links":{"cited_paper":"/paper/2505.14687","citing_paper":"/paper/2607.12358"},"observation_digest":"sha256:94fda63c85d5d3b11fe7681cfdf0e3bdcc7e10346415995b64fc7eefb815c1d6","observation_id":"03ed245a-a299-4c3a-9bee-234a7289ec20","resolution":{"observed_at":"2026-08-02T06:40:16.892454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14687","snapshot_observed_at":"2026-08-15T23:30:07.769382Z","title":"Grouping first, attending smartly: Training-free acceleration for diffusion transformers.arXiv preprint arXiv:2505.14687, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12780","last_updated":"2026-08-13T03:43:31Z","snapshot_observed_at":"2026-08-18T03:59:11.125522Z","submitted_at":"2026-08-13T03:43:31Z","title":"SCOPE: Subspace Clustering with Online Per-Head Top-K Estimation for Sparse Video Attention","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:30:07.769382Z"},"links":{"cited_paper":"/paper/2505.14687","citing_paper":"/paper/2608.12780"},"observation_digest":"sha256:1ddd3694591dfc6e53664cc53aa783643d9d3ff3bfe2f5b378f04fad66779712","observation_id":"8e5acc8b-c681-4a6e-85f2-429ec8ba351e","resolution":{"observed_at":"2026-08-15T23:30:07.769382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14687/citation-record","integrity":"/paper/2505.14687/integrity","json":"/paper/2505.14687/citation-record.json","paper":"/paper/2505.14687"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:08.008274Z","title":"All are worth words: A vit backbone for diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.008274Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:997a9cf4862b29131e0187241e6d6791fd07c675ff821c46a90adf07081de589","observation_id":"1aee1501-f069-4741-a986-6b2df5d8ef2a","resolution":{"observed_at":"2026-08-07T15:33:08.008274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-20T09:39:07.545813Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-07T15:33:08.118350Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.118350Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:171a3096d3197b827ff9e7332b1a267d8b2f3b3f4714f8d879d74bdeb1d78ade","observation_id":"79c19ce1-eb41-4073-bc28-c88e517ff778","resolution":{"observed_at":"2026-08-07T15:33:08.118350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:18.201330Z","title":"Pixart- σ: Weak-to-strong training of diffusion transformer for 4k text-to-image generation","venue":null,"work_id":"2a095ea5-998e-418e-b85e-8dd4b126ab7e","year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.197422Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:2beac5686e76e4c5a083508d3e80013b99d66dd49c3a696ba824491fd86749f6","observation_id":"570f195f-2620-41dc-914c-3d3c2f7f226a","resolution":{"observed_at":"2026-08-07T15:33:18.248784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-07T15:33:08.290073Z","title":"Flashattention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.290073Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:2bfceff59409f13fb90878281453ae4202edb4828649564085df46da4e8c467c","observation_id":"8e1e9712-4957-4e21-bf0d-88a4e3ac9617","resolution":{"observed_at":"2026-08-07T15:33:08.290073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02589","last_updated":"2025-02-04T18:59:46Z","snapshot_observed_at":"2026-08-14T09:50:00.957608Z","submitted_at":"2025-02-04T18:59:46Z","title":"COCONut-PanCap: Joint Panoptic Segmentation and Grounded Captions for Fine-Grained Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02589","snapshot_observed_at":"2026-08-07T15:33:08.388520Z","title":"Coconut-pancap: Joint panoptic segmentation and grounded captions for fine-grained understanding and generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.388520Z"},"links":{"cited_paper":"/paper/2502.02589","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:272d4f1f4bae8463b2ebca40fb880b2c159d99260c87320e284c8148a772234c","observation_id":"f3978d47-c442-4331-bc50-de86e6ed8d5d","resolution":{"observed_at":"2026-08-07T15:33:08.388520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05496","last_updated":"2024-12-07T01:46:38Z","snapshot_observed_at":"2026-08-14T20:35:19.337789Z","submitted_at":"2024-12-07T01:46:38Z","title":"Flex Attention: A Programming Model for Generating Optimized Attention Kernels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05496","snapshot_observed_at":"2026-08-07T15:33:08.466620Z","title":"Flex attention: A programming model for generating optimized attention kernels","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.466620Z"},"links":{"cited_paper":"/paper/2412.05496","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:61f9004c8b220c14449c87211556f9f81f801081cd30ff2ab577fea99dfb4251","observation_id":"b65944f0-5ef0-4d1f-90ca-b981e5a77b81","resolution":{"observed_at":"2026-08-07T15:33:08.466620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:08.532943Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.532943Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:3ce8c1360976ca3e74b7b2f0e0ab9ad78203059f89ab915458972387ef089b63","observation_id":"55148d36-2d75-4aad-8792-03b2310999da","resolution":{"observed_at":"2026-08-07T15:33:08.532943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:08.640437Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.640437Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:475c88e73a421692cedcd82a656b8ff9be9fae3136341534d14fc4165f58811d","observation_id":"4ed792c8-8bfc-49e3-a976-f12d51407e7b","resolution":{"observed_at":"2026-08-07T15:33:08.640437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:18.067120Z","title":"Structural pruning for diffusion models","venue":null,"work_id":"8183df60-3f86-4474-8473-d716230cf7a9","year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.725477Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:9a617513226cb528c17833b505c4f90727636c52e7a3a464b2eda99be442d2f9","observation_id":"c084b80d-dd89-4d79-a5c9-8a0a46f8ebde","resolution":{"observed_at":"2026-08-07T15:33:18.103909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:17.919567Z","title":"Geneval: An object-focused framework for evaluating text-to-image alignment","venue":null,"work_id":"0fef2555-05aa-49e2-a864-a46829d63f92","year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.815181Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:0d1ad80585f9c5c0f391365602d4b1a829b9f1f86392c12f4bc33751b1dd0dbc","observation_id":"aa39bbf9-2236-4de0-b5dd-b96f1eddd47d","resolution":{"observed_at":"2026-08-07T15:33:17.981770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:17.690575Z","title":"Neighborhood attention transformer","venue":null,"work_id":"e4cf165d-d7dd-48ab-b3fb-30bc9cacd7db","year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.892465Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:fadc4b8accf84179200920febe19ad19a0a0222c7b8c51f88b62dbf887ebbe7c","observation_id":"4b10cff7-cce4-4bf4-a41e-21bfe2969bf6","resolution":{"observed_at":"2026-08-07T15:33:17.816114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18537","last_updated":"2024-06-12T08:20:59Z","snapshot_observed_at":"2026-08-16T14:38:51.018726Z","submitted_at":"2023-11-30T13:20:09Z","title":"A Simple Video Segmenter by Tracking Objects Along Axial Trajectories","version":2},"cited_work":{"arxiv_id":"2311.18537","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.18537","snapshot_observed_at":"2026-08-07T15:33:13.502180Z","title":"A Simple Video Segmenter by Tracking Objects Along Axial Trajectories","venue":"cs.CV","work_id":"809b4222-632f-4321-a502-ca36cb5bc239","year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:08.965378Z"},"links":{"cited_paper":"/paper/2311.18537","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:10254e44b3a45e45f3361aa67cd086bec89e3ac8d868ca0286a8155ba5508b66","observation_id":"0eea724e-96ed-45c3-81e6-87c7c20ea960","resolution":{"observed_at":"2026-08-07T15:33:13.584587Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:09.065536Z","title":"Flowtok: Flowing seamlessly across text and image tokens","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.065536Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:370182cdaf91f5c88da22b1cf5e991373bf161f4c35e6ab4c415a685e8f9549b","observation_id":"03515be4-1de5-4509-b57b-0eb2ae6b54e8","resolution":{"observed_at":"2026-08-07T15:33:09.065536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:09.139544Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.139544Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:0cf2a91341c9c5fea89ed91b2b4a85939ae92bfa7c10a07369d09eead338b95c","observation_id":"03e5c20f-ce90-4244-ba60-26c8237e3e2f","resolution":{"observed_at":"2026-08-07T15:33:09.139544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:09.231873Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.231873Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:532fea0c9fcaf3b1023483ad01be68673756029e2cf10e97499c8d6f3b2b6b58","observation_id":"788e1d04-561d-4298-ba60-ebb3ee82799e","resolution":{"observed_at":"2026-08-07T15:33:09.231873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:09.321274Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.321274Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:cd0d00eeea422f440c5013178a39fed3212463c9980aa362a2027aa25e648556","observation_id":"37d84659-5348-4166-a3cf-c3936698a787","resolution":{"observed_at":"2026-08-07T15:33:09.321274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:09.415489Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.415489Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:a753b6b5cc45bf34cb108e7c671c6b58a5fc7d25fa271b22c59a80f3f959d566","observation_id":"1f4363f6-381f-42b0-a7ea-d36456e50415","resolution":{"observed_at":"2026-08-07T15:33:09.415489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15798","last_updated":"2024-12-02T12:58:23Z","snapshot_observed_at":"2026-08-20T06:10:40.663669Z","submitted_at":"2023-05-25T07:28:28Z","title":"BK-SDM: A Lightweight, Fast, and Cheap Version of Stable Diffusion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15798","snapshot_observed_at":"2026-08-07T15:33:09.528176Z","title":"On architectural compression of text-to-image diffusion models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.528176Z"},"links":{"cited_paper":"/paper/2305.15798","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:05c801c5c341729d557196888426a564bfcfd51a214a1d0accaa753165319e0a","observation_id":"d74470f6-32c6-427b-9b13-b484f376cc39","resolution":{"observed_at":"2026-08-07T15:33:09.528176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07730","last_updated":"2025-08-02T07:11:16Z","snapshot_observed_at":"2026-08-17T07:53:14.156204Z","submitted_at":"2025-01-13T22:37:17Z","title":"Democratizing Text-to-Image Masked Generative Models with Compact Text-Aware One-Dimensional Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07730","snapshot_observed_at":"2026-08-07T15:33:09.611097Z","title":"Democratizing text-to-image masked generative models with compact text-aware one-dimensional tokens","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.611097Z"},"links":{"cited_paper":"/paper/2501.07730","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:70685db3dc622450964a3422ae67b6f4e19ca9517de597aa674be9354076b5ce","observation_id":"2a26b896-c5e6-445e-8391-19d4a2ddce8e","resolution":{"observed_at":"2026-08-07T15:33:09.611097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:17.325141Z","title":"Auto-encoding variational bayes","venue":null,"work_id":"642429a0-7b3b-4060-9bf1-b6eb65c297ab","year":2014},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.705790Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:414a5455545fea04875d4378ef4599739a6c604a78eec31f0edaee3abc24955c","observation_id":"1787af12-90c5-4b72-9f49-63638d80ea82","resolution":{"observed_at":"2026-08-07T15:33:17.450202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-17T07:44:10.213698Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-07T15:33:09.802048Z","title":"Hunyuanvideo: A systematic framework for large video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.802048Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:64078972db486e212637b79d61928600cc1ef7f9fb066d23e6af8ac4eab11c42","observation_id":"d75af1e5-a66f-4b6b-97b7-02db52c580e4","resolution":{"observed_at":"2026-08-07T15:33:09.802048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:17.154358Z","title":"Flux: Official inference repository for flux.1 models, 2024","venue":null,"work_id":"d7dbf3c6-b4df-4538-9983-c47f7d044ffc","year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.890736Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:184c62fcabc6e43ca8079d865aee6f370ff6e46f5e8e45386d3c29d4369a0522","observation_id":"b2bb5ecf-4d31-43cb-8817-516329cc1819","resolution":{"observed_at":"2026-08-07T15:33:17.223842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:16.923915Z","title":"Set transformer: A framework for attention-based permutation-invariant neural networks","venue":null,"work_id":"8ea693d6-0b41-4c41-9ac3-5c87b07316e5","year":2019},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:09.990647Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:042041d65f639030bbd6a017d4c9d08e903ee786782469e882653bced4d279ba","observation_id":"9cc94751-2b32-4437-b9e8-535fa9d70074","resolution":{"observed_at":"2026-08-07T15:33:17.040318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:16.730126Z","title":"Koala: Empirical lessons toward memory-efficient and fast diffusion models for text-to-image synthesis","venue":null,"work_id":"aa92ee9a-5892-48bb-ad5e-a51bcc7edcab","year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.054589Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:1a8778f10ddd0b1db306b4110c87429ff9c98b50067bda225e58e7dd66d1e336","observation_id":"f2caf802-0014-48e2-b3de-918c4742d692","resolution":{"observed_at":"2026-08-07T15:33:16.801008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17245","last_updated":"2024-02-27T06:31:52Z","snapshot_observed_at":"2026-08-16T13:11:20.195602Z","submitted_at":"2024-02-27T06:31:52Z","title":"Playground v2.5: Three Insights towards Enhancing Aesthetic Quality in Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17245","snapshot_observed_at":"2026-08-07T15:33:10.117315Z","title":"Playground v2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.117315Z"},"links":{"cited_paper":"/paper/2402.17245","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:9b3a029b78d43df9dfc30393958536e8733c8d8c3dc0db48488b82614a050601","observation_id":"d5ca0487-ccd4-49f5-ae78-14d7505d2ada","resolution":{"observed_at":"2026-08-07T15:33:10.117315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:16.555615Z","title":"Q-diffusion: Quantizing diffusion models","venue":null,"work_id":"f200ffe2-45fb-4add-9826-b6c9eb17be59","year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.175585Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:30d59b7dc9e6e5efd15e3570df5302a3a1f62ead74a12f9215d8b0d8a2523165","observation_id":"2a90d978-d06c-48d5-b03f-3b411c00ea1b","resolution":{"observed_at":"2026-08-07T15:33:16.609258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:10.217019Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.217019Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:2486a396d193cc4e3d6f85be2066912f737c1d3789300cdb536489946bee0b28","observation_id":"b92128ce-cfe6-4f37-9d28-195864e60914","resolution":{"observed_at":"2026-08-07T15:33:10.217019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:16.358578Z","title":"Flow matching for generative modeling","venue":null,"work_id":"3d8c294f-0054-4e7f-9003-88a4453d2526","year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.273734Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:eebe35f57eceb11623ccafee0c12826fb536525ee667fc9e145e622341314ae2","observation_id":"972035e3-7f4a-4f27-92ca-ed1145ceb719","resolution":{"observed_at":"2026-08-07T15:33:16.438238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:16.188213Z","title":"Pseudo numerical methods for diffusion models on manifolds","venue":null,"work_id":"8c48f63a-e1a1-432d-97ff-cfc6f4e04275","year":2022},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.339537Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:f7cc148148d6f977f227a692e124a86fcc89768b667a85e3da6a44e82f0142b2","observation_id":"0f3c9bf9-39e8-4cd3-8cf7-717e30be88b4","resolution":{"observed_at":"2026-08-07T15:33:16.268542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:16.025673Z","title":"Alleviating distortion in image generation via multi-resolution diffusion models and time-dependent layer normalization.NeurIPS, 2024","venue":null,"work_id":"d9a0db77-5c2e-4365-a422-6c436fa16a3b","year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.406077Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:ac8bc0204a4fef26a81ba44d05c62447268b1ef92e4a89f08716e0dcc5e5f436","observation_id":"0cd2cb5c-2199-4a34-a237-179c20409316","resolution":{"observed_at":"2026-08-07T15:33:16.093310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:10.485556Z","title":"Revision: High-quality, low-cost video generation with explicit 3d physics modeling for complex motion and interaction","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.485556Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:b00d18afb3a74f19a2fdc5c58d7614ef78bc01a1c4110b85fca9c67142e76016","observation_id":"19652a10-b693-4a25-877e-120a4bd9af9c","resolution":{"observed_at":"2026-08-07T15:33:10.485556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16112","last_updated":"2024-12-20T17:57:09Z","snapshot_observed_at":"2026-08-15T20:19:47.193159Z","submitted_at":"2024-12-20T17:57:09Z","title":"CLEAR: Conv-Like Linearization Revs Pre-Trained Diffusion Transformers Up","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16112","snapshot_observed_at":"2026-08-07T15:33:10.540296Z","title":"Clear: Conv-like linearization revs pre-trained diffusion transformers up","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.540296Z"},"links":{"cited_paper":"/paper/2412.16112","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:4a645dd2532903dc9d412eee39b8e81a61051e1e26b070fbdbb668681eae06bc","observation_id":"35b85fd9-8839-4faa-a332-90f6e4ea280d","resolution":{"observed_at":"2026-08-07T15:33:10.540296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:10.610639Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.610639Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:bf15e6a3c5cf989dd9e9a0015a88ccc8a0104b433b8dc9ae8b90764977de14d7","observation_id":"f4577a30-29a3-43a2-9d6c-eab7419c672d","resolution":{"observed_at":"2026-08-07T15:33:10.610639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:10.696982Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.696982Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:abc9b5322e315e0a822884fe4190bc428841df5a85df7be3009d00f714db0e36","observation_id":"4d94bc75-79ca-4c30-a430-b229abadc9d4","resolution":{"observed_at":"2026-08-07T15:33:10.696982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:15.815953Z","title":"Sit: Exploring flow and diffusion-based generative models with scalable interpolant transformers","venue":null,"work_id":"92c6bfaa-2ba7-46ec-ab98-4134c787ceca","year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.753989Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:48dfdcd7f3129a4ba557e4efacc0eeafc5fdcfee34d39e0796109f55ce1b3187","observation_id":"1dbe9e44-1332-4068-bf74-324f3776c0db","resolution":{"observed_at":"2026-08-07T15:33:15.882654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:10.831193Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.831193Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:1799d7784ebf25b8c1beba6d0226acae2d215488f8d422f863cd6ea1ed9ece00","observation_id":"f3338114-3ca9-4c04-8fe0-8ad611cde28c","resolution":{"observed_at":"2026-08-07T15:33:10.831193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:10.906479Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.906479Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:a143ad6b426529c1da85d02a1dccee0f1232551df6d7c82ecc6c21889e5b965a","observation_id":"86184171-4eff-455c-bce7-036aa8a98720","resolution":{"observed_at":"2026-08-07T15:33:10.906479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:10.970631Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:10.970631Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:2c14a50426cb4e8ef79df4563532075984e60f46c5a7c55005eea547f1107b9e","observation_id":"043dafce-3774-4c63-ac1a-3847466d5983","resolution":{"observed_at":"2026-08-07T15:33:10.970631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:15.608207Z","title":"Stand-alone self-attention in vision models","venue":null,"work_id":"fb8918cc-c976-408f-9619-abe8b4cbb9f2","year":2019},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.011275Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:29baeb1da172051ba832e01f74aebece6375d701b01a7375188a1649b3ccb6d4","observation_id":"a275f21e-61a1-43de-8f5a-b6f5a8de9e99","resolution":{"observed_at":"2026-08-07T15:33:15.688154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-16T12:54:31.945411Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-08-07T15:33:11.114818Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.114818Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:26a39722c2ca8746854c76073f4dd8ca9429a16d534886125f9069b281fd1d5f","observation_id":"2bbd127e-dbbb-433b-813f-e49370cc231c","resolution":{"observed_at":"2026-08-07T15:33:11.114818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:15.405040Z","title":"Flowar: Scale-wise autoregressive image generation meets flow matching","venue":null,"work_id":"6066ee21-eb3b-40b7-97bb-aea4a5a41436","year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.195760Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:7011f9805e23ce5da4b6dd29ee6b243f83e31ffa1c440136c05921a8507f99d3","observation_id":"9f72c516-3ad7-4c04-8ece-4ef59bbc362f","resolution":{"observed_at":"2026-08-07T15:33:15.477595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:11.277092Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.277092Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:afe5dc2198fc7b5fb29d94ec2120219c8ea3868fb6d1bf9e42efba13320c639b","observation_id":"94c821a4-de10-4790-81ad-2d7123d4bd17","resolution":{"observed_at":"2026-08-07T15:33:11.277092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:15.197900Z","title":"Progressive distillation for fast sampling of diffusion models","venue":null,"work_id":"d594c0e5-6917-48b7-a67f-1a879f7a107f","year":2022},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.359332Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:9380488ba14436b9566ceb89e2252afd424c5b1101a977a44c52c0198350361b","observation_id":"6398b433-bfa5-4f43-8e83-f8eeeefeec59","resolution":{"observed_at":"2026-08-07T15:33:15.272853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:14.972526Z","title":"Post-training quantization on diffusion models","venue":null,"work_id":"494c7796-d367-4043-a52d-02c3432768f8","year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.455816Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:4c1bcb78748e4edcd13f530cd29496f70f7f1d6dbe48bf045c66027a6e91de36","observation_id":"321737fb-993e-48a6-a12b-32fbfd077602","resolution":{"observed_at":"2026-08-07T15:33:15.032194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14494","last_updated":"2025-09-02T18:15:39Z","snapshot_observed_at":"2026-08-20T06:25:24.766951Z","submitted_at":"2025-03-18T17:58:08Z","title":"Deeply Supervised Flow-Based Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14494","snapshot_observed_at":"2026-08-07T15:33:11.513331Z","title":"Deeply supervised flow-based generative models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.513331Z"},"links":{"cited_paper":"/paper/2503.14494","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:6019cdede9a8980c56b9882b175bd06550f1c9ab6b71d708d559c936f6990c7c","observation_id":"c24fecb9-67b7-4ab2-a03d-d5e391791211","resolution":{"observed_at":"2026-08-07T15:33:11.513331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-07T15:33:11.607502Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.607502Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:64bda4fb917fd5c2f1aa8825931df0ec574bd8e4ca9d5438e39c6c5dcd63aa43","observation_id":"19ff55c3-075f-45ca-bbf3-7053f4ce474c","resolution":{"observed_at":"2026-08-07T15:33:11.607502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:11.705712Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.705712Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:2e73970cb37fc09eec4e43073eb2732125611946d84299ab9d2fde3c70d0470f","observation_id":"5ab29220-e2f7-49e4-a5c8-71683cfec651","resolution":{"observed_at":"2026-08-07T15:33:11.705712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-07T15:33:11.772789Z","title":"Wan: Open and advanced large-scale video generative models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.772789Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:314cd24d41013c40daed30f2e1d3ba0d0ac0674d1f0df269691b21529a3db3a2","observation_id":"0a5d231c-f14c-4c32-ad4f-523e11f1d95d","resolution":{"observed_at":"2026-08-07T15:33:11.772789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:14.761783Z","title":"Axial- deeplab: Stand-alone axial-attention for panoptic segmentation","venue":null,"work_id":"0e11b184-eeb5-4bb5-a8ad-73f588219056","year":2020},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.883552Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:d5999826128207d57e71a076b62bd054506c6b5344c0a3f5cff6da13588f2575","observation_id":"335f927a-0a5c-4a67-a57f-1cefeef14486","resolution":{"observed_at":"2026-08-07T15:33:14.822785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-07T15:33:11.991320Z","title":"Linformer: Self-attention with linear complexity, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.991320Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:35c304a85858e6df52d0457bf9516ae05262714ec084d1110a4514b6383ec26b","observation_id":"38e89115-e881-4974-8c2e-638c6bcb5b66","resolution":{"observed_at":"2026-08-07T15:33:11.991320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01812","last_updated":"2024-02-05T09:21:28Z","snapshot_observed_at":"2026-08-18T12:39:33.186794Z","submitted_at":"2023-10-03T05:55:11Z","title":"PPT: Token Pruning and Pooling for Efficient Vision Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01812","snapshot_observed_at":"2026-08-07T15:33:12.123223Z","title":"Ppt: Token pruning and pooling for efficient vision transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.123223Z"},"links":{"cited_paper":"/paper/2310.01812","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:cb2e397b7e3edf2060364dbb25600d61d95075619ee1d8a6d6d85b7a5b64f93a","observation_id":"26888ff7-48f0-4f2b-a890-68aa6548ffe5","resolution":{"observed_at":"2026-08-07T15:33:12.123223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:14.557249Z","title":"Revealing the dark secrets of masked image modeling","venue":null,"work_id":"c4488e20-5a24-46ac-8518-a4561e949263","year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.199902Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:534cae8dea2bc1f59ea298c9a6b8c8083812f40d2879e0057c965d47a92c3491","observation_id":"7d171f7b-9679-4dd8-98b7-0f4657292cc7","resolution":{"observed_at":"2026-08-07T15:33:14.625332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:14.350817Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":"bf6f05f9-f229-4e61-9dfb-6adcb92f32c0","year":2023},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.267943Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:72a5c3863819c2758e1f7e7d76ef2c16d855f76b9be5bf5f4491f913d44f1b52","observation_id":"21e1b526-6c24-4eb8-9732-6fa63313b9fa","resolution":{"observed_at":"2026-08-07T15:33:14.439072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-13T11:19:19.475091Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18653","snapshot_observed_at":"2026-08-07T15:33:12.353042Z","title":"1.58-bit flux","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.353042Z"},"links":{"cited_paper":"/paper/2412.18653","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:3826fc2e084ac1f13e5e4be770fa80a754761e0fc1720b83cecc393f4d772932","observation_id":"20031a9d-1774-46c2-9f24-63e9b5f8b4bd","resolution":{"observed_at":"2026-08-07T15:33:12.353042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00776","last_updated":"2024-11-01T17:59:58Z","snapshot_observed_at":"2026-08-21T09:57:50.022950Z","submitted_at":"2024-11-01T17:59:58Z","title":"Randomized Autoregressive Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00776","snapshot_observed_at":"2026-08-07T15:33:12.464495Z","title":"Randomized autoregressive visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.464495Z"},"links":{"cited_paper":"/paper/2411.00776","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:564dec1721c0425aada80ec9e441ca462fdcc676f15c7bc4bfa685c4204fdb6c","observation_id":"5ca922d8-374f-4f87-84ea-6bbce513e84b","resolution":{"observed_at":"2026-08-07T15:33:12.464495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:14.096085Z","title":"An image is worth 32 tokens for reconstruction and generation","venue":null,"work_id":"53c2ece2-c156-4a06-a04d-10a05d53290e","year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.577214Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:1df237a940b597db4a2d227c72eb99b7be9a720c7743bb8b4cb2a750de572fdb","observation_id":"7620ea40-4ef0-47f6-b852-c29001f5d12e","resolution":{"observed_at":"2026-08-07T15:33:14.221647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:13.919699Z","title":"Ditfastattn: Attention compression for diffusion transformer models","venue":null,"work_id":"05c96af6-de87-4d3a-8201-ecc502c09eb0","year":2024},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.642624Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:c6a8276d8d26c452b9f0f1677c8eb9f6e27c3b67d8c08782db6c1d428de74859","observation_id":"57186a5d-b8a1-4890-9d3e-67454e39df8b","resolution":{"observed_at":"2026-08-07T15:33:14.001466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:13.775985Z","title":"Big bird: Transformers for longer sequences","venue":null,"work_id":"80b0bc71-7703-4e76-a924-964bc0be54a9","year":2020},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.738393Z"},"links":{"citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:1b9bf51221d0362bc0c331434f6f6ef34513525be05eae266c8dc75a646e1295","observation_id":"09a73369-39d8-4ca8-9def-216df835b5ed","resolution":{"observed_at":"2026-08-07T15:33:13.837906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04507","last_updated":"2025-06-04T23:21:39Z","snapshot_observed_at":"2026-08-17T20:33:39.027283Z","submitted_at":"2025-02-06T21:17:09Z","title":"Fast Video Generation with Sliding Tile Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04507","snapshot_observed_at":"2026-08-07T15:33:12.833852Z","title":"Hello GRAT","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:12.833852Z"},"links":{"cited_paper":"/paper/2502.04507","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:444e58758f1dc6dd2bca82f1bca6367f69c9e31d61344f227b3fb9139233d0b9","observation_id":"5f1ba8ba-8080-4e44-b3d1-2a3d53862c32","resolution":{"observed_at":"2026-08-07T15:33:12.833852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T14:08:52.059933Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 10 inbound Pith citation observations for arXiv:2505.14687."}