{"as_of":"2026-08-19T04:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1cb5af128750a8976142c96f2f5955b4448bf17ff7fa2f06aacede056d120ee2","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:13:23.656049Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.21292/citation-record","integrity":"/paper/2504.21292/integrity","json":"/paper/2504.21292/citation-record.json","paper":"/paper/2504.21292"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:25.902215Z","title":"Butterworth","venue":null,"work_id":"18dadfb4-f7b4-41a2-8787-e780b7a27889","year":1930},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.175746Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:6f94691edea94fe9002abcd8fe4ac702aaa067806e6ebdb7f8c761bdfabe96c6","observation_id":"43f91412-12f4-402c-b694-21aad15dec5f","resolution":{"observed_at":"2026-08-16T05:13:25.966795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02347","last_updated":"2024-12-18T10:45:06Z","snapshot_observed_at":"2026-08-16T13:46:16.128088Z","submitted_at":"2024-06-04T14:23:27Z","title":"Flash Diffusion: Accelerating Any Conditional Diffusion Model for Few Steps Image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02347","snapshot_observed_at":"2026-08-16T05:13:23.186771Z","title":"Flash diffusion: Accelerating any conditional diffusion model for few steps image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.186771Z"},"links":{"cited_paper":"/paper/2406.02347","citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:19ac7e602cc9a0c084c37a806af34a22e3061df8f0e30a154e859878dc422646","observation_id":"e7d4d3cd-aa4a-4d6e-911a-ec62119f8453","resolution":{"observed_at":"2026-08-16T05:13:23.186771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:25.888994Z","title":"Pixart-Σ: Weak-to-strong training of diffusion transformer for 4k text-to-image generation","venue":null,"work_id":"e36c3713-a48d-416e-97ad-668a09028bc8","year":2024},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.191134Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:8cb90a68c921c831a6a449b1943501e9cee731ca4b02080998b54e1b72c3966e","observation_id":"220a54da-d045-4b39-bcaa-13504f7f157c","resolution":{"observed_at":"2026-08-16T05:13:25.893786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:25.875613Z","title":"Simple baselines for image restoration","venue":null,"work_id":"3f7b7c81-6a72-4148-abfe-9a8bd73cc010","year":2022},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.195286Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:f50e98b30294ff488611e30bf24d6f30978d6f536d9e3e9a6c5545fcc67ea919","observation_id":"169f7757-9882-407c-b96c-0bd968dab5b0","resolution":{"observed_at":"2026-08-16T05:13:25.881518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16821","last_updated":"2024-04-29T20:24:30Z","snapshot_observed_at":"2026-08-17T14:16:52.244007Z","submitted_at":"2024-04-25T17:59:19Z","title":"How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16821","snapshot_observed_at":"2026-08-16T05:13:23.201201Z","title":"How far are we to gpt-4v? closing the gap to commercial multimodal models with open-source suites","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.201201Z"},"links":{"cited_paper":"/paper/2404.16821","citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:0129a601103a1eb72af83f42b53b2d30c80e81ab785950ab8bf79c170a806726","observation_id":"440b074c-1963-43e2-8844-b4f6b1ab1a7f","resolution":{"observed_at":"2026-08-16T05:13:23.201201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:25.775456Z","title":"Rifegan: Rich feature generation for text-to-image synthesis from prior knowledge","venue":null,"work_id":"2ea62ee1-49b4-4d8e-bb23-2b052500bc6c","year":2020},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.205603Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:adfc0ec29ddf83facd2526565e59c98dfe59bc1405c3fd691b8f44d4e0e2383e","observation_id":"8ecd76a3-1904-4344-9473-7ae4d76bd0b5","resolution":{"observed_at":"2026-08-16T05:13:25.826809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:25.762282Z","title":"Kaplan, and Enrico Shippole","venue":null,"work_id":"2d406df6-e5e5-4d70-8501-a87c367082b8","year":2024},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.209601Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:9756bfe5e804b25cb7686f5d3aa16bf6f4797eb5637c4ddc0bf832b237774055","observation_id":"9e648e70-1a8d-44ae-82f3-57e171ad2ce1","resolution":{"observed_at":"2026-08-16T05:13:25.766066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:25.647508Z","title":"Transformers are ssms: Generalized models and efficient algorithms through structured state space duality","venue":null,"work_id":"ac6ef2a9-8ec1-43ee-89ab-77f4bf0abcef","year":null},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.214499Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:b11220efeff6971ce40a254929eb6ce2f474db3a83f94a8ccfbf49ca583be4c3","observation_id":"e65840dc-93dc-4a1b-9366-1da507335c6a","resolution":{"observed_at":"2026-08-16T05:13:25.753001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:25.483879Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"cc1aa036-c377-4db4-8378-ab1d5bea4cd7","year":2021},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.218081Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:d009f30f530deee2500f28a10ad695e8cf8d85a547253c00ccf42e7b107fb8c3","observation_id":"3477e814-f06d-4785-829d-e2b3f3615f3c","resolution":{"observed_at":"2026-08-16T05:13:25.488215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-08-17T20:47:46.242385Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-16T05:13:23.222435Z","title":"Mamba: Linear-time sequence model- ing with selective state spaces","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.222435Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:6249bffd2fff5fc1b497464578b6cb9bade7f52f05099e3f3d1ec1628063e724","observation_id":"7f555d8b-8d37-4321-95c9-af2e28228302","resolution":{"observed_at":"2026-08-16T05:13:23.222435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:25.471132Z","title":"Efficient diffu- sion training via min-snr weighting strategy","venue":null,"work_id":"4d7e868e-6616-4156-80b5-b09fb5a5a944","year":2023},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.253133Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:f24821661618ed424af4a4cdc62faede6b97f6635ecc85fbc5cf5d4780ddd7e9","observation_id":"dc921f8e-2e7f-4f71-96c6-c1639c4f77c4","resolution":{"observed_at":"2026-08-16T05:13:25.476244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:25.308589Z","title":"Neighborhood attention transformer","venue":null,"work_id":"a89da4a1-976f-4a3d-b12b-aab48a417635","year":2023},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.295471Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:b9c664b8b48e16cb857f0b6e92f412936dfe5a094dd53d71cece97cf5ba9d4e0","observation_id":"9128077e-87c4-4fbd-84c8-1b3d9b7bab7d","resolution":{"observed_at":"2026-08-16T05:13:25.357697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:23.316049Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.316049Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:ff450a2a34834f0bf1add633522e945789f5f44faf1409646d583ae834f91079","observation_id":"0e58f682-61d2-46eb-86ce-b6238bac75e0","resolution":{"observed_at":"2026-08-16T05:13:23.316049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:25.288792Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":"f2985917-6b63-4698-a5c9-d63aeb497b75","year":2020},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.319834Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:af48fbe4e49c9ff4ad4bd1baf6a85e6cef656d6c8cee171c3c08645045267326","observation_id":"b893b62c-f6a4-4858-a5d3-6ea4f831a3bd","resolution":{"observed_at":"2026-08-16T05:13:25.292563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:25.196913Z","title":"Alias-free generative adversarial networks","venue":null,"work_id":"de5d6643-89f1-40fe-9fc1-5b22c78f2fc7","year":2021},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.323490Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:a1c90309701b1c9b40b1d58b8a8cc1ef6286f973e105ee8696bfd47b0ea258e1","observation_id":"276fecd5-2493-48d6-8fef-42d232e4358d","resolution":{"observed_at":"2026-08-16T05:13:25.234747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:25.184840Z","title":"Elucidating the design space of diffusion-based generative models","venue":null,"work_id":"e1c7ca84-63e7-4251-b8e3-3288de3fac20","year":2022},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.327206Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:e8996cc2f99dedc882d6e67d167dc5d81f09397f71de102be0f4adeffa22c522","observation_id":"dc756dc6-b5a3-493c-b60f-4c5aff047ddb","resolution":{"observed_at":"2026-08-16T05:13:25.188853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:25.173718Z","title":"Analyzing and improving the training dynamics of diffusion models","venue":null,"work_id":"5f0dedeb-7915-4971-afa5-8e851c5bd78d","year":2024},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.331790Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:44232bf77a678ec3ed75775709846245f787395bf6feee2523bff891eaf3cdd4","observation_id":"0df50b9b-cae6-40b6-abb7-9f8afa36dd61","resolution":{"observed_at":"2026-08-16T05:13:25.177483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:25.058695Z","title":null,"venue":null,"work_id":"c67eac5a-f176-4c61-813c-b513be17b860","year":2024},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.335657Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:b45468cfcb073fbe55e683f13946c7f1f341dea84348e925b050c5f89d087e18","observation_id":"c1d3fd5d-3da1-48e3-b490-3f3eba1f5e13","resolution":{"observed_at":"2026-08-16T05:13:25.165990Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.986326Z","title":null,"venue":null,"work_id":"f52089ea-b451-45bf-aa22-ff5cfeb5db2d","year":2019},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.338982Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:46b883f09eab5c76a8efa1a641bc509e6230a543dd4cef33ad90a2426467f70a","observation_id":"ed7de0cd-bf6a-4282-b846-6cf3b8ffe322","resolution":{"observed_at":"2026-08-16T05:13:24.990278Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02747","last_updated":"2025-02-26T10:49:33Z","snapshot_observed_at":"2026-08-16T14:03:56.951368Z","submitted_at":"2024-04-03T13:44:41Z","title":"Faster Diffusion via Temporal Attention Decomposition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02747","snapshot_observed_at":"2026-08-16T05:13:23.342919Z","title":"Faster diffu- sion via temporal attention decomposition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.342919Z"},"links":{"cited_paper":"/paper/2404.02747","citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:b8574a158a0d5e74a7f0806813149ba14f8f81fce0247a0ed630882a5ddea48d","observation_id":"2a2049d4-7da3-4801-a954-26c1e83f79c0","resolution":{"observed_at":"2026-08-16T05:13:23.342919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","snapshot_observed_at":"2026-08-18T07:06:04.890772Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02097","snapshot_observed_at":"2026-08-16T05:13:23.346402Z","title":"Linfusion: 1 gpu, 1 minute, 16k image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.346402Z"},"links":{"cited_paper":"/paper/2409.02097","citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:095681f8c8fc61b1cd560ef76fffa4f5d9c884464dc2bcebe73012e57cc04e71","observation_id":"1ce73f91-59b4-402d-b201-ec65c663fcb5","resolution":{"observed_at":"2026-08-16T05:13:23.346402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.05744","last_updated":"2022-12-05T15:37:39Z","snapshot_observed_at":"2026-08-16T17:35:32.144393Z","submitted_at":"2021-12-10T18:55:50Z","title":"More Control for Free! Image Synthesis with Semantic Diffusion Guidance","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.05744","snapshot_observed_at":"2026-08-16T05:13:23.400547Z","title":"More control for free! image synthesis with semantic diffusion guidance","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.400547Z"},"links":{"cited_paper":"/paper/2112.05744","citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:d08cedc1f6ef49a954b717de7b025751401ebd597491d2aa5ad9e0a36ba4d794","observation_id":"01f18ee4-3953-4363-bca3-0481593350fc","resolution":{"observed_at":"2026-08-16T05:13:23.400547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.971505Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"73283c52-667a-4de5-abac-5f46d50aa9d4","year":2021},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.443728Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:7ad5eb8819aa05b743460b2e370f8fe10abfb5998685a4683810c177b3ad034e","observation_id":"92f33a93-d365-4541-8bdb-b352ccbbbc7f","resolution":{"observed_at":"2026-08-16T05:13:24.977269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:23.467486Z","title":"Token caching for diffusion transformer acceleration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.467486Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:7e4637116a4518faa21c9089526dbb83a88026e279ffe7ebaa7e978ca04ce41b","observation_id":"802b7057-62c9-4fdc-9369-eaf4b656c76c","resolution":{"observed_at":"2026-08-16T05:13:23.467486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01095","last_updated":"2025-05-19T07:56:56Z","snapshot_observed_at":"2026-08-18T13:49:48.200480Z","submitted_at":"2022-11-02T13:14:30Z","title":"DPM-Solver++: Fast Solver for Guided Sampling of Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01095","snapshot_observed_at":"2026-08-16T05:13:23.478064Z","title":"Dpm-solver++: Fast solver for guided sampling of diffusion probabilistic models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.478064Z"},"links":{"cited_paper":"/paper/2211.01095","citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:5d78ec48f630a9bb109f4d5d48c252dad22e1795085f5e967ff51b3daf601942","observation_id":"7197f8be-b6cb-47d8-b49d-0f910cb3ef38","resolution":{"observed_at":"2026-08-16T05:13:23.478064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.803213Z","title":"Understanding the effective receptive field in deep convolu- tional neural networks","venue":null,"work_id":"1c3c7141-dda4-44a1-8235-4fda5fc02349","year":2016},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.483044Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:53f5200e738577f5adb490c4a1f0f63296ddd41f032545fa6603a30f77eef14c","observation_id":"313f2e72-1254-4b13-b288-9f7b931c9127","resolution":{"observed_at":"2026-08-16T05:13:24.909520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.792352Z","title":"Kingma, Stefano Ermon, Jonathan Ho, and Tim Salimans","venue":null,"work_id":"219c86e1-65f8-4343-a6a7-092126e2726f","year":2023},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.486050Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:9aa35c00ea8af054067ecd32bce7364e116d238cda9ceee0a78a8564b899e5c6","observation_id":"3f35b6bf-8c54-48d5-a74c-a2a3273b5b27","resolution":{"observed_at":"2026-08-16T05:13:24.796516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.779548Z","title":"GLIDE: towards photorealistic image gen- eration and editing with text-guided diffusion models","venue":null,"work_id":"29064b18-e6c7-4408-9565-b9a4b72d5413","year":2022},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.489064Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:2cb1e514cfe381e0c227f9b3b7a044c4ad284648749790a2712ade7265d02140","observation_id":"0c64192b-3673-4ed4-b1b7-c66a021043c2","resolution":{"observed_at":"2026-08-16T05:13:24.783837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.618026Z","title":null,"venue":null,"work_id":"629a3517-6391-4eb5-ac9e-fff547f26713","year":2024},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.492387Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:894996bca238ad37dc9707b2cf801b7552165619abc1b3edd2abdfedd626953d","observation_id":"e388da6e-fc73-4bbc-ab5e-6d73dff89b34","resolution":{"observed_at":"2026-08-16T05:13:24.698053Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.606991Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"21ac7078-dbc1-4eb3-a7e0-a9af75faadb3","year":2023},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.495465Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:b281ffd4a16395754e734e154210f21a5fda002877174c1674e1c49545ce2f75","observation_id":"040c90cb-ab5f-4c65-adbb-043919e320f1","resolution":{"observed_at":"2026-08-16T05:13:24.610380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-16T05:13:23.498577Z","title":"SDXL: improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.498577Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:b663c769c1198136af9adc00fabca53d98f070434d4c65e04daec3cc6162c4a2","observation_id":"1f5361bb-6d0f-4b23-9c71-7a5fe37ed309","resolution":{"observed_at":"2026-08-16T05:13:23.498577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.529512Z","title":"Proakis and Dimitris G","venue":null,"work_id":"9d97e47b-b23e-45cb-937a-223eb816deb4","year":1996},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.501853Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:9769f52939b6dd117c26ca932b579b2fd2f035b8ce986631efdc78a71b9d15aa","observation_id":"e177a634-6f2c-4dd4-91ea-a04dbae4060b","resolution":{"observed_at":"2026-08-16T05:13:24.599543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.467624Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"be85eb98-d402-436a-9a83-51537d63bff9","year":2022},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.505803Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:3dc12de6c7566e2e759b5a361ba3c84f86bc829db931c54ed11d0913370f030c","observation_id":"4ada7950-00d7-4029-86d5-61379ccc04e1","resolution":{"observed_at":"2026-08-16T05:13:24.471349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.456738Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":"d50ecec1-ebcb-4135-92d0-cca57beb8c95","year":2015},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.510755Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:93bc4814fdf840d8fd391ab34d023fceac5a1da0e988cc5ed068731ffc5eabbc","observation_id":"7d6c679d-5c39-44c9-90d8-a29cd4d030c9","resolution":{"observed_at":"2026-08-16T05:13:24.460101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11487","last_updated":"2022-05-23T17:42:53Z","snapshot_observed_at":"2026-08-17T05:51:02.087480Z","submitted_at":"2022-05-23T17:42:53Z","title":"Photorealistic Text-to-Image Diffusion Models with Deep Language Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11487","snapshot_observed_at":"2026-08-16T05:13:23.516270Z","title":"Sara Mahdavi, Rapha Gontijo Lopes, Tim Salimans, Jonathan Ho, David J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.516270Z"},"links":{"cited_paper":"/paper/2205.11487","citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:8d52941effc43ab14a5fdf2721733be4420c2c6d48acae6ad8ebf1bc21674af5","observation_id":"cb1efbf7-1a4d-4add-8d42-1bac940b4e41","resolution":{"observed_at":"2026-08-16T05:13:23.516270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.437937Z","title":"Stylegan-t: Unlocking the power of gans for fast large-scale text-to-image synthesis","venue":null,"work_id":"52f2922f-a6e5-41e3-b60f-37a14041d01d","year":2023},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.536075Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:4f7d26df265b577454db3f9482aee65f78f6837c4f8f37d202967ca0e6367a37","observation_id":"0402eedd-cd4d-4700-bfb4-7ab1194bf52a","resolution":{"observed_at":"2026-08-16T05:13:24.448438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.390060Z","title":"Laion-5b: A large-scale dataset for training ai models","venue":null,"work_id":"d972a49a-8b81-4dc9-8527-699f87385e7a","year":2022},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.569300Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:ac12cbb3f22019f6e7dfe75a6fc70c1fc3b668785322a2e66df7d5aa9a8e9dca","observation_id":"5316c712-2f78-461b-a5b7-49061dc37d3e","resolution":{"observed_at":"2026-08-16T05:13:24.409166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01425","last_updated":"2024-07-01T16:14:37Z","snapshot_observed_at":"2026-08-16T13:38:03.111467Z","submitted_at":"2024-07-01T16:14:37Z","title":"FORA: Fast-Forward Caching in Diffusion Transformer Acceleration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01425","snapshot_observed_at":"2026-08-16T05:13:23.602018Z","title":"Fora: Fast-forward caching in diffusion transformer acceleration","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.602018Z"},"links":{"cited_paper":"/paper/2407.01425","citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:8abdd52553a6033e23127cb4280e98487c306a49e437009f6928a73ccc2cabc7","observation_id":"aceb1237-0934-4799-880e-361589e470fe","resolution":{"observed_at":"2026-08-16T05:13:23.602018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.380009Z","title":"Denoising diffusion implicit models","venue":null,"work_id":"ff3a4aef-9c64-48dd-86ea-4e969568e3fa","year":2021},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.623244Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:06fc8dd2a5fcdcedafa695b4e1a3d87769a7ab8e7c12a347f726a66c9c0be8d3","observation_id":"06d5847f-c57a-4677-a417-f2782a359fe2","resolution":{"observed_at":"2026-08-16T05:13:24.383639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.368744Z","title":"Kingma, Ab- hishek Kumar, Stefano Ermon, and Ben Poole","venue":null,"work_id":"b8d6f969-11ee-40ea-9367-5a381ae890d9","year":null},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.627787Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:bef44eb9a2685eed1d2dd47fdfc7406e18805e3110bd7fd61abd86749224131b","observation_id":"4d3724bb-943a-4a00-a707-cbcc5c8072b7","resolution":{"observed_at":"2026-08-16T05:13:24.373164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.343968Z","title":"Expos- ing flaws of generative model evaluation metrics and their unfair treatment of diffusion models","venue":null,"work_id":"f41ef806-24e0-4cb2-9de3-177d0b0ee39a","year":2023},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.632240Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:482339081d13d1db59bea20850edd57024f3953899f84caeb779e7002cd7fdd9","observation_id":"fadae87b-05bb-47df-b0bc-1a559cbd99cf","resolution":{"observed_at":"2026-08-16T05:13:24.360969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.281807Z","title":"Rethinking the incep- tion architecture for computer vision","venue":null,"work_id":"3c139be1-d3d7-4244-9ee6-e3c791e80ed0","year":null},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.636363Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:8b5b4e87560ac1dd75fbb1734b54c9871bc97bb64f7b2e4b9946d8b1d96492d0","observation_id":"28217a4f-e2fc-4163-a21f-bae3f5197bd8","resolution":{"observed_at":"2026-08-16T05:13:24.297407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.270788Z","title":"text2image-multi-prompt: A multi-prompt dataset for text-to-image generation","venue":null,"work_id":"4d1a2d11-36a9-4a3b-b939-ebf282ec4fc9","year":2023},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.640562Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:cc11918c51fec0edc56a3e1e80a9bb2c7ab9e224ef5f5a7bcdd89142f7c57f22","observation_id":"8a4571b2-d12c-44a4-a198-c91a29bdb008","resolution":{"observed_at":"2026-08-16T05:13:24.274251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.110087Z","title":"Attention is all you need","venue":null,"work_id":"8c2f81c0-6826-4241-b393-c984341d583c","year":2017},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.644724Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:9f6d5a656d6cc828650651918a4bc0400f3124fc41e91454d74bd8e601a469dc","observation_id":"b0c7b602-70d8-4380-82dd-ab6acfa35708","resolution":{"observed_at":"2026-08-16T05:13:24.192012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:24.100113Z","title":"midjourney-v5-202304-clean","venue":null,"work_id":"31987792-00c1-4898-afa0-9c6ed3909a5b","year":2023},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.651842Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:a6febd557d6b86ac9f19e042c8b8443af280ec2389b740ed8da9c07b7fef7c28","observation_id":"dfeb0648-83c3-4146-9757-7b50c9b77d56","resolution":{"observed_at":"2026-08-16T05:13:24.103327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:13:23.989933Z","title":"Ditfastattn: Attention compression for diffusion transformer models","venue":null,"work_id":"3da1261b-0ff1-4467-9396-406afdd41c55","year":2024},"citing_paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T05:13:23.656049Z"},"links":{"citing_paper":"/paper/2504.21292"},"observation_digest":"sha256:3b478eb3b1b9068f689ff733c1f456f154da56619f65c1a6021aa7403987c878","observation_id":"c6cdd0fa-bf29-46d7-8663-a87e6a4ae62c","resolution":{"observed_at":"2026-08-16T05:13:24.091649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.21292","last_updated":"2025-04-30T03:57:28Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T07:06:14.849854Z","submitted_at":"2025-04-30T03:57:28Z","title":"Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":31},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2504.21292."}