{"as_of":"2026-08-20T02:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c48cb68e35da983b6d91bbe3aff1176ba5c2bae66c470795443124f12362220b","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:44:38.640196Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.18999/citation-record","integrity":"/paper/2506.18999/integrity","json":"/paper/2506.18999/citation-record.json","paper":"/paper/2506.18999"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.244209Z","title":"One transformer fits all distributions in multi-modal diffu- sion at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.244209Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:c4cff543b5eaaa793e50c9453aca979aa57882ceac67e3103c02ea94ab05845b","observation_id":"d10ad56f-20b7-48a6-a764-320b0d3a0827","resolution":{"observed_at":"2026-08-15T18:44:38.244209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.248738Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.248738Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:caca59093a21d9b9615a0b77f378ce9496ab2df48e74bf29f57d321547516c3f","observation_id":"09a858a8-8f64-4761-9fd5-8e7dde54312f","resolution":{"observed_at":"2026-08-15T18:44:38.248738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.590982Z","title":"Cross-layer distillation with semantic calibration","venue":null,"work_id":"c3c27c20-d363-444f-b75a-7c7febc65703","year":2021},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.252859Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:d9a25ab68db975394820ef378c8af5c5d5727fe277537aea4ba14aa4505e5e72","observation_id":"31d9c724-e7d2-4888-b5e6-3527f0243779","resolution":{"observed_at":"2026-08-15T18:44:39.596917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-15T18:44:38.257309Z","title":"Pixart-alpha: Fast training of diffusion transformer for photorealistic text-to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.257309Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:985a7d2a34e4b0a17cd3f1cda6da71a9dd892350d9728836ab177052f39b95fc","observation_id":"0795c075-9350-4a2d-84df-096bb9a07aab","resolution":{"observed_at":"2026-08-15T18:44:38.257309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04692","last_updated":"2024-03-17T16:59:25Z","snapshot_observed_at":"2026-08-16T14:11:52.899972Z","submitted_at":"2024-03-07T17:41:37Z","title":"PixArt-\\Sigma: Weak-to-Strong Training of Diffusion Transformer for 4K Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04692","snapshot_observed_at":"2026-08-15T18:44:38.263438Z","title":"Pixart-\\sigma: Weak-to-strong training of diffusion transformer for 4k text-to-image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.263438Z"},"links":{"cited_paper":"/paper/2403.04692","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:ad0c0e9b83e09ca32cb128b2f815c1369df35ffbc007ce8e03fd229553735d22","observation_id":"4cd509fc-59fd-4137-bc8a-10d09c3bac0d","resolution":{"observed_at":"2026-08-15T18:44:38.263438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04557","last_updated":"2024-06-02T09:30:39Z","snapshot_observed_at":"2026-08-16T14:36:43.703222Z","submitted_at":"2023-12-07T18:59:30Z","title":"GenTron: Diffusion Transformers for Image and Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04557","snapshot_observed_at":"2026-08-15T18:44:38.268537Z","title":"Gentron: Delving deep into dif- fusion transformers for image and video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.268537Z"},"links":{"cited_paper":"/paper/2312.04557","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:55c1be475c133eb9a810146e6617ac1d4a5ddebddc57e72e2f61b313a9fea7d0","observation_id":"4a5bc4b1-3be9-4021-b6de-9bb55c260087","resolution":{"observed_at":"2026-08-15T18:44:38.268537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.574421Z","title":"Pali- x: On scaling up a multilingual vision and language model,","venue":null,"work_id":"adcc11dd-32cf-483c-8b47-f600c5b88d09","year":null},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.273632Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:635ea946cc8a10810a000d383fc51afddd0149ce2fcff2544360fb4bf4b68bd4","observation_id":"147d0c0c-0ab1-464f-b761-ef836b300ec1","resolution":{"observed_at":"2026-08-15T18:44:39.579506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.278080Z","title":"Scaling instruction- finetuned language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.278080Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:41e7e328557d564a6cc2467ab60c49e50fe6ae05687ac4a1c945892806146e84","observation_id":"341c1bcb-733c-42d5-819e-2ac44649f85f","resolution":{"observed_at":"2026-08-15T18:44:38.278080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21060","last_updated":"2024-05-31T17:50:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:50:01Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21060","snapshot_observed_at":"2026-08-15T18:44:38.283159Z","title":"Transformers are ssms: General- ized models and efficient algorithms through structured state space duality","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.283159Z"},"links":{"cited_paper":"/paper/2405.21060","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:9ffc6bf7ed0ff604510500b6bc721959bc6242541602dc281107fb2576ce0c90","observation_id":"946e96b4-d2b9-4816-8b86-0b4ee721010e","resolution":{"observed_at":"2026-08-15T18:44:38.283159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.288396Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.288396Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:a97d7b0baa9b5a7e3256f90cf8148626781086a3d7edd459cf5f3f137fd23a73","observation_id":"5950ab43-4f0c-4b5f-82f3-b0bae9ecd54c","resolution":{"observed_at":"2026-08-15T18:44:38.288396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01159","last_updated":"2024-06-03T09:51:59Z","snapshot_observed_at":"2026-08-16T13:46:49.329986Z","submitted_at":"2024-06-03T09:51:59Z","title":"Dimba: Transformer-Mamba Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01159","snapshot_observed_at":"2026-08-15T18:44:38.293601Z","title":"Dimba: Transformer- mamba diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.293601Z"},"links":{"cited_paper":"/paper/2406.01159","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:5f07d1b97c8581b23e01878c4e958bef8fe26df453ce0013dbd2712820e45153","observation_id":"6d78aac6-9b54-4603-a200-bc9e79211c33","resolution":{"observed_at":"2026-08-15T18:44:38.293601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.14052","last_updated":"2023-04-29T03:18:40Z","snapshot_observed_at":"2026-08-18T19:17:21.619873Z","submitted_at":"2022-12-28T17:56:03Z","title":"Hungry Hungry Hippos: Towards Language Modeling with State Space Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.14052","snapshot_observed_at":"2026-08-15T18:44:38.298754Z","title":"Hungry hungry hippos: To- wards language modeling with state space models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.298754Z"},"links":{"cited_paper":"/paper/2212.14052","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:f5f4c38dc115f7899922cb2cdc71b2653e8066f87889cb4b82eea2b17ed5c72f","observation_id":"15df9e22-72b3-49d4-9268-55124b7c0db0","resolution":{"observed_at":"2026-08-15T18:44:38.298754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.538743Z","title":"Simple hardware-efficient long convolutions for se- quence modeling","venue":null,"work_id":"182cc680-5a62-4953-9d57-aaa66918a230","year":2023},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.303637Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:9816208224febae5e64fb482e9a5dccdf16d6a0b78d2e3f35c4c14cccbe18eae","observation_id":"1a49452b-03d6-4f0c-8385-104e2a62d911","resolution":{"observed_at":"2026-08-15T18:44:39.542856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05945","last_updated":"2024-06-13T11:13:39Z","snapshot_observed_at":"2026-08-16T13:53:57.994391Z","submitted_at":"2024-05-09T17:35:16Z","title":"Lumina-T2X: Transforming Text into Any Modality, Resolution, and Duration via Flow-based Large Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05945","snapshot_observed_at":"2026-08-15T18:44:38.319824Z","title":"Lumina-t2x: Trans- forming text into any modality, resolution, and duration via flow-based large diffusion transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.319824Z"},"links":{"cited_paper":"/paper/2405.05945","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:da2e21ba6021a9289b611b6f78b29f1f52ab4f87890fbfe5686988acd24d319b","observation_id":"ab2614db-bee4-43c3-946a-a1eb435a82ed","resolution":{"observed_at":"2026-08-15T18:44:38.319824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.525447Z","title":"Masked diffusion transformer is a strong image synthesizer, 2023","venue":null,"work_id":"5fe92f34-71ec-43c5-8c65-a6f36adc57e1","year":2023},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.329819Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:5f1b496de960d070908028d5da748fce08789ce68bfa122c096d02bf11b56f1f","observation_id":"65e47fa5-09ca-446b-b439-b44675af7668","resolution":{"observed_at":"2026-08-15T18:44:39.529796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03025","last_updated":"2024-05-10T08:30:07Z","snapshot_observed_at":"2026-08-19T20:15:19.917647Z","submitted_at":"2024-05-05T18:36:45Z","title":"Matten: Video Generation with Mamba-Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03025","snapshot_observed_at":"2026-08-15T18:44:38.335567Z","title":"Matten: Video generation with mamba- attention","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.335567Z"},"links":{"cited_paper":"/paper/2405.03025","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:79b8dcac1e9001249381721e033c2c7b2c29433b095b31a94d9bda959eeba950","observation_id":"d61578d8-2746-49da-bc12-4cdbbab43d84","resolution":{"observed_at":"2026-08-15T18:44:38.335567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.342764Z","title":"Geneval: An object-focused framework for evaluating text- to-image alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.342764Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:cd7394305a563797200879e4d28d05e611897ef6022f8ab4b82ea249670b03a5","observation_id":"301ce75d-3a4c-4458-bf22-4f6f12293ef1","resolution":{"observed_at":"2026-08-15T18:44:38.342764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.347851Z","title":"Knowledge distillation: A survey","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.347851Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:bf4556185abb81c902f5eb80c3049360b68f8520e098be918dd22756138316c0","observation_id":"bf81d307-958b-4d01-9d8f-9574fc40bf0e","resolution":{"observed_at":"2026-08-15T18:44:38.347851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-08-17T20:47:46.242385Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-15T18:44:38.353748Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.353748Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:8d87b28b46f2bcf1edf5010058121df99e779bb7de7e9a76238533847fba67ce","observation_id":"c0bca4ce-6a51-431f-906c-3cc25973fd6d","resolution":{"observed_at":"2026-08-15T18:44:38.353748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00396","last_updated":"2022-08-05T17:54:38Z","snapshot_observed_at":"2026-08-14T01:02:41.198730Z","submitted_at":"2021-10-31T03:32:18Z","title":"Efficiently Modeling Long Sequences with Structured State Spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00396","snapshot_observed_at":"2026-08-15T18:44:38.359214Z","title":"Efficiently modeling long sequences with structured state spaces","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.359214Z"},"links":{"cited_paper":"/paper/2111.00396","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:8abe04d8b26babcc70c7b7af435c740d111e8a6798c0e5b61b0cf2da417e1cde","observation_id":"b43007ff-3101-42fd-96b9-ea668f4a4209","resolution":{"observed_at":"2026-08-15T18:44:38.359214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.486177Z","title":"State-space models","venue":null,"work_id":"ca7ef390-9d9d-47a7-abca-ff5669c62acb","year":1994},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.364064Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:8e9b389f5acc326f8d05f91dd2dbcfa9439db3fa261bf77a0eac471126048c90","observation_id":"bc281e77-22ee-4749-8add-1b4933f74c61","resolution":{"observed_at":"2026-08-15T18:44:39.491806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.368519Z","title":"A comprehensive overhaul of feature distillation","venue":null,"work_id":null,"year":1921},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.368519Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:5f4c663648b1cdd04cf189339892ccebc12b9052fcb9df3ed790e8a2ae5843ca","observation_id":"a63b7b23-ada5-40b5-86c9-66b50b6bf0eb","resolution":{"observed_at":"2026-08-15T18:44:38.368519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.373561Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.373561Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:c3cd0a5b08bedd65d4a5801c23e5d1d607893b772fd74e956abcfd7176462b19","observation_id":"0a0fadcb-dbf6-4587-a785-19042dd231b7","resolution":{"observed_at":"2026-08-15T18:44:38.373561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-15T18:44:38.378761Z","title":"Distill- ing the knowledge in a neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.378761Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:ca63bdb91c5fd385f33def4d2c0293c5c85046c0419be8a18708928651482231","observation_id":"6d989004-e9d9-4cb5-a8e4-1c3f52c149f4","resolution":{"observed_at":"2026-08-15T18:44:38.378761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.383904Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.383904Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:656783f276d9f59d309cd8ed2cd841caa1dad1515edbd7c6ef6f7b953982241b","observation_id":"31cf9810-b172-4541-bf61-91b188080cdc","resolution":{"observed_at":"2026-08-15T18:44:38.383904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15282","last_updated":"2021-12-17T17:21:04Z","snapshot_observed_at":"2026-08-16T19:20:27.997234Z","submitted_at":"2021-05-30T17:14:52Z","title":"Cascaded Diffusion Models for High Fidelity Image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.15282","snapshot_observed_at":"2026-08-15T18:44:38.389809Z","title":"Cascaded diffusion models for high fidelity image generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.389809Z"},"links":{"cited_paper":"/paper/2106.15282","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:6c60a5138d9487988de7f589446cec94199ec7ba8a74c0c3991ce93c641d0894","observation_id":"83c57675-00da-496f-b7b6-9335cbfbf50c","resolution":{"observed_at":"2026-08-15T18:44:38.389809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13802","last_updated":"2024-11-24T14:25:05Z","snapshot_observed_at":"2026-08-16T14:07:56.307721Z","submitted_at":"2024-03-20T17:59:14Z","title":"ZigMa: A DiT-style Zigzag Mamba Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13802","snapshot_observed_at":"2026-08-15T18:44:38.394734Z","title":"Zigma: Zigzag mamba diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.394734Z"},"links":{"cited_paper":"/paper/2403.13802","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:883dc8932a08d781e372cf07dcfffa898c945bb9fcbe009422c6c2fccc8e0427","observation_id":"da1d3a86-7009-4bfb-bf4a-40f113b33b4e","resolution":{"observed_at":"2026-08-15T18:44:38.394734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19832","last_updated":"2024-08-21T09:52:52Z","snapshot_observed_at":"2026-08-19T06:43:08.651988Z","submitted_at":"2024-07-29T09:38:15Z","title":"ML-Mamba: Efficient Multi-Modal Large Language Model Utilizing Mamba-2","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19832","snapshot_observed_at":"2026-08-15T18:44:38.400868Z","title":"Ml-mamba: Efficient multi-modal large language model utilizing mamba-2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.400868Z"},"links":{"cited_paper":"/paper/2407.19832","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:22f3a83a9902fa5799317e37a103664e2ff64b459be9371ad094e4b169ad4477","observation_id":"f5b6912c-5699-435d-a371-b220005b93d5","resolution":{"observed_at":"2026-08-15T18:44:38.400868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.439405Z","title":"Efficient movie scene detection using state-space transformers","venue":null,"work_id":"1d538926-ec39-4680-b980-61eb6898d03c","year":2023},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.405564Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:8f61c550e12f11eb928ed136730272770b56ad54ba5995639ea7453f35011101","observation_id":"31c033a1-5df6-4128-95ee-b9a17438f7e6","resolution":{"observed_at":"2026-08-15T18:44:39.446412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.424863Z","title":"Just chop: Em- barrassingly simple llm compression, 2024","venue":null,"work_id":"25ac4359-ca24-449f-bd47-32e469fd2316","year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.412866Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:4865d5d84858d0b5213fe04e8824f79fdd336e04a95988e759fce5658de5e261","observation_id":"5cd7fef6-4347-4687-a45c-6bf2bf02f725","resolution":{"observed_at":"2026-08-15T18:44:39.429202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.408100Z","title":"Knowledge dis- tillation via route constrained optimization","venue":null,"work_id":"37b3fa83-4b6f-4ba5-b645-322ee4e45df6","year":2019},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.418824Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:7a6b998b78c46ce24223269401b0954b89483dda5b7d1a40ac9cd95592150c9d","observation_id":"2e4e52f8-a50e-4dcf-9a29-10977337d0d3","resolution":{"observed_at":"2026-08-15T18:44:39.413940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.393217Z","title":null,"venue":null,"work_id":"b8236048-e972-4599-a67e-8ff9c77ff86e","year":2021},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.426018Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:0cece3b81a6e5a7772afbde0990139ebfafe3a3293e060fbe2b46d418f4b63ac","observation_id":"e30ada65-2aad-4c43-b9d7-d416142a2931","resolution":{"observed_at":"2026-08-15T18:44:39.397908Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.430899Z","title":"Videomamba: State space model for efficient video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.430899Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:d92c08c383c4ed54ad53d090b9c3515ce790e85805899dabd049015c160965c7","observation_id":"62780981-65b9-4775-9e9c-29da68c2563a","resolution":{"observed_at":"2026-08-15T18:44:38.430899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19887","last_updated":"2024-07-03T14:30:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-28T23:55:06Z","title":"Jamba: A Hybrid Transformer-Mamba Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19887","snapshot_observed_at":"2026-08-15T18:44:38.439733Z","title":"Jamba: A hybrid transformer-mamba language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.439733Z"},"links":{"cited_paper":"/paper/2403.19887","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:2552d23aece5595b15ec5e6c794341a3b4f9ce78bc8021d640b7fdeea8e684f8","observation_id":"d42cce7d-b139-438e-a330-ab93ca19bcac","resolution":{"observed_at":"2026-08-15T18:44:38.439733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.446202Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.446202Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:8a51c62dca47a44f2c801256e60de7481c701332f142a0ca0ef5892822a4a67a","observation_id":"14b862c2-f386-4449-8ce1-62c8c7d5da28","resolution":{"observed_at":"2026-08-15T18:44:38.446202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","snapshot_observed_at":"2026-08-18T07:06:04.890772Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02097","snapshot_observed_at":"2026-08-15T18:44:38.453093Z","title":"Linfusion: 1 gpu, 1 minute, 16k image.arXiv preprint arXiv:2409.02097, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.453093Z"},"links":{"cited_paper":"/paper/2409.02097","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:c2ac024cdb78f006c3d5572d1a5cfc90e66ebcf0654aaec3dee20f5a337cb23b","observation_id":"cf12ec93-5e9e-4d3a-b3e8-8c43e14b608e","resolution":{"observed_at":"2026-08-15T18:44:38.453093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.358124Z","title":"Instaflow: One step is enough for high-quality diffusion- based text-to-image generation","venue":null,"work_id":"18151589-4dd3-4733-b8ae-4dc764841b1e","year":2023},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.459979Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:9e88914e2e8ac8f95c8adfb8eda46060cbb9c25f36e16cc3a361ab05c0270e94","observation_id":"1ccf3cb2-d300-4a74-a641-21e19993b1a8","resolution":{"observed_at":"2026-08-15T18:44:39.362585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.342700Z","title":"Vmamba: Visual state space model","venue":null,"work_id":"1a618a6a-cb6d-4575-8178-be765a20cd23","year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.465447Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:b58c4bf249da21a614d8d279cdfc0ab7be0df538029dd9c2a15a6f609056dcce","observation_id":"94ab20b5-fd9c-4e64-bbaa-46c3a3b737da","resolution":{"observed_at":"2026-08-15T18:44:39.347088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.13947","last_updated":"2022-07-02T17:58:04Z","snapshot_observed_at":"2026-08-20T01:14:42.609061Z","submitted_at":"2022-06-27T01:50:18Z","title":"Long Range Language Modeling via Gated State Spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.13947","snapshot_observed_at":"2026-08-15T18:44:38.471525Z","title":"Long range language modeling via gated state spaces","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.471525Z"},"links":{"cited_paper":"/paper/2206.13947","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:7d34de9fc063f414fdb5d8e1cb1834251408befe50143a77c6b80cf3b570a21a","observation_id":"3fed1391-a6de-4e10-adb3-9e6151ea8008","resolution":{"observed_at":"2026-08-15T18:44:38.471525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.328825Z","title":"Lin- earizing large language models","venue":null,"work_id":"d0eeecc9-51b6-4b10-8799-48a80717a5dc","year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.478235Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:4196997e9de89c7a5e55343a55dd6044cb2b9fe4baf9b5aac8713218cc884dc3","observation_id":"23673296-1432-47c0-a234-6061f697c7e9","resolution":{"observed_at":"2026-08-15T18:44:39.333951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15881","last_updated":"2024-05-24T18:50:27Z","snapshot_observed_at":"2026-08-16T13:49:37.856428Z","submitted_at":"2024-05-24T18:50:27Z","title":"Scaling Diffusion Mamba with Bidirectional SSMs for Efficient Image and Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15881","snapshot_observed_at":"2026-08-15T18:44:38.484584Z","title":"Scaling diffusion mamba with bidirectional ssms for efficient image and video gener- ation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.484584Z"},"links":{"cited_paper":"/paper/2405.15881","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:aea7b6c6c3a6b6cd96d0a241eae7bd1a6e96cf496dc5e86e8e9fccbea46588db","observation_id":"1c52bade-1d42-423e-be6d-81f3a008c925","resolution":{"observed_at":"2026-08-15T18:44:38.484584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.315206Z","title":"S4nd: Modeling images and videos as multidimensional signals with state spaces","venue":null,"work_id":"f34fcd83-c32f-448a-ba7a-c58da7a5bca4","year":2022},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.490524Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:c0412ddc123b0d54241b11a72bc40a284030ac44340b943e54230c7f6e93b9da","observation_id":"23893a81-85fe-48b6-a627-f1f122edd9fd","resolution":{"observed_at":"2026-08-15T18:44:39.319833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-15T18:44:38.496160Z","title":"Glide: Towards photorealistic image generation and editing with text-guided diffusion models.arXiv preprint arXiv:2112.10741, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.496160Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:78343597f03410b4fc2acb0e81a4bf78c652d28a7367518ce8e95e759377bc6f","observation_id":"c7da6f5b-d099-4093-8d6d-979d7beddf6f","resolution":{"observed_at":"2026-08-15T18:44:38.496160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.502299Z","title":"Glide: Towards photorealistic image generation and editing with text-guided diffusion models, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.502299Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:448698b6ecd7a4b3504addaf83eb897cd81deadccf708042619ba128436d3d09","observation_id":"d601f70b-5d2d-4e0c-a9f1-b195f98cbfb0","resolution":{"observed_at":"2026-08-15T18:44:38.502299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.507006Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.507006Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:18ad1516a6468eb9ee46f8d7689b7d677a89cbceeaaee8ebd0ab3fb35900c129","observation_id":"28dc476a-d208-4e29-815e-f89e673d2d64","resolution":{"observed_at":"2026-08-15T18:44:38.507006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13048","last_updated":"2023-12-11T03:58:56Z","snapshot_observed_at":"2026-08-17T17:58:38.402665Z","submitted_at":"2023-05-22T13:57:41Z","title":"RWKV: Reinventing RNNs for the Transformer Era","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13048","snapshot_observed_at":"2026-08-15T18:44:38.512227Z","title":"Rwkv: Reinventing rnns for the transformer era","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.512227Z"},"links":{"cited_paper":"/paper/2305.13048","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:f5f4a271c0b87fb3a8efbf1d7ecb96e1b4d9311bcaa0743873fed6fc1d9f8c94","observation_id":"50e95542-49dd-4262-b56c-7d8adc57e634","resolution":{"observed_at":"2026-08-15T18:44:38.512227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-15T18:44:38.517264Z","title":"Sdxl: Improving latent diffusion mod- els for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.517264Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:45f27bde57756e1790755b1bd9645bb735daa56e744e7828aefaa4a3130cf711","observation_id":"db4dafad-2158-4edc-a780-169536b91e4c","resolution":{"observed_at":"2026-08-15T18:44:38.517264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.283492Z","title":"Hyena hierarchy: Towards larger con- volutional language models","venue":null,"work_id":"908f877f-7f3b-48a3-bbed-b9c35af2d3cf","year":2023},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.524498Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:7e1566c5ff07e9698973cb376e54469c18e47e72c7bdfce28a2e2dcf57e0ee3c","observation_id":"2d9b1f7d-4029-4036-98a8-39368707e0bb","resolution":{"observed_at":"2026-08-15T18:44:39.288767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.529472Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.529472Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:317fe7a24e4bc465b5f5d00acef9d53414134a8bdfb8eab18b82759cbbf57176","observation_id":"2074047a-4425-4876-a498-4489f9b1a4e9","resolution":{"observed_at":"2026-08-15T18:44:38.529472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.252286Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":"3a013a2f-0071-42c0-bbda-f7a6af8a3edc","year":2021},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.533872Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:d70984ef7e1e164fed8bd07c5f485594c1d6bd4f5eede57a83265bd5a7c23f4d","observation_id":"73e16053-56e9-4808-bfa2-22f809fd9756","resolution":{"observed_at":"2026-08-15T18:44:39.257442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.235571Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"7e0a1b64-3297-464f-aa4a-e025c84c6edc","year":2022},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.538486Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:65de6f323c38b776bbf70eb61d9a7eab3cec2d89737e70cee94dbebd3d8384c9","observation_id":"cd10c6cf-4ee3-4ac9-9ae3-eec302f34632","resolution":{"observed_at":"2026-08-15T18:44:39.241034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.546585Z","title":"U-net: Convolutional networks for biomedical image segmentation,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.546585Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:ecee1f1323ed2faa7feeedafc301cb6fe9e76e10dfc9bdba38c87e42a2c2c99d","observation_id":"db15ecda-4ae1-41a2-a344-78e73af25ad0","resolution":{"observed_at":"2026-08-15T18:44:38.546585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.553903Z","title":"Sara Mahdavi, Rapha Gontijo Lopes, Tim Salimans, Jonathan Ho, David J Fleet, and Mohammad Norouzi","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.553903Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:4c8218a11a4ebdf844dc752fd44ad73981db08b5864a56a1e7181f8588e425ba","observation_id":"4e976d72-6c25-4f83-b302-27ae9423c6fb","resolution":{"observed_at":"2026-08-15T18:44:38.553903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.559957Z","title":"Stylegan-t: Unlocking the power of gans for fast large-scale text-to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.559957Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:129bd71671a6f96494c0181cef5e2aff17ab54c314bccd8f7db1fdc710163deb","observation_id":"87148e25-e373-4d0c-8354-35ef4fc17470","resolution":{"observed_at":"2026-08-15T18:44:38.559957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.198898Z","title":"Convolutional state space models for long-range spatiotemporal modeling.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"c468a318-547f-4974-aedd-30f60af1364d","year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.566507Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:5b597df121e9d04f1db588a43a45116e27a7fbe6510284f85c2a0f28f2423a80","observation_id":"599306f1-5d34-4a09-a780-7957605c5c31","resolution":{"observed_at":"2026-08-15T18:44:39.203109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14224","last_updated":"2024-07-10T09:02:11Z","snapshot_observed_at":"2026-08-16T20:38:15.729152Z","submitted_at":"2024-05-23T06:53:18Z","title":"DiM: Diffusion Mamba for Efficient High-Resolution Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14224","snapshot_observed_at":"2026-08-15T18:44:38.571021Z","title":"Dim: Diffusion mamba for efficient high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.571021Z"},"links":{"cited_paper":"/paper/2405.14224","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:f8090bd4f2f5029e061308f4bce1d3503f887ae94afab953a253caeb000d0616","observation_id":"c61cf94d-0f63-4f86-a451-31015abfcd6c","resolution":{"observed_at":"2026-08-15T18:44:38.571021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10699","last_updated":"2022-01-24T19:12:34Z","snapshot_observed_at":"2026-08-10T18:58:30.893017Z","submitted_at":"2019-10-23T17:59:18Z","title":"Contrastive Representation Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10699","snapshot_observed_at":"2026-08-15T18:44:38.575544Z","title":"Contrastive representation distillation","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.575544Z"},"links":{"cited_paper":"/paper/1910.10699","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:7382755b0626d21cf9a59d745325639614937c43d90e23cc14859be4d1a0b6fc","observation_id":"5ca8e7e6-b5f4-475e-a456-7a03c604ff49","resolution":{"observed_at":"2026-08-15T18:44:38.575544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.581307Z","title":"Similarity-preserving knowl- edge distillation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.581307Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:297ed0b0c897f4bab7257b2326a362df50aab164eb1ab67d32ff9f2b091f2ac3","observation_id":"5ba07854-eba6-4806-ae19-8c40ddb60b5d","resolution":{"observed_at":"2026-08-15T18:44:38.581307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.173649Z","title":"Gomez, Łukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"cf8f4eaa-7c19-48d3-bd0b-5079d500e3f7","year":null},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.586376Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:36fc2e147c2756573f2ac03a7eb8abc7f3a98bffb54e2c4e6eabed6298c2f4ec","observation_id":"2ef8c214-a542-4bc5-818d-347de7fbc8a3","resolution":{"observed_at":"2026-08-15T18:44:39.178588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07887","last_updated":"2024-06-12T05:25:15Z","snapshot_observed_at":"2026-07-06T18:29:21.709395Z","submitted_at":"2024-06-12T05:25:15Z","title":"An Empirical Study of Mamba-based Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07887","snapshot_observed_at":"2026-08-15T18:44:38.596554Z","title":"An empirical study of mamba-based language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.596554Z"},"links":{"cited_paper":"/paper/2406.07887","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:15478aaa97e0a7faaff6b0a1a32ad750fdef1a73941dbf26ffc03da43f4f83d7","observation_id":"27797923-01f5-4521-81c4-cd3025c63fee","resolution":{"observed_at":"2026-08-15T18:44:38.596554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15237","last_updated":"2025-06-27T07:54:57Z","snapshot_observed_at":"2026-08-16T13:23:25.041410Z","submitted_at":"2024-08-27T17:56:11Z","title":"The Mamba in the Llama: Distilling and Accelerating Hybrid Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15237","snapshot_observed_at":"2026-08-15T18:44:38.601371Z","title":"The mamba in the llama: Distilling and accelerating hybrid models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.601371Z"},"links":{"cited_paper":"/paper/2408.15237","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:832774c0f5405543c149500459bd3c97e498032fcb3f8577d24d589f425bb0ce","observation_id":"ce3b3831-15a1-4da0-9921-c3fbb15a1eb8","resolution":{"observed_at":"2026-08-15T18:44:38.601371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06694","last_updated":"2024-04-11T01:18:06Z","snapshot_observed_at":"2026-08-16T14:53:24.619970Z","submitted_at":"2023-10-10T15:13:30Z","title":"Sheared LLaMA: Accelerating Language Model Pre-training via Structured Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06694","snapshot_observed_at":"2026-08-15T18:44:38.606300Z","title":"Sheared llama: Accelerating language model pre-training via structured pruning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.606300Z"},"links":{"cited_paper":"/paper/2310.06694","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:0b1746b4e3593962965615786a2973c82fbb7833b37a0a7bc680feb97aceb1d3","observation_id":"18f0c2e7-73b0-40ba-b757-729c1f187db2","resolution":{"observed_at":"2026-08-15T18:44:38.606300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.146245Z","title":"Difffit: Un- locking transferability of large diffusion models via sim- ple parameter-efficient fine-tuning","venue":null,"work_id":"685c37b7-baee-4dda-abaa-7a5aaeeefb47","year":2023},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.610852Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:c39d455dd8899a6a61cb34f18958cdc9f39a6ccfc976d3d866612c650a50ff95","observation_id":"b1b8309c-b54d-48b1-8d28-9a964bab2c72","resolution":{"observed_at":"2026-08-15T18:44:39.151358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18861","last_updated":"2024-11-10T15:06:53Z","snapshot_observed_at":"2026-08-18T18:58:36.330394Z","submitted_at":"2024-04-29T16:51:30Z","title":"Visual Mamba: A Survey and New Outlooks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18861","snapshot_observed_at":"2026-08-15T18:44:38.616407Z","title":"A survey on vision mamba: Models, applications and chal- lenges","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.616407Z"},"links":{"cited_paper":"/paper/2404.18861","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:179868452956e667842b6a98f75eb322f0d41200e937fc991ed2f7f224714075","observation_id":"520d7ec0-df33-44c1-a20e-c2025743922c","resolution":{"observed_at":"2026-08-15T18:44:38.616407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.130844Z","title":"The hedgehog & the porcupine: Expressive linear attentions with softmax mimicry, 2024","venue":null,"work_id":"582bbf8b-5e80-4eed-bfb7-8c006c8afe66","year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.620884Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:5959e53357b6477f23497acc4b972011b172c7521647b00c65c909c0ab6d603c","observation_id":"5b8cf8ca-0a57-4264-8a45-ac509bf80e09","resolution":{"observed_at":"2026-08-15T18:44:39.136393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14520","last_updated":"2025-01-08T11:03:00Z","snapshot_observed_at":"2026-08-16T14:07:37.083558Z","submitted_at":"2024-03-21T16:17:57Z","title":"Cobra: Extending Mamba to Multi-Modal Large Language Model for Efficient Inference","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14520","snapshot_observed_at":"2026-08-15T18:44:38.626227Z","title":"Cobra: Extending mamba to multi-modal large language model for efficient inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.626227Z"},"links":{"cited_paper":"/paper/2403.14520","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:69cfe1248e532a7711324aff06c052ae9fc913d7396e4a9a8e0f7e425048ac24","observation_id":"2ea1e74c-1b51-439a-993f-34d097c7b59c","resolution":{"observed_at":"2026-08-15T18:44:38.626227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:39.114078Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":"ac22764a-5847-4723-a633-5ee2d8f658dc","year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.631557Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:b95653e5174594d59510917ec72949c7584f425b9c46a3ccd64e7a5e6f397b86","observation_id":"3e0d5353-1c3e-471e-8f92-1bbaaa72761b","resolution":{"observed_at":"2026-08-15T18:44:39.120623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.00650","last_updated":"2021-02-01T05:53:04Z","snapshot_observed_at":"2026-08-19T09:58:18.760378Z","submitted_at":"2021-02-01T05:53:04Z","title":"Rethinking Soft Labels for Knowledge Distillation: A Bias-Variance Tradeoff Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.00650","snapshot_observed_at":"2026-08-15T18:44:38.635832Z","title":"Rethinking soft la- bels for knowledge distillation: A bias-variance tradeoff per- spective","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.635832Z"},"links":{"cited_paper":"/paper/2102.00650","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:abf0de2ee23cd6c3367a92e573cffc3cebb2e5f6be4193f0b9b80f707d32dadd","observation_id":"f0c67ca5-0704-4975-a0d5-d81007622b84","resolution":{"observed_at":"2026-08-15T18:44:38.635832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18583","last_updated":"2024-06-05T17:53:26Z","snapshot_observed_at":"2026-08-16T13:45:47.270039Z","submitted_at":"2024-06-05T17:53:26Z","title":"Lumina-Next: Making Lumina-T2X Stronger and Faster with Next-DiT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18583","snapshot_observed_at":"2026-08-15T18:44:38.640196Z","title":"Lumina-next: Making lumina-t2x stronger and faster with next-dit","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.640196Z"},"links":{"cited_paper":"/paper/2406.18583","citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:5a6fdcd3778eb4b07023be55e57b5c85bd544c1777d61c36c490c7695e6f21c1","observation_id":"c386b471-4784-4ebf-af94-c7ee25b69542","resolution":{"observed_at":"2026-08-15T18:44:38.640196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:44:38.591667Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-15T18:44:38.591667Z"},"links":{"citing_paper":"/paper/2506.18999"},"observation_digest":"sha256:134ce4ae580b2d8a2b0f4089cf5e1ab5060900da5f16e213af954510ffc01dfb","observation_id":"e88f3373-26aa-4bd3-af2f-c3abfec95166","resolution":{"observed_at":"2026-08-15T18:44:38.591667Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.18999","last_updated":"2025-06-23T18:01:19Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T19:39:10.972681Z","submitted_at":"2025-06-23T18:01:19Z","title":"Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":49,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 0 inbound Pith citation observations for arXiv:2506.18999."}