{"as_of":"2026-08-13T17:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9867d3d21790b103ff68804926b87e965634f56c7af24f59a70cb11987b202d5","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T20:37:02.034586Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.05628/citation-record","integrity":"/paper/2412.05628/integrity","json":"/paper/2412.05628/citation-record.json","paper":"/paper/2412.05628"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-11T20:37:01.632298Z","title":"ediff-i: Text-to-image diffusion models with an ensemble of expert denoisers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.632298Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:ac4e513d68ba301fb4b4940411a7d92284d0e6f1a7e92fe9a90c7128d178718c","observation_id":"e09e7855-7d29-4cfb-936a-80a53aab357c","resolution":{"observed_at":"2026-08-11T20:37:01.632298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:01.638332Z","title":"All are worth words: A vit backbone for diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.638332Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:9ad27c30852e61edc53658e876d6aacaa882b98ba83210de68ee6293725a39ca","observation_id":"3df01fed-48ca-41f9-a58f-21d5db4d3a20","resolution":{"observed_at":"2026-08-11T20:37:01.638332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:01.643485Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.643485Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:d3d6ef2a43e7e608ccc7d25f35b671ea5c7c743bc3c9267dac2d35329eabd002","observation_id":"9ae19ae8-b395-46a7-bb9e-12430f2f8ed7","resolution":{"observed_at":"2026-08-11T20:37:01.643485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.13771","last_updated":"2022-12-28T10:32:59Z","snapshot_observed_at":"2026-08-13T15:36:51.188277Z","submitted_at":"2022-12-28T10:32:59Z","title":"Exploring Vision Transformers as Diffusion Learners","version":1},"cited_work":{"arxiv_id":"2212.13771","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.13771","snapshot_observed_at":"2026-08-11T20:37:02.309483Z","title":"Exploring Vision Transformers as Diffusion Learners","venue":"cs.CV","work_id":"1ec8692e-aba8-4225-95e2-040f8e61960e","year":2022},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.648799Z"},"links":{"cited_paper":"/paper/2212.13771","citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:7a6d56acd6b46dd22d007e19b0142efd74df2ccf3458b19417a998130fa0a9a0","observation_id":"91f8a7eb-8ac9-4f3b-b030-28a5af73d8b7","resolution":{"observed_at":"2026-08-11T20:37:02.315205Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04557","last_updated":"2024-06-02T09:30:39Z","snapshot_observed_at":"2026-08-13T05:07:42.154228Z","submitted_at":"2023-12-07T18:59:30Z","title":"GenTron: Diffusion Transformers for Image and Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04557","snapshot_observed_at":"2026-08-11T20:37:01.654865Z","title":"Gentron: Delving deep into diffusion transformers for image and video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.654865Z"},"links":{"cited_paper":"/paper/2312.04557","citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:97026068d09d3190d9c4834ff0f33e628c726a5d4c9f98a805f698aba468c8b9","observation_id":"86041bb7-e9ac-42c9-b9d9-53b3711eacc4","resolution":{"observed_at":"2026-08-11T20:37:01.654865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:01.660268Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.660268Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:43b078049486631264c975891aee7691a845611801db6bf27a53bd7d42f66894","observation_id":"478355b4-2cc5-4631-bbb8-574d2b0c7abe","resolution":{"observed_at":"2026-08-11T20:37:01.660268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:01.666241Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.666241Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:4bb69a50d7477b19e69d28d64c31e3fe151196f211a1443dbda12209a5ef0e1b","observation_id":"ce57dd8a-49ae-4ac4-af19-c4456dd1bcce","resolution":{"observed_at":"2026-08-11T20:37:01.666241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-13T14:19:26.598265Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-11T20:37:01.671532Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.671532Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:42e678a8882708efc9dfb21a89ace1b935d2cdb053ce1dbf3c48a416ee49423a","observation_id":"f617ccf7-dd3a-4209-bae5-83171a5d65db","resolution":{"observed_at":"2026-08-11T20:37:01.671532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.830007Z","title":"Structural pruning for diffusion models","venue":null,"work_id":"97516237-aa90-40a2-afdd-d134fc5a4adb","year":2023},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.676981Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:697d46edc537ea84103780ee98238f838ffe5996858d0ab821ff1ef1beb72d2e","observation_id":"5bc6faaa-2d6a-4637-bd78-2ac0b3948311","resolution":{"observed_at":"2026-08-11T20:37:02.835266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:01.682670Z","title":"Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.682670Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:929357ff30263903cd4009021d5831903db3db2d4d1622a360ad5a8e0ee17103","observation_id":"b7976958-de29-4287-820e-6fdefb6eb2bf","resolution":{"observed_at":"2026-08-11T20:37:01.682670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.803701Z","title":"Vector quantized diffusion model for text-to-image synthesis","venue":null,"work_id":"9f4c438c-607d-493c-b9e6-4d6a1bfab07d","year":2022},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.687317Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:cc8149f357fd3559bd436f8ccd5cf997d4da9b478096dfe8888b2fd65cc6f314","observation_id":"2c8f8835-bd6a-4f2c-b769-b8c64fb971b5","resolution":{"observed_at":"2026-08-11T20:37:02.808757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:01.692135Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.692135Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:33354502b07f8b6344886213a9eeb5fb5d5cff16394338598ac723c498e00e7a","observation_id":"922c3e35-114f-4331-ae46-89babbf595d3","resolution":{"observed_at":"2026-08-11T20:37:01.692135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:01.701036Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.701036Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:dd5130ae0f229f1bf033590dcb6a3f555818a1632f48cfa10ef5cb7d58508842","observation_id":"a677f498-56df-4e31-8e20-a19c948b3c53","resolution":{"observed_at":"2026-08-11T20:37:01.701036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:01.706174Z","title":"U-dit tts: U-diffusion vision transformer for text-to-speech","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.706174Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:9b459e54f7d0958dc8b925c86bf0980a2ded9121f64af1728aaa1b887d81e414","observation_id":"b2ddfb1a-6d76-4bfc-b6aa-b9f225682f53","resolution":{"observed_at":"2026-08-11T20:37:01.706174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.752296Z","title":"Multi- architecture multi-expert diffusion models","venue":null,"work_id":"70f30852-f81c-40f9-a088-7ae524d329be","year":2024},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.710892Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:36ee973e5eb3e906c30a39065a8502949f6abb1b958095bd3a145890abb5c74d","observation_id":"c61d4cb6-a3f6-406f-82bc-f1cd49c3df99","resolution":{"observed_at":"2026-08-11T20:37:02.757369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:01.715869Z","title":"Dlt: Conditioned layout generation with joint discrete-continuous diffusion layout transformer","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.715869Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:5b57ce0ed4104a62675a3493ce819b79fca77c955bd359bb5d07b22e5facc556","observation_id":"dd9cdbe8-05ed-4898-95ac-1b2730ecaafb","resolution":{"observed_at":"2026-08-11T20:37:01.715869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08860","last_updated":"2023-06-15T05:04:39Z","snapshot_observed_at":"2026-08-13T11:17:00.794754Z","submitted_at":"2023-06-15T05:04:39Z","title":"OMS-DPM: Optimizing the Model Schedule for Diffusion Probabilistic Models","version":1},"cited_work":{"arxiv_id":"2306.08860","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.08860","snapshot_observed_at":"2026-08-11T20:37:02.247019Z","title":"OMS-DPM: Optimizing the Model Schedule for Diffusion Probabilistic Models","venue":"cs.LG","work_id":"a2b7d352-da35-480d-94c8-17c93343ff5e","year":2023},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.721880Z"},"links":{"cited_paper":"/paper/2306.08860","citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:2ea4e299731397a5e4ad623d29d0e98caf3d8c2c06e61bb3d65d212f21a06a2f","observation_id":"2757ffc5-196f-4b54-8931-3f979cb72235","resolution":{"observed_at":"2026-08-11T20:37:02.255214Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12708","last_updated":"2024-04-21T07:17:14Z","snapshot_observed_at":"2026-08-13T11:37:37.379097Z","submitted_at":"2023-05-22T04:37:41Z","title":"ViT-TTS: Visual Text-to-Speech with Scalable Diffusion Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12708","snapshot_observed_at":"2026-08-11T20:37:01.727003Z","title":"Vit-tts: visual text-to-speech with scalable diffusion transformer","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.727003Z"},"links":{"cited_paper":"/paper/2305.12708","citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:ae1972cdec21482abd67b620c3a00ab960b5891fd380a314ec2e781896d92cbc","observation_id":"2b0fb5cb-361f-47e4-9a88-167061e57aa5","resolution":{"observed_at":"2026-08-11T20:37:01.727003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.726088Z","title":"Vdt: General- purpose video diffusion transformers via mask modeling","venue":null,"work_id":"310a5d07-9f1c-41ca-aafa-ca6ce8a0d532","year":2023},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.733030Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:4bdec1d64a1f5398350f5b1bf457920e8c68c9556025ddfb1b662fb04df21c49","observation_id":"9dc8d7ef-2eb3-4b3f-8a56-8ce0ad73bbef","resolution":{"observed_at":"2026-08-11T20:37:02.731235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03048","last_updated":"2025-05-01T09:40:21Z","snapshot_observed_at":"2026-08-13T10:28:06.516901Z","submitted_at":"2024-01-05T19:55:15Z","title":"Latte: Latent Diffusion Transformer for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03048","snapshot_observed_at":"2026-08-11T20:37:01.738475Z","title":"Latte: Latent diffusion transformer for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.738475Z"},"links":{"cited_paper":"/paper/2401.03048","citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:8eef40b753013d999fc36f47fa792851d714669885600ff9bc8ed5eed116af46","observation_id":"da9157c3-83f6-428e-a7e4-13e07865c2af","resolution":{"observed_at":"2026-08-11T20:37:01.738475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00858","last_updated":"2023-12-07T17:24:18Z","snapshot_observed_at":"2026-08-13T05:12:18.337935Z","submitted_at":"2023-12-01T17:01:06Z","title":"DeepCache: Accelerating Diffusion Models for Free","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00858","snapshot_observed_at":"2026-08-11T20:37:01.743326Z","title":"Deepcache: Accelerating diffusion models for free","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.743326Z"},"links":{"cited_paper":"/paper/2312.00858","citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:96c52a964c029960a376d9e5cab88f77cebaf108fbf11e8ce3d56b387206ccc8","observation_id":"4a68d741-60bd-49d2-abdc-1738ce2b4c97","resolution":{"observed_at":"2026-08-11T20:37:01.743326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.709684Z","title":"Deepcache: Accelerating diffusion models for free","venue":null,"work_id":"a7461be4-a061-43a5-999f-b72c213ac790","year":2024},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.748481Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:db7287e0f5f13f6f63a06bf75cbc2f325243663a52bd71237a05b71ca54a414a","observation_id":"3b4b616e-30e0-4453-a1ae-367a6a960a6f","resolution":{"observed_at":"2026-08-11T20:37:02.714959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14797","last_updated":"2024-02-22T18:55:08Z","snapshot_observed_at":"2026-08-13T04:12:37.971867Z","submitted_at":"2024-02-22T18:55:08Z","title":"Snap Video: Scaled Spatiotemporal Transformers for Text-to-Video Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14797","snapshot_observed_at":"2026-08-11T20:37:01.753229Z","title":"Snap video: Scaled spatiotemporal transformers for text-to-video synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.753229Z"},"links":{"cited_paper":"/paper/2402.14797","citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:9d655e68344f0f62a6df838ef29a7f6b4c301dcabf5f249ed58dbfb4f75e35b2","observation_id":"a0cf65a8-03d7-48b9-8cdd-c20fa9fb645e","resolution":{"observed_at":"2026-08-11T20:37:01.753229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.693376Z","title":"Dit-3d: Exploring plain diffusion transformers for 3d shape generation.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"de75018f-b79e-4411-963b-c99a25a66321","year":2024},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.758945Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:399a657716ced1188b7c1c3e54bfe4df56eb61fd245fab2127b46779edca96fe","observation_id":"e1627879-2aae-4396-bedb-7b2cc80e9000","resolution":{"observed_at":"2026-08-11T20:37:02.698746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:01.765152Z","title":"Improved denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.765152Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:b6530221a5357d631392c80b0530f4e7b2ca0b17731adf36d38934f27b2bdfda","observation_id":"4fa4f3d0-7b84-41af-8967-1977d2aa5fbf","resolution":{"observed_at":"2026-08-11T20:37:01.765152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14167","last_updated":"2024-02-21T23:08:54Z","snapshot_observed_at":"2026-08-13T04:44:13.123976Z","submitted_at":"2024-02-21T23:08:54Z","title":"T-Stitch: Accelerating Sampling in Pre-Trained Diffusion Models with Trajectory Stitching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14167","snapshot_observed_at":"2026-08-11T20:37:01.773861Z","title":"T-stitch: Accelerating sampling in pre-trained diffusion models with trajectory stitching","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.773861Z"},"links":{"cited_paper":"/paper/2402.14167","citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:6f076c41b6048cc880c52bbc88567609499b2fe38e4d1e9ee8700b41d62a6414","observation_id":"7215a1e1-fbdc-4cde-809f-5253e7b2b1ed","resolution":{"observed_at":"2026-08-11T20:37:01.773861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07138","last_updated":"2024-02-21T04:00:06Z","snapshot_observed_at":"2026-08-13T05:52:32.593251Z","submitted_at":"2023-10-11T02:23:18Z","title":"Denoising Task Routing for Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07138","snapshot_observed_at":"2026-08-11T20:37:01.782192Z","title":"Denoising task routing for diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.782192Z"},"links":{"cited_paper":"/paper/2310.07138","citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:b73002324358078f7b8cb470d11097cf30ba8f93739b6276377e1b138532f512","observation_id":"94b1bad7-2e89-4b1f-a466-9a9cbe89b3f3","resolution":{"observed_at":"2026-08-11T20:37:01.782192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:01.787367Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.787367Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:c36c446beb783e3e3e9e209a2cb0bd2ca2cc06725f9ab1827d842c716652029f","observation_id":"d3d31d5c-501c-49d8-9d9a-c2e720764d8e","resolution":{"observed_at":"2026-08-11T20:37:01.787367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:01.792499Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.792499Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:5e2553f17ff6a100a5fcb82b4f8f2d408c5e96f54d8f451eabcf35b20b57a5fc","observation_id":"b2ccae28-43e9-46c5-9f77-72047a8d562f","resolution":{"observed_at":"2026-08-11T20:37:01.792499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:01.797480Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.797480Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:bb05b2c0acd5595c0e4d603b67eacdd76427d19b59da72c5fcb2f0b2d90705f2","observation_id":"3659ef08-0942-45f7-917f-fa9f639fc8fd","resolution":{"observed_at":"2026-08-11T20:37:01.797480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-11T20:37:01.802323Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.802323Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:a5ad04d8aa9dbf128107de9f13b9715c3015c06efb880f9d2e96bb44528f8385","observation_id":"97efeea4-a0e7-40a5-bc10-f92316167333","resolution":{"observed_at":"2026-08-11T20:37:01.802323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:01.807563Z","title":"Generative modeling by estimating gradients of the data distribution","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.807563Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:86b349ba23ea9e4dabea799a02cb6e05a737bca739a734e248adddbd40ae4375","observation_id":"157d2d24-3436-423d-8522-725e17380e66","resolution":{"observed_at":"2026-08-11T20:37:01.807563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-11T20:37:01.812353Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.812353Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:b5c10e2a847f93b2ee2015c57e8acb00e9bf5a5350771ad6fba25f42a2df1a38","observation_id":"86ebf3e5-d21a-4c52-91c0-2e68409abe4b","resolution":{"observed_at":"2026-08-11T20:37:01.812353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:01.817569Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.817569Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:17f2a1e871f26d571fe1df36b77f97a6fbb4466af332117510245f9f39283493","observation_id":"81daa912-513c-48b3-840f-7e5c6bc6e7ab","resolution":{"observed_at":"2026-08-11T20:37:01.817569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.613186Z","title":"Factorizing knowledge in neural networks","venue":null,"work_id":"00c04ed0-0a37-4b1a-8fd0-680583d632ab","year":2022},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.941703Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:97b8912f36c1ecc6f033f7a4fa450139145a683a1eb7fa9d2c8bbce09a60d432","observation_id":"5501da59-4040-4ec2-91e0-96a2ba876288","resolution":{"observed_at":"2026-08-11T20:37:02.618208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.598113Z","title":"Diffusion probabilistic model made slim","venue":null,"work_id":"c811bb6b-c2af-4ddd-8451-e26acfcdf022","year":2023},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.946936Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:2ab8e522b2ebb9dae22fab297c5214546d3aacc1eaffb524ec6a633369db2a09","observation_id":"f3245b59-2c58-4461-9fbe-108f3d840614","resolution":{"observed_at":"2026-08-11T20:37:02.602808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:01.952104Z","title":"Deep model reassembly","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.952104Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:f395c39b69154b905e21777f551ff4718464fb8cb0acdc0b1e012d7a69795656","observation_id":"e852ad19-8585-46eb-9618-2dc2e92f65bd","resolution":{"observed_at":"2026-08-11T20:37:01.952104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07791","last_updated":"2022-08-16T15:02:21Z","snapshot_observed_at":"2026-08-13T14:44:28.823270Z","submitted_at":"2022-08-16T15:02:21Z","title":"Your ViT is Secretly a Hybrid Discriminative-Generative Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07791","snapshot_observed_at":"2026-08-11T20:37:01.957152Z","title":"Your vit is secretly a hybrid discriminative-generative diffusion model","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.957152Z"},"links":{"cited_paper":"/paper/2208.07791","citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:1697e83cd0857c69c940833b90afee8a6cc12df39d7afa9ec7b4ca142268d72f","observation_id":"8a220f16-0eee-475b-bbc3-a845355d8a87","resolution":{"observed_at":"2026-08-11T20:37:01.957152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-13T11:15:49.655634Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-11T20:37:01.962804Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.962804Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:995659e85a697021dd3a0451cd050e13c6d788179a760c56b8df48823cb3711f","observation_id":"18ab7e93-b2b8-4d33-b6d6-936aa6fae1bc","resolution":{"observed_at":"2026-08-11T20:37:01.962804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.571777Z","title":"Guidelines: • The answer NA means that the abstract and introduction do not include the claims made in the paper","venue":null,"work_id":"ddd97c07-fae0-4d23-b61a-cd3c1179600c","year":null},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.967761Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:9a76074731506207511b350890c4fe7e345ecae9573ba186bc996f2e8befc99d","observation_id":"d2d249f8-27f5-4707-ae05-4b4358e5d22f","resolution":{"observed_at":"2026-08-11T20:37:02.576778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.556557Z","title":"Limitations","venue":null,"work_id":"d807d57e-4882-4e25-acd1-b32fbec84beb","year":null},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.972732Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:e5589c87d673ca1ad77bfafa8034089e0d9726c1244e42a3e4c9369c3213f602","observation_id":"ac3b99c8-63fe-448b-83bc-229dc638bef6","resolution":{"observed_at":"2026-08-11T20:37:02.561374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.540318Z","title":"Guidelines: 13 • The answer NA means that the paper does not include theoretical results","venue":null,"work_id":"54656f5f-9aed-4279-bd4a-f966b2c3f49d","year":null},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.977560Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:d29edb4d1b376a49d7f15ff5c4f86ac32d62f5bd09bcaa9a835c23e4ac83a198","observation_id":"815e9f5a-2743-4087-833c-ab5b9617becb","resolution":{"observed_at":"2026-08-11T20:37:02.545276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.523594Z","title":"Guidelines: • The answer NA means that the paper does not include experiments","venue":null,"work_id":"a3cb171f-2867-4d45-a774-ca6fc4c98c14","year":null},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.982673Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:a21c6b7c4801328347dce22d2e70d82ec2f51ad751bd69e3ea1140440a3eb6d5","observation_id":"49af15f8-817b-4800-b5dd-b8ac1fc2be67","resolution":{"observed_at":"2026-08-11T20:37:02.529343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.506633Z","title":"14 Guidelines: • The answer NA means that paper does not include experiments requiring code","venue":null,"work_id":"31de4181-722c-489d-9924-12edb5610d9d","year":null},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.987717Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:508db97a931ccdea36ff66f818936b6650d60eb81a2a2f6f575116e0f874c1f1","observation_id":"2366bd51-6682-49b9-bb3e-682586c258bf","resolution":{"observed_at":"2026-08-11T20:37:02.512060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.488986Z","title":"Guidelines: • The answer NA means that the paper does not include experiments","venue":null,"work_id":"31bf41a3-411f-44ce-9dc6-1db4be7f3593","year":null},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.992450Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:fb0af9607b75e4d91a1a7e47056178b172c0b2334d0d1cf9b4bd5ba2fd6c90e2","observation_id":"925c7ab8-f43f-47e2-9ef4-bf882117d6b3","resolution":{"observed_at":"2026-08-11T20:37:02.494549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.472523Z","title":"Guidelines: • The answer NA means that the paper does not include experiments","venue":null,"work_id":"c0af9f75-fe1a-41ea-a730-dc69440d4ca8","year":null},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.997523Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:6ca76a2343887d0d1d806c9fdfb0a485a34b597dbcc249cc83c41652c3e9ac3a","observation_id":"407dc21d-13c9-47e4-bd1d-0fce62e4335f","resolution":{"observed_at":"2026-08-11T20:37:02.477602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.455587Z","title":"Guidelines: • The answer NA means that the paper does not include experiments","venue":null,"work_id":"705d594d-e30a-4adf-a7d2-b61218f55a61","year":null},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:02.001984Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:160453f1f8b542d6c2ec87d189a07140e939c8eadafa4f2551daab39264db339","observation_id":"e00964b4-a07e-4d9c-b4c5-598b090341b7","resolution":{"observed_at":"2026-08-11T20:37:02.461197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.439792Z","title":"Guidelines: • The answer NA means that the authors have not reviewed the NeurIPS Code of Ethics","venue":null,"work_id":"580b7878-7960-4f75-97e2-808447fdc155","year":null},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:02.006824Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:da2e16a0075d0e7169f0bb05957567115b80b3f87754e6f7295438f96f6c33af","observation_id":"b4169bd0-761b-4269-9128-a5da1ef1a07b","resolution":{"observed_at":"2026-08-11T20:37:02.444733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.422618Z","title":"Guidelines: • The answer NA means that there is no societal impact of the work performed","venue":null,"work_id":"b007ee95-7bce-46db-beeb-341e67c89dcc","year":null},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:02.011362Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:1db96d6a21bd7544e10cce1f522a672c565b82a252f0f208443f1ed45aa2feaa","observation_id":"7283e08e-c765-4918-8a36-1126a0d6c274","resolution":{"observed_at":"2026-08-11T20:37:02.427964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.015574Z","title":"Guidelines: • The answer NA means that the paper poses no such risks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:02.015574Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:ae9938353710c6ed3c7f4dbf46a2ff42cdebd265edf6f905b9905c46a3af3a30","observation_id":"eb867ff9-7ddb-4c87-9568-c8efb1dbd5ec","resolution":{"observed_at":"2026-08-11T20:37:02.015574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.394916Z","title":"Guidelines: • The answer NA means that the paper does not use existing assets","venue":null,"work_id":"25c341b9-b653-45e2-853c-5af0e7c7b6a1","year":null},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:02.020433Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:2b42c0da26ee5c3d651cdcc20c860c654dabf5185852334d40e5b19c7ff4f194","observation_id":"e33c906b-630f-49f4-a5f6-660df6ae99a0","resolution":{"observed_at":"2026-08-11T20:37:02.399908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.378420Z","title":"17 Guidelines: • The answer NA means that the paper does not release new assets","venue":null,"work_id":"919d1caa-1571-425f-b422-2d08576fe024","year":null},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:02.024988Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:ce1af68f67fc831dd36b1afc5edd13ddc7764b57f75965a4e4aefd00432f465f","observation_id":"b7478e1b-cd98-4815-9e4d-bc5751f1148a","resolution":{"observed_at":"2026-08-11T20:37:02.383435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.360971Z","title":"Guidelines: • The answer NA means that the paper does not involve crowdsourcing nor research with human subjects","venue":null,"work_id":"c014454d-4c91-482a-8161-7981f963b78f","year":null},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:02.029738Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:2351a68cc95165c8b745fed8986113cc77f6b700c6c51ca4a6c6d8d0f618c19d","observation_id":"d575a7d0-3185-4fbb-bf8f-bafd27d71dbf","resolution":{"observed_at":"2026-08-11T20:37:02.366049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:37:02.345096Z","title":"Guidelines: • The answer NA means that the paper does not involve crowdsourcing nor research with human subjects","venue":null,"work_id":"c0e50fe2-f5b9-4be9-9269-0f6c43d448fd","year":null},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:02.034586Z"},"links":{"citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:28addd0f5b812bdcd8e54c7d32892ba390a86510de3637808a00d6d1f236258a","observation_id":"9ad315cc-6e38-4dea-b944-62e3b63152ae","resolution":{"observed_at":"2026-08-11T20:37:02.350312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T04:44:30.910608Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":2,"verified_fuzzy":22},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2412.05628."}