{"as_of":"2026-08-11T13:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eb5e18612da5d2a47b2d2d46162e43a836a0f7e1ee42fb391dd3a428c1dd31aa","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T16:18:12.320037Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.13349/citation-record","integrity":"/paper/2501.13349/integrity","json":"/paper/2501.13349/citation-record.json","paper":"/paper/2501.13349"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.120848Z","title":"All are worth words: A vit backbone for diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.120848Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:07683529679f936f9cc128309b09b6b8c57c5c64c2f4444d10c2498f2fda8e7f","observation_id":"9fa396b9-80a6-4a4a-be5a-11154329de4d","resolution":{"observed_at":"2026-08-10T16:18:12.120848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-10T16:18:12.124919Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.124919Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:69c6c390a719b427cd6bb1e862ca0ac999e5426e0099e443018707e6d4f861cc","observation_id":"66ea07dc-99e4-4c29-bd5a-3bba831946cf","resolution":{"observed_at":"2026-08-10T16:18:12.124919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.128915Z","title":"Align your latents: High-resolution video synthesis with latent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.128915Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:faa43a7cb3c4c663dc4005afde88e1c0a05ae38b129ba0a74bf1a6c72c2ec599","observation_id":"e75ca290-275a-4ac6-863e-34bdc27a11cc","resolution":{"observed_at":"2026-08-10T16:18:12.128915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.808367Z","title":null,"venue":null,"work_id":"2b7fcfed-348d-439a-ae31-2e3a848209b3","year":2022},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.132376Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:9eb96830e4b45a4fabab6fe440fddc224c8619be67a401ef14b721a3d87c4248","observation_id":"3afa850d-a72b-4b5d-aea8-3c87b35d2ebe","resolution":{"observed_at":"2026-08-10T16:18:12.812124Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04692","last_updated":"2024-03-17T16:59:25Z","snapshot_observed_at":"2026-08-11T01:07:36.814668Z","submitted_at":"2024-03-07T17:41:37Z","title":"PixArt-\\Sigma: Weak-to-Strong Training of Diffusion Transformer for 4K Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04692","snapshot_observed_at":"2026-08-10T16:18:12.136181Z","title":"Pixart- \\sigma: Weak-to-strong training of diffusion transformer for 4k text-to-image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.136181Z"},"links":{"cited_paper":"/paper/2403.04692","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:c55a269bcde5baf5f416a76c7927cd0363c6a31a933f5b6ecb8e543f31982814","observation_id":"ba2e50ad-cfeb-4577-afc5-affd7740269a","resolution":{"observed_at":"2026-08-10T16:18:12.136181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05252","last_updated":"2024-01-10T16:27:38Z","snapshot_observed_at":"2026-08-11T02:40:47.256553Z","submitted_at":"2024-01-10T16:27:38Z","title":"PIXART-{\\delta}: Fast and Controllable Image Generation with Latent Consistency Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05252","snapshot_observed_at":"2026-08-10T16:18:12.140228Z","title":"Pixart- {\\delta}: Fast and controllable image generation with latent consistency models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.140228Z"},"links":{"cited_paper":"/paper/2401.05252","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:cf7895e41f4e5e9bcb9cb693711a94ad1b955038ff5f2d6e339d6e133f18afed","observation_id":"da31fbe0-a8cd-4e01-91b5-9b305fbc37d9","resolution":{"observed_at":"2026-08-10T16:18:12.140228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-10T16:18:12.144488Z","title":"Pixart-alpha: Fast training of diffusion transformer for photorealistic text-to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.144488Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:aa30ff6f8c49376b11f84d5022bd7f9d2f89d077a68a0f4700aa8b498b0d3c72","observation_id":"f86bcd86-598f-4037-9c39-7f69073a2e41","resolution":{"observed_at":"2026-08-10T16:18:12.144488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09660","last_updated":"2021-06-19T01:47:11Z","snapshot_observed_at":"2026-08-11T01:10:30.784128Z","submitted_at":"2021-06-17T17:09:21Z","title":"WaveGrad 2: Iterative Refinement for Text-to-Speech Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09660","snapshot_observed_at":"2026-08-10T16:18:12.148306Z","title":"Weiss, Mohammad Norouzi, Najim Dehak, and William Chan","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.148306Z"},"links":{"cited_paper":"/paper/2106.09660","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:d357876ca8e5cc142b5bf0470aece9482317dbb99bb87137b60778640d3dab2f","observation_id":"d602bc70-0ae4-43bd-b051-648d8e2d6a36","resolution":{"observed_at":"2026-08-10T16:18:12.148306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.151961Z","title":"Infogan: Interpretable representation learning by information maximizing generative adversarial nets","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.151961Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:ac026c92d8ae587941185092b9cc31b943d0853d6f161aebe9164344ab0a6337","observation_id":"ad7c3ab5-00a4-4fb4-bee9-a2d9bf577d22","resolution":{"observed_at":"2026-08-10T16:18:12.151961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15807","last_updated":"2023-09-27T17:30:19Z","snapshot_observed_at":"2026-08-02T11:54:13.342379Z","submitted_at":"2023-09-27T17:30:19Z","title":"Emu: Enhancing Image Generation Models Using Photogenic Needles in a Haystack","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15807","snapshot_observed_at":"2026-08-10T16:18:12.155162Z","title":"Emu: Enhancing image generation models using photogenic needles in a haystack","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.155162Z"},"links":{"cited_paper":"/paper/2309.15807","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:544a8479987b35028c41c3548b62f7188f626db77c4b9a79b91d236a25a00bae","observation_id":"b312b944-3253-4893-9f66-29fbd46274f7","resolution":{"observed_at":"2026-08-10T16:18:12.155162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.159233Z","title":"Imagenet: A large- scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.159233Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:f637cfdf374f95adfe290698073a0b76a2420ea9d357870d1feb93c41fb5017b","observation_id":"c1345b48-5175-406e-96f2-e948543e1537","resolution":{"observed_at":"2026-08-10T16:18:12.159233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.162589Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.162589Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:d2ad0ba26ca3bb17f076c00ee96c9469a6f968f60dcd36a80418b0f5a9e876e8","observation_id":"60756fe4-78c3-4555-a839-feaedb1873a4","resolution":{"observed_at":"2026-08-10T16:18:12.162589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.780683Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"5ce5b933-84d3-4228-bc11-62248f5f04fa","year":2021},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.166029Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:8f16d2ea2414d0971477d7e95682709740af27e19fa5a0c15419a5df2c23d425","observation_id":"14ec4ede-1869-4c73-8e6e-3b30b507f03f","resolution":{"observed_at":"2026-08-10T16:18:12.784162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.769683Z","title":"Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":"6cac79c2-df19-436e-8a22-fe52bd2b62a2","year":2023},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.169416Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:9bc4b3fe7cbee4ae93c7fc84b8bf595e80916c6cc92583ac29fff92ec717df56","observation_id":"06383022-d4af-4ea1-9b49-20816330025e","resolution":{"observed_at":"2026-08-10T16:18:12.774064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.759034Z","title":"Generative adversarial nets","venue":null,"work_id":"2802e587-9abf-4a88-904b-3e0e3611daad","year":2014},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.172589Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:684c286e43563cf7e536431f2edc8c5afe1b2ab61e36cc2cad087b8e1216afcb","observation_id":"ff4920b8-0055-4e2b-9c01-7f356ccc9c1b","resolution":{"observed_at":"2026-08-10T16:18:12.762535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.748648Z","title":"TeaForN: Teacher-forcing with n-grams","venue":null,"work_id":"deaa28db-1064-41ea-8346-781813c906bd","year":2020},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.175927Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:f52486d00ae2a945827fffdcd966ecebb2da902e8085e5bf1f025612a5e33346","observation_id":"795ca3eb-313d-462d-a6b3-188f88dd592f","resolution":{"observed_at":"2026-08-10T16:18:12.752348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.179159Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.179159Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:59d95610b7858f3c03debe197a74c033f0c0072cba68a9923240690b90169d8d","observation_id":"b3556108-a5dc-4f99-be73-6442ffd98695","resolution":{"observed_at":"2026-08-10T16:18:12.179159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-10T16:18:12.182237Z","title":"Imagen video: High definition video generation with diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.182237Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:8db9d0f7d6528a3f192bccd430fa975c90a19c08426a3f4aaafc53deaf3cbca9","observation_id":"17098205-1e35-4804-a518-aeee3f75e5c7","resolution":{"observed_at":"2026-08-10T16:18:12.182237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.186269Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.186269Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:9e3ee0f486616909e08ab0337dd3c8fd9e9f6e6fe607a85d3be1d47ca7ec6761","observation_id":"848860eb-2369-48b6-9591-1b48e93c007b","resolution":{"observed_at":"2026-08-10T16:18:12.186269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.189584Z","title":"Cascaded diffusion models for high fidelity image generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.189584Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:4fa6c8f701d8cd323ba793344247a305d3f7d181702e4065f588446f61fb874d","observation_id":"9920df46-fc15-446e-abdf-73f1ad50c17c","resolution":{"observed_at":"2026-08-10T16:18:12.189584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-10T16:18:12.193031Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.193031Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:41c44a6a02c5a9b0b32e094bfc3decf52a7aa53a7a73e5a051e06a9d1804dd81","observation_id":"03477b64-a0bd-4f4b-aba5-38884c9335bd","resolution":{"observed_at":"2026-08-10T16:18:12.193031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.720201Z","title":"Scaling up gans for text-to-image synthesis","venue":null,"work_id":"37fe0c89-d21e-4639-8d45-2cc12eccdf42","year":2023},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.196628Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:461b8a448d2c8d7144db785eb384666c9f8525b2a2d8c7086e35a1ad4fa8f22b","observation_id":"34c6618a-9386-4e45-9ba5-95b04189cb25","resolution":{"observed_at":"2026-08-10T16:18:12.723931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.710028Z","title":"Guided-tts: A diffusion model for text-to- speech via classifier guidance","venue":null,"work_id":"43ec6515-860e-442a-b764-80fc3f6bf5cf","year":2021},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.200088Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:4c22c3a3d00c5ed29f34d885cd9019ad8f56f70c4dc8f848836639c2aed69aca","observation_id":"afc1217a-103e-482e-b2e6-520d80e1e6aa","resolution":{"observed_at":"2026-08-10T16:18:12.713582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.700167Z","title":"Distilling ode solvers of diffusion models into smaller steps","venue":null,"work_id":"987c79f7-e9e1-4eed-a7ac-cee7b471efa3","year":2024},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.203895Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:3406624dcdfe013d58ed9ea08b5b9e7a91f4a69db6b6a4e339f80d1d2fa9f305","observation_id":"5fe72913-69a9-4ed1-8086-22efb9c065e9","resolution":{"observed_at":"2026-08-10T16:18:12.703720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.207359Z","title":"Understanding diffusion objectives as the elbo with simple data augmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.207359Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:c92577df1b1570f6badb74290131e47336e7f6702e4ed438c27288649f1181f2","observation_id":"95653b0b-1556-409b-b70a-88bdde5909ad","resolution":{"observed_at":"2026-08-10T16:18:12.207359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-10T16:18:12.210558Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.210558Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:5c1be5e50048daf77e20efcf6c972702262354e8590104107e265d6f4b7cf5e6","observation_id":"b70a37a0-d2a2-4275-85cb-784e71c824ea","resolution":{"observed_at":"2026-08-10T16:18:12.210558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.683999Z","title":"Diffwave: A versatile diffusion model for audio synthesis","venue":null,"work_id":"85e0c937-e599-461a-b905-6ab1591c166a","year":null},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.214294Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:886741f6b7032f52d601e63171e8cd970ef9bea40abc56267007f91034e6e581","observation_id":"c84a2c4c-651e-4026-afc3-dd59c4fdabd5","resolution":{"observed_at":"2026-08-10T16:18:12.687559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.674031Z","title":"Sdxl-lightning: Progressive adversarial diffusion distillation, 2024","venue":null,"work_id":"aa6fddbf-c6ff-4973-990a-b4ddacf901cb","year":2024},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.217672Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:247a028ed818bde0839d2ad3def98defe8a16897c61c918ca61a4cff2bea3569","observation_id":"fc86caee-f6a1-4eea-ae8f-311b200e4ef0","resolution":{"observed_at":"2026-08-10T16:18:12.677560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10695","last_updated":"2024-10-21T20:01:13Z","snapshot_observed_at":"2026-07-06T19:16:23.103921Z","submitted_at":"2024-09-16T19:52:24Z","title":"Playground v3: Improving Text-to-Image Alignment with Deep-Fusion Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10695","snapshot_observed_at":"2026-08-10T16:18:12.220781Z","title":"Playground v3: Improving text-to-image alignment with deep-fusion large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.220781Z"},"links":{"cited_paper":"/paper/2409.10695","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:63342929b4bceb6a72226ed3982853d92cc0ab4afb1f3283e603a241fc0a2da9","observation_id":"39954511-0346-4579-987d-00fb6dd8ff98","resolution":{"observed_at":"2026-08-10T16:18:12.220781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.224247Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.224247Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:7d6d64ae3c269a6426fa461daa376d6bed2c297b83b40f63c68d5754406fa430","observation_id":"56dc96ee-3635-4e3d-9f63-c395b60c1cfe","resolution":{"observed_at":"2026-08-10T16:18:12.224247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12085","last_updated":"2024-07-18T16:04:19Z","snapshot_observed_at":"2026-07-06T16:50:10.189504Z","submitted_at":"2023-11-20T11:24:21Z","title":"Pyramid Diffusion for Fine 3D Large Scene Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12085","snapshot_observed_at":"2026-08-10T16:18:12.227573Z","title":"Pyramid diffusion for fine 3d large scene generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.227573Z"},"links":{"cited_paper":"/paper/2311.12085","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:7a0d095762c1d6d46844b8a5788dd3cfb77e7d2be9d44220cf26284e56150d13","observation_id":"0f05c97b-ed3a-49d2-b510-541428255ad6","resolution":{"observed_at":"2026-08-10T16:18:12.227573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.231257Z","title":"Dpm-solver: A fast ode solver for diffusion probabilistic model sampling in around 10 steps","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.231257Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:05eb8ef69c493e0453d806bafce2605998e28181b2a410659550e65d840b1e22","observation_id":"9e952232-a8b7-477e-8376-a4e7c886bcd9","resolution":{"observed_at":"2026-08-10T16:18:12.231257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01095","last_updated":"2025-05-19T07:56:56Z","snapshot_observed_at":"2026-07-29T20:17:21.488997Z","submitted_at":"2022-11-02T13:14:30Z","title":"DPM-Solver++: Fast Solver for Guided Sampling of Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01095","snapshot_observed_at":"2026-08-10T16:18:12.234323Z","title":"Dpm- solver++: Fast solver for guided sampling of diffusion probabilistic models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.234323Z"},"links":{"cited_paper":"/paper/2211.01095","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:fcc3e88477b6cfd1c1557d02d9ba264657d1a994ee6ab02f51558e165e45effa","observation_id":"fba1c7fe-ddbc-42d8-b40c-43526e2d9a6a","resolution":{"observed_at":"2026-08-10T16:18:12.234323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12376","last_updated":"2024-10-15T02:51:00Z","snapshot_observed_at":"2026-08-08T17:18:09.872627Z","submitted_at":"2024-02-19T18:59:07Z","title":"FiT: Flexible Vision Transformer for Diffusion Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12376","snapshot_observed_at":"2026-08-10T16:18:12.237904Z","title":"Fit: Flexible vision transformer for diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.237904Z"},"links":{"cited_paper":"/paper/2402.12376","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:7070c2ba37af875456434736b7596e38994e0fdacab7ad545ea9c7c0652b670a","observation_id":"d18cd26e-ae0d-49b2-a726-f9516fdd0697","resolution":{"observed_at":"2026-08-10T16:18:12.237904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08740","last_updated":"2024-09-23T15:59:41Z","snapshot_observed_at":"2026-08-10T16:29:09.535299Z","submitted_at":"2024-01-16T18:55:25Z","title":"SiT: Exploring Flow and Diffusion-based Generative Models with Scalable Interpolant Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08740","snapshot_observed_at":"2026-08-10T16:18:12.241739Z","title":"Sit: Exploring flow and diffusion-based generative models with scalable interpolant transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.241739Z"},"links":{"cited_paper":"/paper/2401.08740","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:3838e0b4c67839d3ff0a327c41128230ee86906d7e4f13013a08374054a2c3d9","observation_id":"8124b151-35e6-45e8-a91b-863bc93e4e5e","resolution":{"observed_at":"2026-08-10T16:18:12.241739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1411.1784","last_updated":"2014-11-06T22:33:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-11-06T22:33:22Z","title":"Conditional Generative Adversarial Nets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.1784","snapshot_observed_at":"2026-08-10T16:18:12.245367Z","title":"Conditional generative adversarial nets","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.245367Z"},"links":{"cited_paper":"/paper/1411.1784","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:52b503a77e8100b4a35e9c2da46937dd6f2e434edc9326c0cb5afc26a8bfdda0","observation_id":"fe3a9662-7ddf-4a0d-be28-94a60aa1adb5","resolution":{"observed_at":"2026-08-10T16:18:12.245367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.651539Z","title":"Swiftbrush: One-step text-to-image diffusion model with variational score distillation","venue":null,"work_id":"16e6c0f3-b4c1-476f-a88a-108776adedfc","year":2024},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.249017Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:3bed6a92a7aacc994316489b4a514ad9589ccfdc6eb7c6aaed7a4851ec1c6f04","observation_id":"b14e42e3-1a4b-4284-bd35-6573cf7c6024","resolution":{"observed_at":"2026-08-10T16:18:12.655347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.252526Z","title":"Improved denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.252526Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:bdfcb45ffd024c0b41223a347377186de82069bcbc9138f5610ab8c90bb3d26d","observation_id":"7bc2c760-941c-4b2e-8196-494270208f1e","resolution":{"observed_at":"2026-08-10T16:18:12.252526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.255983Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.255983Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:91e2296df7dcf0b514998c1d028b62c17e912a17603f6478de5125f08cc49be3","observation_id":"e7a3de48-3468-4143-9a18-99e8e99edf8e","resolution":{"observed_at":"2026-08-10T16:18:12.255983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-10T16:18:12.259362Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.259362Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:0db56c60a14688a641741770de86b524f1ea02632778ef83fab4efe492a3f716","observation_id":"5f1a9adb-7aa2-420d-9b4f-8f1fa30a0943","resolution":{"observed_at":"2026-08-10T16:18:12.259362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.628855Z","title":null,"venue":null,"work_id":"b3574f4a-43df-4f53-a8f6-366055fb916b","year":2021},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.262939Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:1894ac1242d1203541f9a820b7951500bf3726028e32b2303706721e873dc8f6","observation_id":"54036ca6-50a2-44f8-b370-3062a6aa00a9","resolution":{"observed_at":"2026-08-10T16:18:12.632406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.617899Z","title":"Generating diverse high-fidelity images with vq-vae-2","venue":null,"work_id":"a56e44b0-33ce-4b51-ad5c-21992cce7f33","year":2019},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.266258Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:051c5322c0e8563912534bb1d0c9f6de65215d1a5fe95def197f7160b83113ff","observation_id":"47031572-372c-456a-9629-078a47be0783","resolution":{"observed_at":"2026-08-10T16:18:12.621657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.269931Z","title":"High- resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.269931Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:d90552b7f6b4c9af2bc54495af1de50d048bdf389dcb5abfc5511ae6af0e10ee","observation_id":"f8456c8b-6428-4010-994e-74af120f22f5","resolution":{"observed_at":"2026-08-10T16:18:12.269931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.273220Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.273220Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:9733cc541cddc92508d457b15ece2b1077d5c93f80ec99790fba9f47bb7f9437","observation_id":"2e4bc64c-e057-44bd-96fe-5be43b3ad6c5","resolution":{"observed_at":"2026-08-10T16:18:12.273220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.276693Z","title":"Progressive distillation for fast sampling of diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.276693Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:a3921f97201460eced8d60506db1fda4c70d9017418ae5db300c910920df1d23","observation_id":"24c3cd2c-0383-4d41-846c-83a337e7c4ae","resolution":{"observed_at":"2026-08-10T16:18:12.276693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.280203Z","title":"Stylegan-xl: Scaling stylegan to large diverse datasets","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.280203Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:924ab2e78d3f6f5e1c538feb9c3e633f709ebb6453491dc450227b8ced8da0a0","observation_id":"3db7a48f-c2b8-4cdc-bf3d-173e03036369","resolution":{"observed_at":"2026-08-10T16:18:12.280203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.582671Z","title":"Make-a-video: Text-to-video generation without text-video data","venue":null,"work_id":"ba9ac3ba-05e2-461e-a646-f8f63c4ecd25","year":null},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.283643Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:650b8dba97b54cd45fdc2c09dc0d2423d96dc995a04e32731342231d00e3c64f","observation_id":"1b942d56-83f4-43a6-b3ec-8804801bece9","resolution":{"observed_at":"2026-08-10T16:18:12.586297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-10T16:18:12.287034Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.287034Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:3b703907e1491df31ba2482c32ead9e1d3ff05dc81f76a54c860442f48879266","observation_id":"a9a0775e-3f36-4b1e-b9e1-55c196391158","resolution":{"observed_at":"2026-08-10T16:18:12.287034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-10T16:18:12.293892Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.293892Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:d37b01db04c8cfd00ffc4fb2a2c4720e052e4a491d02e4ce86cc07a172fcdc5e","observation_id":"13121d95-7f15-432f-84a8-168a7d88e744","resolution":{"observed_at":"2026-08-10T16:18:12.293892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.572427Z","title":"Givt: Generative infinite-vocabulary transformers","venue":null,"work_id":"a7087a83-70f5-4828-bc35-588de1abca2a","year":2025},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.297177Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:9123a0c668b298472df410e1da96192c9b55e4a3d037e236d1465d8d5616c9e9","observation_id":"6a5a13cd-7c45-4c5f-95c7-33b3049b92e1","resolution":{"observed_at":"2026-08-10T16:18:12.576020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13925","last_updated":"2024-10-17T15:51:49Z","snapshot_observed_at":"2026-08-11T11:12:31.922902Z","submitted_at":"2024-10-17T15:51:49Z","title":"FiTv2: Scalable and Improved Flexible Vision Transformer for Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13925","snapshot_observed_at":"2026-08-10T16:18:12.300336Z","title":"Fitv2: Scalable and improved flexible vision transformer for diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.300336Z"},"links":{"cited_paper":"/paper/2410.13925","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:81be8940d85ab9ba737dd34acee6aba88ea273757166fd893fc0ac759937108f","observation_id":"8e300284-9b58-4daf-8007-77f0727afdf7","resolution":{"observed_at":"2026-08-10T16:18:12.300336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.561494Z","title":"PeRFlow: Piecewise rectified flow as universal plug-and-play accelerator","venue":null,"work_id":"c39fb059-35a2-4f50-8f67-e7ff184686e9","year":2024},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.303705Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:8750c8cdbeff7ac3b0f3fd928f41a611aa1e826899ba146f31434656a270d90b","observation_id":"f4d2239a-bfda-41a3-aef1-441303efa296","resolution":{"observed_at":"2026-08-10T16:18:12.565237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04627","last_updated":"2022-06-05T01:57:58Z","snapshot_observed_at":"2026-07-06T11:56:10.689708Z","submitted_at":"2021-10-09T18:36:00Z","title":"Vector-quantized Image Modeling with Improved VQGAN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04627","snapshot_observed_at":"2026-08-10T16:18:12.306951Z","title":"Vector-quantized image modeling with improved vqgan","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.306951Z"},"links":{"cited_paper":"/paper/2110.04627","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:e895f0e9f75a733fb16c2b20235208ea74b5048b47acb7266b83ad2e87dfda2f","observation_id":"fb64496d-7135-4027-a06a-8590fbc4fe10","resolution":{"observed_at":"2026-08-10T16:18:12.306951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08531","last_updated":"2024-10-11T05:03:56Z","snapshot_observed_at":"2026-07-06T19:31:36.072099Z","submitted_at":"2024-10-11T05:03:56Z","title":"Diffusion Models Need Visual Priors for Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08531","snapshot_observed_at":"2026-08-10T16:18:12.310367Z","title":"Diffusion models need visual priors for image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.310367Z"},"links":{"cited_paper":"/paper/2410.08531","citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:704a5ac482a58acff0c7ba6cb86d1cf2b9dcb57cdc04dd9911e9f201357ecbc0","observation_id":"1c9c8a19-715b-427b-bc51-cf315e2edc74","resolution":{"observed_at":"2026-08-10T16:18:12.310367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.313968Z","title":"Show-1: Marrying pixel and latent diffusion models for text-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.313968Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:a77622c638b76d59d1bc7f54bc8c7fd3e85e6260ad2c802eaf78b0b55fe66873","observation_id":"9c82f638-014e-44d9-a200-48afd0102450","resolution":{"observed_at":"2026-08-10T16:18:12.313968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.544689Z","title":"Dpm-solver-v3: Improved diffusion ode solver with empirical model statistics","venue":null,"work_id":"f5581c65-b62c-40c2-adb5-7127c5ccf982","year":2023},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.316998Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:a4d25526b3d33a5877bee6b2f1012f5d72a8d42074a2347c35ddb561de425ffa","observation_id":"1fcabc56-ad4b-41be-9b1b-b4d45c714aae","resolution":{"observed_at":"2026-08-10T16:18:12.548277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:18:12.531947Z","title":"Fast ode-based sampling for diffusion models in around 5 steps","venue":null,"work_id":"dea67e5f-ba17-4ec8-a3d4-b26594a67d1f","year":2024},"citing_paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:12.320037Z"},"links":{"citing_paper":"/paper/2501.13349"},"observation_digest":"sha256:9cc882ddfeefaa033f28a756c647863a123521064c7f2114527ff396df7a5fc3","observation_id":"1d1e7d36-e5a6-46d2-981f-ee3c81b9ec6e","resolution":{"observed_at":"2026-08-10T16:18:12.537455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.13349","last_updated":"2025-06-30T09:57:33Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T01:07:54.988811Z","submitted_at":"2025-01-23T03:18:23Z","title":"MSF: Efficient Diffusion Model Via Multi-Scale Latent Factorize"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2501.13349."}