Pith. sign in

Paper Citation Record · LEDGER

Masked Autoencoders Are Effective Tokenizers for Diffusion Models

As of 9 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 9 inbound Pith citation observations for arXiv:2502.03444.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.03444 v2

Coverage vector

measured 45 of 45 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-09T04:47:30.494924Z

measured 54 of 54 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 9 of 9 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:12:35.779135Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T20:50:11.463918Z

Reference resolution

45 of 45 outbound references displayed

  • verified exact0
  • verified fuzzy6
  • unresolved36
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch2

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 6d312cda-e11e-46ca-abe5-7d6bb89f6774 · outbound

This paper cites CFG++: Manifold-constrained Classifier Free Guidance for Diffusion Models.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models CFG++: Manifold-constrained Classifier Free Guidance for Diffusion Models

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.300523Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.300523Z digest=sha256:8c194bfbceb233a0e3abb62b3308bd33f90a4d70536671dac54aa49a209b286f

Observation 315e1a6b-2f5c-467e-9166-774844a93d46 · outbound

This paper cites We use a classifier-free guidance scale of 2.0.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models We use a classifier-free guidance scale of 2.0

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T04:47:31.353123Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T04:47:30.471173Z digest=sha256:95e086a3295eac322fd2307f2d1cb9847255c1e0905d5c27e9205ab927e5cc3b

Observation c320df9f-cd57-4c37-a478-7d707f9ab734 · outbound

This paper cites Imagenet: A large-scale hierarchical image database.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Imagenet: A large-scale hierarchical image database

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.315643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.315643Z digest=sha256:98b1d3c2fc80e14b35104cdf58d3eb3b0ecd18325b8141a283dbddc2216c3fe2

Observation 9abfc1e2-5d1f-4142-a911-d84939b87c1a · outbound

This paper cites MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.325347Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.325347Z digest=sha256:9839c553f9b6166aa6512932066c850a1f0515b56b28c7e0deacb4c4f8b22dca

Observation 9fd820e9-6c9f-4c1d-ab9b-dc06f0d92388 · outbound

This paper cites Learning Mixtures of Gaussians Using Diffusion Models.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Learning Mixtures of Gaussians Using Diffusion Models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.330316Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.330316Z digest=sha256:10504c66b143994897e524487a638e466de06fe05c94d3158ed8be2f435486fc

Observation 34a3c264-4b60-4807-8bb5-2c4553194f57 · outbound

This paper cites Rethinking the Objectives of Vector-Quantized Tokenizers for Image Synthesis.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Rethinking the Objectives of Vector-Quantized Tokenizers for Image Synthesis

Reference 11

Resolution
metadata mismatch
local_arxiv, observed 2026-08-09T04:47:31.134178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T04:47:30.334536Z digest=sha256:da2e04d8648fa5121dec485bca1dd7bf2896eb3868f3a9a7c54fff873a57f6e6

Observation ef981338-a86b-4db4-a4ba-fe029231fdfb · outbound

This paper cites Auto-Encoding Variational Bayes.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Auto-Encoding Variational Bayes

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.352649Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.352649Z digest=sha256:f24913d302fbd71047296120293fe9bbdcca0fbbdd7c72c187855fa4f537a902

Observation 3659ef7d-8169-4307-be1f-38c83d87caef · outbound

This paper cites Applying Guidance in a Limited Interval Improves Sample and Distribution Quality in Diffusion Models.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Applying Guidance in a Limited Interval Improves Sample and Distribution Quality in Diffusion Models

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.357328Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.357328Z digest=sha256:8ec4cfa82c87a5c38453ee07b7eb63d76b65a020247aceeec923ce99a308c362

Observation ca61901c-c8ed-4221-8b40-163581a829ae · outbound

This paper cites Scalable autoregressive image generation with mamba.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Scalable autoregressive image generation with mamba

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.362139Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.362139Z digest=sha256:54c59f19431d9b96967f5433db0d88dc3fe66b8b2935b5811c4a26cded7a176f

Observation 88c84e75-e3bf-4e02-9c0d-9be1286d50b3 · outbound

This paper cites MAGE: MAsked Generative Encoder to Unify Representation Learning and Image Synthesis.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models MAGE: MAsked Generative Encoder to Unify Representation Learning and Image Synthesis

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.366749Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.366749Z digest=sha256:bf2a082305f1df321fa5eae27db81f7b85b7bec2a9633e6577c8b53bd45034b3

Observation 053c4ca8-c933-48e5-b03b-5a8c7e27cd38 · outbound

This paper cites Decoupled Weight Decay Regularization.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Decoupled Weight Decay Regularization

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.376382Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.376382Z digest=sha256:788639a26a511b4455ab85e6ef328647526d3fc2bfcb571a66aad9edfaa3eb6b

Observation 0a433903-6052-4c93-b615-41bf8acf14fb · outbound

This paper cites UMAP: Uniform Manifold Approximation and Projection for Dimension Reduction.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models UMAP: Uniform Manifold Approximation and Projection for Dimension Reduction

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.385806Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.385806Z digest=sha256:f2453f9007010bda916ad761cde9f9d8b1fface08b573ffc5fa9d7430c852606

Observation 2ee4a99d-0bbd-494a-9b1a-e028a53457a1 · outbound

This paper cites Improved Denoising Diffusion Probabilistic Models.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Improved Denoising Diffusion Probabilistic Models

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.390516Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.390516Z digest=sha256:6bb545cc57b4e425ac7942cfdb46affdf54df935ea801ab24efbbd64ef35c33d

Observation 1676abbe-ba08-44e0-820a-fb3536d78cfd · outbound

This paper cites Scalable Diffusion Models with Transformers.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Scalable Diffusion Models with Transformers

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.395192Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.395192Z digest=sha256:ccc5c62245f0a9ae4a1c54890cfeacafb3c575dc2e636b48c6375cacd938771a

Observation bfbc628b-1402-4466-848a-af856d58595a · outbound

This paper cites TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.399979Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.399979Z digest=sha256:68dec9ab69a6184852b281e96cc39e57eb4115be315311cba2086422ff46aa2f

Observation 2be2b9d3-15af-4ebb-b77f-ac0de51c7674 · outbound

This paper cites Generating Diverse High-Fidelity Images with VQ-VAE-2.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Generating Diverse High-Fidelity Images with VQ-VAE-2

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.404988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.404988Z digest=sha256:665ac138f7514daadd23cb6f1a05156df322b77e6526330c906975892933164f

Observation 0c90efcd-9360-477c-823a-011764809218 · outbound

This paper cites Deep Unsupervised Learning using Nonequilibrium Thermodynamics.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Deep Unsupervised Learning using Nonequilibrium Thermodynamics

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.410224Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.410224Z digest=sha256:017a587e8cf68d2ab82108995e52c552b5831accedc89987ea409aca9818ac41

Observation 7845f076-7985-4bf3-b12a-2c0f6a261ec7 · outbound

This paper cites Denoising Diffusion Implicit Models.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Denoising Diffusion Implicit Models

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.415234Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.415234Z digest=sha256:6c660fea2c002c3a0fe2bba28e31e7d00af3061fde68f38f8aea284a34f03f7a

Observation 0042ac06-01d5-435c-9301-8887c412a26f · outbound

This paper cites Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.420636Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.420636Z digest=sha256:dfb95cead5c680e180ccc6d62d414f361c2d5eaa75ce97d9f8f45fdf99167eea

Observation 3ae13516-c185-4215-a967-7403ede333d0 · outbound

This paper cites Regularizing Generative Adversarial Networks under Limited Data.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Regularizing Generative Adversarial Networks under Limited Data

Reference 30

Resolution
metadata mismatch
local_arxiv, observed 2026-08-09T04:47:30.672090Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T04:47:30.425246Z digest=sha256:fe3f7c501382b142a53a18d1097843c2bc6814f3b934eb74577f37d300633eca

Observation 9c516e76-6e6f-4fdd-b728-951fc1a6e7c9 · outbound

This paper cites Score-based Generative Modeling in Latent Space.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Score-based Generative Modeling in Latent Space

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.429558Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.429558Z digest=sha256:0fc5cdc88d2b37ca3501c012909e9b0bf1aee38cf8599f6dac0998bd30c9f68d

Observation f7d35cb9-8cda-4fba-b775-fdecb24ba814 · outbound

This paper cites Attention Is All You Need.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Attention Is All You Need

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.433779Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.433779Z digest=sha256:2c528cd993b59cf752e089ce459781666b26f3524aeb5165d968fe6b03b8cb82

Observation 9bdb1c11-5e51-44e8-889d-93ead04943f4 · outbound

This paper cites VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.442646Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.442646Z digest=sha256:14aa0c7d8423886e5b78982bdbd38df75a5aa68047386d71112d3acff4391e9b

Observation 4975f68d-d73b-4453-ba8e-dd1a490ff62e · outbound

This paper cites Reconstruction vs. Generation: Taming Optimization Dilemma in Latent Diffusion Models.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Reconstruction vs. Generation: Taming Optimization Dilemma in Latent Diffusion Models

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.447243Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.447243Z digest=sha256:1da4d1edee023df2d85aa6a86d2fad8638d3fe27176ff8eaa9f326e66635af1e

Observation 789bfca7-de10-42f5-9113-b2459896a84b · outbound

This paper cites Vector-quantized Image Modeling with Improved VQGAN.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Vector-quantized Image Modeling with Improved VQGAN

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.452091Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.452091Z digest=sha256:2e0d4c0006796a04b3f419a4416ef99d492dc77b93e255509899058e583d1dc0

Observation 4f9e08ab-7385-45d3-8d59-89606488a16e · outbound

This paper cites Randomized Autoregressive Visual Generation.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Randomized Autoregressive Visual Generation

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.456843Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.456843Z digest=sha256:7f3cdaa392f0a927e8ddefdfe306fe63b5b7e9bd255b27335bab9d1a5319a1d0

Observation e9a29faf-4e30-48b8-973d-ebf8d3f21bbf · outbound

This paper cites The Unreasonable Effectiveness of Deep Features as a Perceptual Metric.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models The Unreasonable Effectiveness of Deep Features as a Perceptual Metric

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.461611Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.461611Z digest=sha256:d423fa2535f5704586c305e688f649e879e24a37da741ddf75fa632c3e94a8e7

Observation 6d3811b7-d03b-4fa6-9681-480d2b127e50 · outbound

This paper cites Scaling the Codebook Size of VQGAN to 100,000 with a Utilization Rate of 99%.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Scaling the Codebook Size of VQGAN to 100,000 with a Utilization Rate of 99%

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.466469Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.466469Z digest=sha256:705d06cfdfec7ae630ca236c3f5b41329e899566948506128aa55903cb135f4f

Observation 6e725b27-a52b-4da1-883d-cbc5aafd01f2 · outbound

This paper cites We use a classifier-free guidance scale of 2.0.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models We use a classifier-free guidance scale of 2.0

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T04:47:31.336142Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T04:47:30.475930Z digest=sha256:5f1c8f3393d09dc38c57cd3124f7c1499c5c093a21b59ecc6fc786df1b77eaa2

Observation ea03c417-bd11-4343-8e02-e564b5aab4e5 · outbound

This paper cites The maximum mean norm of the GMM in GMM 9 is bounded as: maxi ∥µi∥ ≤B.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models The maximum mean norm of the GMM in GMM 9 is bounded as: maxi ∥µi∥ ≤B

Reference 42

Resolution
malformed identifier
raw_fallback, observed 2026-08-09T04:47:31.320117Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T04:47:30.480997Z digest=sha256:d905e212aafaf60ebcd42498c3c371a8c6708b4f6b7ab061e72b558c0d29fa8e

Observation a53ad343-15a8-4942-b1db-7bb10809d55d · outbound

This paper cites In the practical sampling process, we adopt an early stopping strategy to improve the generation quality.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models In the practical sampling process, we adopt an early stopping strategy to improve the generation quality

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T04:47:31.304732Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T04:47:30.485553Z digest=sha256:f92d43b5632a0144e9b3c2e5c887581aad8fa7248038e88d6039437eb9be4e5b

Observation 5d3181e5-2e0c-4a4a-9cf4-19b46a46baba · outbound

This paper cites Training Details of Diffusion Models We present the training details of SiT-XL and LightningDiT in Tables 8 and 9, which mainly follows their original setup.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Training Details of Diffusion Models We present the training details of SiT-XL and LightningDiT in Tables 8 and 9, which mainly follows their original setup

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T04:47:31.289147Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T04:47:30.490415Z digest=sha256:737ae36d526a6355ac1c7c10dcdf4338f127e594e921e4b1fa464fc5eff9cf19

Observation 8e55d054-6c21-4d98-9a48-7c40f22e0da3 · outbound

This paper cites However, it is still extremely difficult to tune the guidance scale.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models However, it is still extremely difficult to tune the guidance scale

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T04:47:31.273750Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T04:47:30.494924Z digest=sha256:11e3d5be0cc71efe5065cce362acefc18c3820a97ff307df5338165d7c6a2dd7

Observation a20dbb75-36c4-4e3b-9cae-5272442fb366 · outbound

This paper cites Causal Diffusion Transformers for Generative Modeling.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Causal Diffusion Transformers for Generative Modeling

Reference 2005

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.310301Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.310301Z digest=sha256:1e1b08a87998bde120d083e744a944a9ddbabac950469c0ee017704b3fbc846f

Observation e36ec6ca-3dd3-4f37-a2c6-5abd453e03b0 · outbound

This paper cites Classifier-Free Diffusion Guidance.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Classifier-Free Diffusion Guidance

Reference 2006

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.338682Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.338682Z digest=sha256:ccb8c5c8f8b14cec48b8095c4078b12426712a9d646bedf08a9b681b1e0f01fd

Observation 9a160977-3b0c-4400-874c-3912974a14f7 · outbound

This paper cites MaskBit: Embedding-free Image Generation via Bit Tokens.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models MaskBit: Embedding-free Image Generation via Bit Tokens

Reference 2008

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.438125Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.438125Z digest=sha256:f0277d5b2d9ed32eeb878ba5e4418c2fcea9845017ec9d7b4522c5ab04d61458

Observation 51b913ed-3f84-47ad-ac19-9eda566c17f7 · outbound

This paper cites Customize Your Visual Autoregressive Recipe with Set Autoregressive Modeling.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Customize Your Visual Autoregressive Recipe with Set Autoregressive Modeling

Reference 2014

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.371836Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.371836Z digest=sha256:899037c38fd2d8ad53d76691e81e79cf9056b97ec17cef721f1ebfea525e649a

Observation 7a95c3cd-3a25-4e98-a7a1-e6a11eefd6d4 · outbound

This paper cites SiT: Exploring Flow and Diffusion-based Generative Models with Scalable Interpolant Transformers.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models SiT: Exploring Flow and Diffusion-based Generative Models with Scalable Interpolant Transformers

Reference 2017

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.381159Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.381159Z digest=sha256:b90fd51ac6c4384bb73d9d62318730e5eac0341cbb43e9f8faa859097de7de7b

Observation 31e2148c-9c66-4b9c-a47c-a060c0486208 · outbound

This paper cites Image-to-Image Translation with Conditional Adversarial Networks.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Image-to-Image Translation with Conditional Adversarial Networks

Reference 2018

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.342780Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.342780Z digest=sha256:61f4f0ec621486b0ca56fed63efb93fef241dce3636ce08a37931632952c04ed

Observation 5eaf9259-0ec0-4663-813e-57d3c40d5615 · outbound

This paper cites Guiding a Diffusion Model with a Bad Version of Itself.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Guiding a Diffusion Model with a Bad Version of Itself

Reference 2019

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.347845Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.347845Z digest=sha256:6918898b182333fe18d6cdd2c3648a5794551a647423e1895844d27b83666929

Observation 8cca33ac-068e-4140-9d17-48f02b7732b5 · outbound

This paper cites An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.320373Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.320373Z digest=sha256:1c55a166133650d7ec5e4816fc61dee0c5e1496ce94230a3a2f424ee716e117f

Observation 83404af6-721b-4943-aeed-36ae6ac0d05f · outbound

This paper cites MaskGIT: Masked Generative Image Transformer.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models MaskGIT: Masked Generative Image Transformer

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.283979Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.283979Z digest=sha256:31793ae78d586cdaef30dec84df6569707d513e10967d33f88c94d75acf71654

Observation be54b425-21eb-4843-b885-592c25502b3c · outbound

This paper cites SoftVQ-VAE: Efficient 1-Dimensional Continuous Tokenizer.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models SoftVQ-VAE: Efficient 1-Dimensional Continuous Tokenizer

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.290200Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.290200Z digest=sha256:7579c964ae6afc6ece21106e4752827ebb74aa1e0bf467604a2ac04c9339d6f0

Observation 71d0b6c1-6bc6-4407-bb9f-b9a987532ae2 · outbound

This paper cites and Triggs, B.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models and Triggs, B

Reference 2024

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T04:47:31.378624Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T04:47:30.305669Z digest=sha256:0cf988fef8a8b5de44e3c82cd2f2715a5fc1470db6bf0de723f816de9816ecb4

Observation 3cd3ba6e-4080-43b1-828f-b5e18f19838f · outbound

This paper cites Deep Compression Autoencoder for Efficient High-Resolution Diffusion Models.

Masked Autoencoders Are Effective Tokenizers for Diffusion Models Deep Compression Autoencoder for Efficient High-Resolution Diffusion Models

Reference 2025

Resolution
unresolved
no resolver link, observed 2026-08-09T04:47:30.295488Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T04:47:30.295488Z digest=sha256:5a8fff38b2153325fae6a7d3e1215d376e684c05a1dfc5907e18c1eb5bea770f

Pith citing papers

Observation 09e89c9d-4461-4f07-b14a-1ef1dc47bfe1 · inbound

Physics-Informed Distillation of Diffusion Models for PDE-Constrained Generation cites this paper.

Physics-Informed Distillation of Diffusion Models for PDE-Constrained Generation Masked Autoencoders Are Effective Tokenizers for Diffusion Models

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T13:12:35.779135Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:12:35.779135Z digest=sha256:6742997d806b9a3c2dd4ea3668056932ce692517b82a678d4657e98e25c3d7c6

Observation fc96ed1b-a237-4583-bd10-bb1af9f6da46 · inbound

Adaptive Mask-guided K-space Diffusion for Accelerated MRI Reconstruction cites this paper.

Adaptive Mask-guided K-space Diffusion for Accelerated MRI Reconstruction Masked Autoencoders Are Effective Tokenizers for Diffusion Models

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-06T23:28:32.384911Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:28:32.384911Z digest=sha256:1a31babbba2d348c47ec50a18b5d924913a5da3d2df96367c290886c76e65e38

Observation 137e2f05-51d3-4712-84a0-7b96c1511d17 · inbound

DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer cites this paper.

DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer Masked Autoencoders Are Effective Tokenizers for Diffusion Models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-06T19:41:23.628002Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:41:23.628002Z digest=sha256:b72c427e481fcd567194d272f3ae160409f8c97e3d52421b13c708a592fc500a

Observation c09e4615-7060-4e87-b943-575ace00a510 · inbound

VibeToken: Scaling 1D Image Tokenizers and Autoregressive Models for Dynamic Resolution Generations cites this paper.

VibeToken: Scaling 1D Image Tokenizers and Autoregressive Models for Dynamic Resolution Generations Masked Autoencoders Are Effective Tokenizers for Diffusion Models

Reference 4

Resolution
verified exact
arxiv_id, observed 2026-05-11T21:51:11.648909Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-08T04:12:58.100610Z digest=sha256:c54521af78189a48a58c7ad6fe1648814081fac175ec80c4c8bed0da18a01ea7

Observation f8443c64-a3fa-43e1-811f-321cf04f6d35 · inbound

What Matters for Diffusion-Friendly Latent Manifold? Prior-Aligned Autoencoders for Latent Diffusion cites this paper.

What Matters for Diffusion-Friendly Latent Manifold? Prior-Aligned Autoencoders for Latent Diffusion Masked Autoencoders Are Effective Tokenizers for Diffusion Models

Reference 10

Resolution
verified exact
arxiv_id, observed 2026-05-11T04:05:57.608936Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-11T01:57:24.033068Z digest=sha256:bf46d23ab2b37d60a02d24cd46f15fd3443edc165e8c1cd5e2459e902ab76945

Observation 3f86571b-014d-4824-af0c-f2585530ecbe · inbound

Structure over Pixels: Learning Variable-Length Visual Programs cites this paper.

Structure over Pixels: Learning Variable-Length Visual Programs Masked Autoencoders Are Effective Tokenizers for Diffusion Models

Reference 17

Resolution
verified exact
arxiv_id, observed 2026-06-29T18:13:49.025604Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-29T18:06:01.684713Z digest=sha256:f84581239042488cbefcb9e76c95af3607ac087b93ea9350c2861f501ca67945

Observation 6ab563c2-edc8-4d08-a21e-3afb9d76a152 · inbound

BrainG3N: A Dual-Purpose Tokenizer for Controllable 3D Brain MRI Generation cites this paper.

BrainG3N: A Dual-Purpose Tokenizer for Controllable 3D Brain MRI Generation Masked Autoencoders Are Effective Tokenizers for Diffusion Models

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-07-04T01:19:21.135295Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-26T20:29:00.314097Z digest=sha256:b58abc03e607875a51d619ffe3e11e7da19a2c703cbe183b2a16795a8c8af759

Observation 5bc0004d-beb8-490a-84fe-e00b9c9924c4 · inbound

BrainG3N: A Dual-Purpose Tokenizer for Controllable 3D Brain MRI Generation cites this paper.

BrainG3N: A Dual-Purpose Tokenizer for Controllable 3D Brain MRI Generation Masked Autoencoders Are Effective Tokenizers for Diffusion Models

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-02T10:53:54.467279Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T10:53:54.467279Z digest=sha256:850c02135ac8ee1b172903efa62a3449cfbb72e9ed09e440a8031d8439e29494

Observation ab64295f-cce5-480c-a75a-0eaca0356265 · inbound

MIMFlow: Integrating Masked Image Modeling with Normalizing Flows for End-to-End Image Generation cites this paper.

MIMFlow: Integrating Masked Image Modeling with Normalizing Flows for End-to-End Image Generation Masked Autoencoders Are Effective Tokenizers for Diffusion Models

Reference 1

Resolution
verified exact
arxiv_id, observed 2026-07-04T20:50:11.467934Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-25T19:34:02.046104Z digest=sha256:73451b9834d9cdb524c07f77d231a8e7af85e1783829c477d3b71dee4363fe36