{"as_of":"2026-08-10T17:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3fc299d9feee86f0a32e8c1ae3131d3ccb2c12a3ad0c640928ff7edd37ea997d","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:22:23.749597Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19089/citation-record","integrity":"/paper/2505.19089/integrity","json":"/paper/2505.19089/citation-record.json","paper":"/paper/2505.19089"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:30.322222Z","title":"Structured denoising diffusion models in discrete state-spaces","venue":null,"work_id":"929b1813-000d-45aa-89d0-e740ce59d04f","year":2021},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:19.702342Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:fd7b7e4b076e9f048ab9a4717db875577c05a7e6ef8402d287ca3158315751bc","observation_id":"d2b6a849-60a0-4afb-b9ca-0f7df212d632","resolution":{"observed_at":"2026-08-07T14:22:30.356164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:30.152031Z","title":"All are worth words: a vit backbone for score-based diffusion models","venue":null,"work_id":"f3fed24a-dddc-4b3f-8155-eb37b8bf3ca1","year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:19.783708Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:d8bb28c570a07eb6d15b4f21545458c5c26e80ea68e70e3341b3863de687ad18","observation_id":"c8422181-518a-4c94-8933-a6528b173ac8","resolution":{"observed_at":"2026-08-07T14:22:30.225543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:30.052910Z","title":"Beit: Bert pre-training of image transformers","venue":null,"work_id":"573b0773-b90f-4aaf-8dd1-8d60ea11afb9","year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:19.894865Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:91f0ac6e8d9547dd1cac04693437ced393bf52b8b07c39c7a86a5415d907146c","observation_id":"db864d19-a145-4a53-a48b-364b021c169f","resolution":{"observed_at":"2026-08-07T14:22:30.092278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:29.896073Z","title":"Freeman, Michael Rubinstein, Yuanzhen Li, and Dilip Krishnan","venue":null,"work_id":"8187df60-6e34-43cf-9637-57d2ca619231","year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.057049Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:c22f3d64005de4793e384dd1c54c21c97c3a3698270df3dc37c46f48e31ff6f8","observation_id":"29ecc8be-668b-4141-aacc-df82402ad5ad","resolution":{"observed_at":"2026-08-07T14:22:29.945378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:29.745458Z","title":null,"venue":null,"work_id":"c50f16e5-6980-4504-a3ea-5808a5445664","year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.094167Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:7ec94c001326d44f362682d20f4d6682191dfe1b14134d693bf1d8e62e439f86","observation_id":"9c142a2c-0f5c-463f-a2a1-0a450ea1482e","resolution":{"observed_at":"2026-08-07T14:22:29.806377Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12095","last_updated":"2024-12-17T18:45:55Z","snapshot_observed_at":"2026-07-06T20:07:58.873037Z","submitted_at":"2024-12-16T18:59:29Z","title":"Causal Diffusion Transformers for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12095","snapshot_observed_at":"2026-08-07T14:22:20.175049Z","title":"Causal diffusion transformers for generative modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.175049Z"},"links":{"cited_paper":"/paper/2412.12095","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:2157fe0c6ef7ac3b9a9d4cc6362d3b7461f3f9744c1f25a818f1105747e04841","observation_id":"207544d0-fa63-42af-8ba3-7adbd0774495","resolution":{"observed_at":"2026-08-07T14:22:20.175049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.258861Z","title":"ImageNet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.258861Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:fc58dab42bc8f50c3fea3ccd909480fe19c99a7ccb6d10c4af9f5a1310f6ca1c","observation_id":"48c074fd-7cda-4857-a63b-fd1d368489ce","resolution":{"observed_at":"2026-08-07T14:22:20.258861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.394852Z","title":"Bert: Pre-training of deep bidi- rectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.394852Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:9171454aba2f30d996bff49a9ca0b834145467a1650f1e6db8e63d50437f432d","observation_id":"e28a6360-7857-4299-b76b-3fca6162c69e","resolution":{"observed_at":"2026-08-07T14:22:20.394852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:29.533152Z","title":"Diffusion models beat GANs on image synthesis","venue":null,"work_id":"279c1d52-f83f-48ef-be68-6916892e9a7d","year":2021},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.455774Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:f9be2038772aac3c8a4e31ef0a429fd4c035fddd46fb6ce928fd4f8789902a83","observation_id":"32c914a6-4410-439a-a1f4-208194db83a4","resolution":{"observed_at":"2026-08-07T14:22:29.620944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:29.376515Z","title":"Imagebart: Bidirectional context with multinomial diffusion for autoregressive image synthesis","venue":null,"work_id":"6ec10e17-16f6-451c-8356-9f1e1999c2b4","year":2021},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.509207Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:c54ac3a8cbbddecf902b605d784824bbaed40c3c42133daa75b0b57889bd5066","observation_id":"c5d6181c-560b-47bb-ab72-0bddcc2b0870","resolution":{"observed_at":"2026-08-07T14:22:29.444541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:28.945632Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"60f53d43-97ab-42f0-9e5c-2e027851fada","year":2021},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.562051Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:12fa751df579309ff6a8a669dbbbf71e17ba667f65a9e934b4aed9eb9b09dd72","observation_id":"43f9f8bc-184f-4c2c-b7bd-516e714fb2e8","resolution":{"observed_at":"2026-08-07T14:22:29.209123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13863","last_updated":"2024-10-17T17:59:59Z","snapshot_observed_at":"2026-08-07T22:15:46.490983Z","submitted_at":"2024-10-17T17:59:59Z","title":"Fluid: Scaling Autoregressive Text-to-image Generative Models with Continuous Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13863","snapshot_observed_at":"2026-08-07T14:22:20.617028Z","title":"Fluid: Scaling autoregressive text-to-image generative models with continuous tokens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.617028Z"},"links":{"cited_paper":"/paper/2410.13863","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:414e1ca5871ebdac25158b64dc036d52929be05ca01fb32ac5547c20d3a180ff","observation_id":"ff9a1bf0-9ae0-41b2-bb10-e2ba1b3f28b3","resolution":{"observed_at":"2026-08-07T14:22:20.617028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-08-10T05:10:07.410706Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-07T14:22:20.756291Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.756291Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:b0b80053b8b74a5b65a6de8c6c5fc907ed1c800208012fe3b720f75015643d89","observation_id":"8c35af6d-d189-4965-aad3-4868b574bc21","resolution":{"observed_at":"2026-08-07T14:22:20.756291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.15833","last_updated":"2020-12-31T18:52:59Z","snapshot_observed_at":"2026-08-06T08:31:42.642575Z","submitted_at":"2020-12-31T18:52:59Z","title":"Fully Non-autoregressive Neural Machine Translation: Tricks of the Trade","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.15833","snapshot_observed_at":"2026-08-07T14:22:20.810497Z","title":"Fully non-autoregressive neural machine translation: Tricks of the trade","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.810497Z"},"links":{"cited_paper":"/paper/2012.15833","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:0616d952b5f9482abb873ea0af2578d78689f2029d35269111c804890c7bbbfd","observation_id":"d5fdfa04-02ea-4bfa-9e37-b2f8d092c6e7","resolution":{"observed_at":"2026-08-07T14:22:20.810497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:28.622453Z","title":"Vector quantized diffusion model for text-to-image synthesis","venue":null,"work_id":"86aadd7c-b088-4ca1-80ef-066967d85193","year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.870748Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:80eaa5930c1f21830876a13ffd82c778c1ca8c65f8f0d912c42961551f68095e","observation_id":"970f4271-30f9-402d-a7bc-768b5ffa2a9d","resolution":{"observed_at":"2026-08-07T14:22:28.745354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.922968Z","title":"Diffit: Diffusion vision transformers for image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.922968Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:c6cad0a5905b1dc268bfc145dd77d4a7edad5e2ff16d0bb2dbb746cb57e0be23","observation_id":"dd81193a-d53f-4bc1-aebe-6776476addf6","resolution":{"observed_at":"2026-08-07T14:22:20.922968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:21.020154Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.020154Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:5e48582a2eaa64c8cd1f0be3a3e20001dea3f0bbc0e55347cdadd7fa29bfb906","observation_id":"75ac87fc-86a8-4134-b102-e97c73a02b5d","resolution":{"observed_at":"2026-08-07T14:22:21.020154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:28.252847Z","title":"GANs trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":"dd5d42f0-610e-4a43-9546-c7f337287cb7","year":2017},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.098532Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:bc2049da3038cf606dd56a19897d95d63537921822f42d911c83a08b40c5921c","observation_id":"d7132c5e-5369-4d0e-a71e-927939234de6","resolution":{"observed_at":"2026-08-07T14:22:28.386531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-07T14:22:21.160809Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.160809Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:31daaee4d69dff3a40380e19d9a7a7b2a7281d554eaaa52b52d20991ef10b82a","observation_id":"df36ca3e-ca12-466b-a998-44f23e86eb80","resolution":{"observed_at":"2026-08-07T14:22:21.160809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:27.989031Z","title":"Understanding diffusion objectives as the elbo with simple data augmentation","venue":null,"work_id":"8446696b-e71c-4ec1-913f-ef6e26041c53","year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.240183Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:e493aaac14fcc7f38852017713be9e2d3b9b065eb81608fc9a103ecf0f22044d","observation_id":"24ccbca6-32bc-4891-a6ae-95261f4593a9","resolution":{"observed_at":"2026-08-07T14:22:28.061163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07724","last_updated":"2024-11-06T14:29:36Z","snapshot_observed_at":"2026-08-10T01:37:20.737480Z","submitted_at":"2024-04-11T13:16:47Z","title":"Applying Guidance in a Limited Interval Improves Sample and Distribution Quality in Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07724","snapshot_observed_at":"2026-08-07T14:22:21.350491Z","title":"Applying guidance in a limited interval improves sample and distribution quality in diffusion models.arXiv preprint arXiv:2404.07724, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.350491Z"},"links":{"cited_paper":"/paper/2404.07724","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:de5bc51d77c8476147dca3e9f84f9129f2ba0b6ffccc269c451c4db118dc497c","observation_id":"7b10031d-dc6c-4bad-aeac-c3f5444fed2e","resolution":{"observed_at":"2026-08-07T14:22:21.350491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:21.420593Z","title":"Autoregressive image generation using residual quantization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.420593Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:daa96af38d753f995becefc2691cc5df5e176b4e819fcaf9e566900de49c1d7d","observation_id":"bb6559a1-261d-4d0d-9d0c-90f549c4ea2b","resolution":{"observed_at":"2026-08-07T14:22:21.420593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:27.876134Z","title":"Draft-and-revise: Effective image generation with contextual rq-transformer","venue":null,"work_id":"e8276173-a56f-4428-98cd-3253c23b9834","year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.454887Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:dbb89d90c21c4748ed8014b76db697a40188348be837bf6d698d9e7aee7309ef","observation_id":"e9dabb62-c939-4e62-91ce-5790ad3eeb49","resolution":{"observed_at":"2026-08-07T14:22:27.917270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:21.484277Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.484277Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:b8d0f902df0ea796e62cc3a247beaf2b983ab5afc8da64aee8cdb78bc03ca18f","observation_id":"3b0d97da-c2bc-4702-9c52-0f6d70eb038f","resolution":{"observed_at":"2026-08-07T14:22:21.484277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:27.553002Z","title":"Improved masked image generation with token- critic","venue":null,"work_id":"08775922-ee5c-4af6-8903-2d0227488e7e","year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.533354Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:b232ceba39edfd04434dc1561462fd16f6b23d6db3e6184e110e5cf147fdf558","observation_id":"34083a7a-8d7e-4cfc-8730-4ad1f4e16114","resolution":{"observed_at":"2026-08-07T14:22:27.763904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:27.012991Z","title":"Discrete predictor- corrector diffusion models for image synthesis","venue":null,"work_id":"169d265f-9130-495f-95f6-8b40a863108b","year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.629552Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:37a5b8d92322d9b618d519a980c94b79ba35a2fbcc496ffd6decee0a71680558","observation_id":"6cc8e6df-2358-40dc-a244-5753c776b877","resolution":{"observed_at":"2026-08-07T14:22:27.321907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:26.602350Z","title":"Mage: Masked generative encoder to unify representation learning and image synthesis","venue":null,"work_id":"bac8302c-11f2-482f-b736-4573e126e491","year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.712465Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:f7fc247418cbf8cd613d523ad9958001086bed550830af9a0de9fbdbb4f93442","observation_id":"8a2ee06b-b9ef-4550-90b2-aac8dc92d642","resolution":{"observed_at":"2026-08-07T14:22:26.722456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:26.494297Z","title":"Return of unconditional generation: A self-supervised representation generation method","venue":null,"work_id":"1fec1835-f7c8-40a4-bfd3-ed6b5376ffc0","year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.779255Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:eb60cd654170cd97e72d0d534263c57e657ade5d2f3133f27b4d788eae7a0a1f","observation_id":"92b546f6-50d1-415d-b2e0-ac66d25494ae","resolution":{"observed_at":"2026-08-07T14:22:26.560726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:26.285521Z","title":"Autoregressive image generation without vector quantization","venue":null,"work_id":"03658155-0e80-4283-b0a7-e5e57c02e7ba","year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.818234Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:f20428d70d94b442136d2afddc28c7282a97ba1c5559b7c1ddb7ded8a637e6a2","observation_id":"f2a1fb4d-da3b-47b0-8443-ff369f92c998","resolution":{"observed_at":"2026-08-07T14:22:26.352817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01949","last_updated":"2025-03-19T08:34:29Z","snapshot_observed_at":"2026-08-10T07:06:17.534336Z","submitted_at":"2024-10-02T18:51:38Z","title":"Discrete Copula Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01949","snapshot_observed_at":"2026-08-07T14:22:21.919608Z","title":"Discrete copula diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.919608Z"},"links":{"cited_paper":"/paper/2410.01949","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:a7d8af1811d67a2b4c8112c8e4a802142821ac764681104522b0a7c6a6c1e2b4","observation_id":"ebd10694-5bfd-499c-918e-2d38c0357b32","resolution":{"observed_at":"2026-08-07T14:22:21.919608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:26.057715Z","title":"Maskpredict: Parallel decoding of conditional masked language models","venue":null,"work_id":"9ec68c2b-9759-4c1b-9adc-8aa267e1a2b8","year":2019},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:21.991731Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:50dcf70c487c1dd5a152f1585548580493231788c704b194c0f735cd02ad34c5","observation_id":"3a237b6b-c544-4d09-8e05-6ea1a2d72846","resolution":{"observed_at":"2026-08-07T14:22:26.164916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16834","last_updated":"2024-06-06T21:06:44Z","snapshot_observed_at":"2026-07-06T16:38:29.188225Z","submitted_at":"2023-10-25T17:59:12Z","title":"Discrete Diffusion Modeling by Estimating the Ratios of the Data Distribution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16834","snapshot_observed_at":"2026-08-07T14:22:22.063083Z","title":"Discrete diffusion modeling by estimating the ratios of the data distribution","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.063083Z"},"links":{"cited_paper":"/paper/2310.16834","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:4dd0b52952fa5958adc941e39b64b9994a652d6406f3b393e1cc319d29b2a205","observation_id":"cc0772e2-6f9f-4390-8632-65add6188ad3","resolution":{"observed_at":"2026-08-07T14:22:22.063083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:22.114264Z","title":"Dpm-solver: A fast ode solver for diffusion probabilistic model sampling in around 10 steps","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.114264Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:908880eb45ce7ec9d66eb45bb1e7a6ef67157b89dbdc67c72f60d3048ee4c6cb","observation_id":"b58e2f5d-f0de-4233-b716-39ac9528ac19","resolution":{"observed_at":"2026-08-07T14:22:22.114264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01095","last_updated":"2025-05-19T07:56:56Z","snapshot_observed_at":"2026-07-29T20:17:21.488997Z","submitted_at":"2022-11-02T13:14:30Z","title":"DPM-Solver++: Fast Solver for Guided Sampling of Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01095","snapshot_observed_at":"2026-08-07T14:22:22.151155Z","title":"Dpm-solver++: Fast solver for guided sampling of diffusion probabilistic models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.151155Z"},"links":{"cited_paper":"/paper/2211.01095","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:6c31d17ed7517684fccc459d1d168435e7fbd6652a9d5f18162da53cc45db4a6","observation_id":"c85141af-6a79-4d40-9dfe-c2161220d8f0","resolution":{"observed_at":"2026-08-07T14:22:22.151155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:22.234181Z","title":"Sit: Exploring flow and diffusion-based generative models with scalable interpolant transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.234181Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:fe8a1b07235878d3e534d16352b97659a3c1a6c3cb05c80e44f8fe6e09ad80ff","observation_id":"cdc90829-40d4-453a-a339-359e2c279ae3","resolution":{"observed_at":"2026-08-07T14:22:22.234181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:25.879858Z","title":"Revisiting non-autoregressive transformers for efficient image synthesis","venue":null,"work_id":"9911af98-972f-4d6f-8959-2d19d5269a41","year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.324049Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:3811927d42007a721262a856a227f3f0485d7e490bea723a1793f0781221dd8e","observation_id":"d5997584-6c3a-4ad6-b15b-aa7c0dad9e7c","resolution":{"observed_at":"2026-08-07T14:22:25.965306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:25.651927Z","title":"Adanat: Exploring adaptive policy for token-based image generation","venue":null,"work_id":"66779b91-e25d-4450-bec3-9d31a963434b","year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.383273Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:b27985eb4ff06b40bac5926df6bcf1f431757e1fa216d138cb7d86457d99b198","observation_id":"18ba5bd5-400c-42e1-8c42-085ec0cb9a16","resolution":{"observed_at":"2026-08-07T14:22:25.689532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-09T18:02:17.307812Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-07T14:22:22.430503Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.430503Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:4f9f14eb885cb023dec32d30f3793433f43a28699f80167887c6f2420f06ae67","observation_id":"af23bd07-ea75-4608-88ce-497f048feff0","resolution":{"observed_at":"2026-08-07T14:22:22.430503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:25.411564Z","title":"Scalable diffusion models with Transformers","venue":null,"work_id":"c4120e09-e09a-4041-9f99-03663c8adb59","year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.470385Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:dc84ccbc78c22305dcf7455a5ebad992ade782c636427039f143621129d462d6","observation_id":"aae13b34-2ac2-43fd-90d1-e85c481b3d68","resolution":{"observed_at":"2026-08-07T14:22:25.532550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00750","last_updated":"2023-03-01T18:59:33Z","snapshot_observed_at":"2026-08-09T15:21:12.878321Z","submitted_at":"2023-03-01T18:59:33Z","title":"StraIT: Non-autoregressive Generation with Stratified Image Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00750","snapshot_observed_at":"2026-08-07T14:22:22.534676Z","title":"Strait: Non- autoregressive generation with stratified image transformer","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.534676Z"},"links":{"cited_paper":"/paper/2303.00750","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:1458d29ce652628f34815b1bc481f393ac730514ef999026d34e613d9f12a16d","observation_id":"c9722e61-a3da-40da-9e99-d39e12255091","resolution":{"observed_at":"2026-08-07T14:22:22.534676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:22.657186Z","title":"Improving language understanding by generative pre-training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.657186Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:d36b6b08e26ddadae1af6571a925643c788ab22003ad6c30ecfc4a84b45c3872","observation_id":"27658364-cb1a-427b-bf80-5e35d4a62afe","resolution":{"observed_at":"2026-08-07T14:22:22.657186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:25.265697Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":"86c40edd-9bcd-4a28-ba5d-8e869005f851","year":2019},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.715131Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:9972a6eb8eab16ef7d4c50fba94ed18152222866fb0ad3165a0b1ad2e03d58b9","observation_id":"5f7014a3-cbe8-430f-885c-6c34077dd2c1","resolution":{"observed_at":"2026-08-07T14:22:25.333231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:25.129776Z","title":"Generating diverse high-fidelity images with vq-vae-2","venue":null,"work_id":"82118bfa-cc30-4e8b-9c2a-aa9b03f64cfc","year":2019},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.764804Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:874eb4af9947365ef645194e322a1377532ca5ad7e0dce9877a91cd43498cfa7","observation_id":"7558d3a6-743a-4d33-ad2d-197da628844d","resolution":{"observed_at":"2026-08-07T14:22:25.204504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-08-07T14:22:22.867030Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.867030Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:57e923fd5b710bdba2d017d4e8f99ba7bce43c6f892d5f0ff40306f92cb398f2","observation_id":"3463cecd-eb04-4987-aadd-86d1f4c40274","resolution":{"observed_at":"2026-08-07T14:22:22.867030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:22.931168Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.931168Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:434e1bac7cbd02fa88d2853f5b5844ed7608fe0cab11d30ddd2ea02169fcd805","observation_id":"02f3d19d-c1ca-42fc-964e-b1b753b85e46","resolution":{"observed_at":"2026-08-07T14:22:22.931168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:24.932234Z","title":"Improved techniques for training GANs","venue":null,"work_id":"5bef9421-18f3-453e-a745-7825babf754e","year":2016},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.007958Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:20924f84c17793c5ede607cca38736f25271ad8615e4f2b195dc6d03ce335ed4","observation_id":"a9051ae3-b2db-41f7-ad90-c955fa145ddf","resolution":{"observed_at":"2026-08-07T14:22:24.998850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-07T14:22:23.051577Z","title":"Fast transformer decoding: One write-head is all you need","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.051577Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:60fd40c81cefd8a72b8f5a9619839cf923113ab5af682cbd3d7a0d20b06aed6a","observation_id":"03c1a018-a45f-4f29-8af6-8755344f9ff5","resolution":{"observed_at":"2026-08-07T14:22:23.051577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:23.082603Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.082603Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:92f0b1de738cca8e1b59f7a18bef4cf59743f6dcbb37789fdb0aa7c309abf627","observation_id":"698a3f35-5924-48c1-a782-8c588e91b87e","resolution":{"observed_at":"2026-08-07T14:22:23.082603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:24.750325Z","title":"Givt: Generative infinite-vocabulary transformers","venue":null,"work_id":"7623d939-4884-44e8-83ac-684aeec8b7ee","year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.160882Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:33ff068165d9120e77976cd1f2ce9c49e238899754ffb1da228267aa8e212f8b","observation_id":"e840a4cd-7e3d-455d-b7b8-573526dff548","resolution":{"observed_at":"2026-08-07T14:22:24.859172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:24.542710Z","title":"Neural discrete representation learning","venue":null,"work_id":"1eb6edaf-8db9-4c1d-a0f5-c4e940e92ad6","year":2017},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.249222Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:8cf7be351b6c6ce9ad521d3e99c76c611100eac9c7456847643613fd1bd6a280","observation_id":"62195bd5-1c0c-460c-94d5-f7326aaa731c","resolution":{"observed_at":"2026-08-07T14:22:24.617975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:24.358969Z","title":"Gomez, Łukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"d0476eab-1bf8-4e01-bd56-c90f14f7bd4f","year":2017},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.317491Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:81c911032c6b816919253f1f858d73f849959ed516a2d91b14b94a6d757bf304","observation_id":"b5e74a37-3d84-48da-b7ff-a9a134493487","resolution":{"observed_at":"2026-08-07T14:22:24.478080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16211","last_updated":"2024-12-08T19:55:36Z","snapshot_observed_at":"2026-08-04T16:36:02.143481Z","submitted_at":"2024-09-24T16:12:12Z","title":"MaskBit: Embedding-free Image Generation via Bit Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16211","snapshot_observed_at":"2026-08-07T14:22:23.365662Z","title":"Maskbit: Embedding-free image generation via bit tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.365662Z"},"links":{"cited_paper":"/paper/2409.16211","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:ef38d47bfccc8d3243db0c4c1ac43f53ab0ee7001e32b1697203865a8a4f9cd0","observation_id":"d2c80551-cc65-4d47-b8cf-b1d82d3fa46f","resolution":{"observed_at":"2026-08-07T14:22:23.365662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:23.463621Z","title":"Effective and efficient masked image generation models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.463621Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:d78b5d9cd7e0c276ef544c48881991a432086f83c6eed1684029633d59c71b14","observation_id":"7c03548f-896e-4036-b03b-92b5b55f7f20","resolution":{"observed_at":"2026-08-07T14:22:23.463621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04627","last_updated":"2022-06-05T01:57:58Z","snapshot_observed_at":"2026-07-06T11:56:10.689708Z","submitted_at":"2021-10-09T18:36:00Z","title":"Vector-quantized Image Modeling with Improved VQGAN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04627","snapshot_observed_at":"2026-08-07T14:22:23.537186Z","title":"Vector-quantized image modeling with improved vqgan.arXiv preprint arXiv:2110.04627, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.537186Z"},"links":{"cited_paper":"/paper/2110.04627","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:9768417f5f45eafa7b7eecff48625a546b5d6f4eddc36a969fab984a06057170","observation_id":"472a515d-fb67-4fbe-9c5c-52b01cce65a3","resolution":{"observed_at":"2026-08-07T14:22:23.537186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05737","last_updated":"2024-03-29T17:44:41Z","snapshot_observed_at":"2026-08-02T18:23:02.746177Z","submitted_at":"2023-10-09T14:10:29Z","title":"Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05737","snapshot_observed_at":"2026-08-07T14:22:23.633465Z","title":"Language model beats diffusion–tokenizer is key to visual generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.633465Z"},"links":{"cited_paper":"/paper/2310.05737","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:6e711ef94eb06f7e533d1f9a01870516c300ac1dee9c8e2288d5d4d81af42652","observation_id":"4f2298aa-a27f-4eff-9ec6-d3a744e13c67","resolution":{"observed_at":"2026-08-07T14:22:23.633465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06940","last_updated":"2025-06-18T04:35:42Z","snapshot_observed_at":"2026-07-06T19:30:26.233621Z","submitted_at":"2024-10-09T14:34:53Z","title":"Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06940","snapshot_observed_at":"2026-08-07T14:22:23.680186Z","title":"Representation alignment for generation: Training diffusion transformers is easier than you think","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.680186Z"},"links":{"cited_paper":"/paper/2410.06940","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:2cce4334a4bd770314aa7fafa25749ec425a86486ed3ad6255a88ac454785010","observation_id":"8913b2b9-d47a-4016-92d9-9d6db51230d8","resolution":{"observed_at":"2026-08-07T14:22:23.680186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:23.749597Z","title":"sweet spot","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:23.749597Z"},"links":{"citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:b6500c8aea42bc71a32ad490f5dffd07e9515410252aced7519e0fc9021cc9a2","observation_id":"b308e1ef-e744-42eb-ab55-e00eb0348691","resolution":{"observed_at":"2026-08-07T14:22:23.749597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2505.19089."}