{"as_of":"2026-08-19T07:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2e48d008b86cc42a3e74d41bf67d015f6723f4788c106d5b56f1367c9e74a5c9","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:51:39.674630Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.12035/citation-record","integrity":"/paper/2506.12035/integrity","json":"/paper/2506.12035/citation-record.json","paper":"/paper/2506.12035"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:34.522136Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:34.522136Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:704af8b81d9932166a97dfa82ef99c9ba4aa73c8a3d2788423acaeadb885cd47","observation_id":"0855b291-cb86-48f8-9c29-b71ffc09993d","resolution":{"observed_at":"2026-08-07T14:51:34.522136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:34.599885Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:34.599885Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:dcaad345d9296747c49a650f8a8dde4467c0a030d985537aeb426becd423e220","observation_id":"71ad7472-ddfb-41d8-a021-6347bebc5f87","resolution":{"observed_at":"2026-08-07T14:51:34.599885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:34.739954Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:34.739954Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:113e32094ef37b41cbc2d1402265038ed1a5f16b4b073b6b82c21b151eabed34","observation_id":"bb8c33c4-17cd-4225-9d38-ba9f8a6ea557","resolution":{"observed_at":"2026-08-07T14:51:34.739954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T14:51:34.918931Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:34.918931Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:417ecf452ea6fc6481b7ad3fcafac330c389dd1c2b55c56f3b3244a363b91243","observation_id":"43ff26fe-c2b7-4df8-9318-35a391f46122","resolution":{"observed_at":"2026-08-07T14:51:34.918931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:35.060491Z","title":"Improving language understanding by generative pre-training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.060491Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:af1d8d9f6f3e2ef0b5884356d34cfaadb6e3f8b2aef8378398698323cba91e5d","observation_id":"9362b41c-ba1e-414c-a0bf-59b72d46d594","resolution":{"observed_at":"2026-08-07T14:51:35.060491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:35.109638Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.109638Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:912cdae3291ebc54f419e9be4192ca415b84d7a2193f852f3818e111922d2e78","observation_id":"79d57e66-4b1b-4793-95ca-1465951410ec","resolution":{"observed_at":"2026-08-07T14:51:35.109638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:35.151996Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.151996Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:0038d9a3113aacc57f4bac7ca33809194adcc45eb57c701de418a0cc3db4e9c1","observation_id":"09b31c6d-fbfb-40af-9baa-10fbb3e2e76c","resolution":{"observed_at":"2026-08-07T14:51:35.151996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:35.221860Z","title":"Generative pretraining from pixels","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.221860Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:3602734e5ac4d64c5cfa61746a6c529f5b68280be92e3df75fd1a38cd85ff272","observation_id":"0408b77d-ce05-4bf7-a8a1-4264f0a03455","resolution":{"observed_at":"2026-08-07T14:51:35.221860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:35.324924Z","title":"Con- ditional image generation with pixelcnn decoders","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.324924Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:29d00cf32f16da1d5fd43ca3ff6a71c23a95bf0b49a9e6bdfc191675a03ddf53","observation_id":"550e00fe-7789-4d2d-b03b-d7803153e762","resolution":{"observed_at":"2026-08-07T14:51:35.324924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:42.819254Z","title":"Parallel multiscale autoregressive density estimation","venue":null,"work_id":"d710e558-ac6c-4234-b080-c5a20c49f27b","year":2017},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.404187Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:647785995de9457855354551fc422b8c7d9b58cba2b05da18bc15414cb64447c","observation_id":"dbea20ad-b1de-4434-945c-06d2cad83140","resolution":{"observed_at":"2026-08-07T14:51:42.898404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:35.487117Z","title":"Image transformer","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.487117Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:df848d011a8c2f6a2670a67055c6af3006ff4a2723288c8ed4baf1a25aa2e037","observation_id":"facbe27e-024e-4770-a509-d4f1d93fed9c","resolution":{"observed_at":"2026-08-07T14:51:35.487117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:35.606850Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.606850Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:d99d839adf190343ab16002ef224ab643bf501908fbc297e87496a05df82afc3","observation_id":"97b20b8d-b383-4f70-85a9-301f44095392","resolution":{"observed_at":"2026-08-07T14:51:35.606850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-08-13T22:05:34.844117Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-07T14:51:35.679726Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.679726Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:8e921811ca140ddef45f3a3ef4d1713766bf63ab62a5b36947055e7624ea1282","observation_id":"0d9faa52-18ba-456a-845d-ed4246ea6c70","resolution":{"observed_at":"2026-08-07T14:51:35.679726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:35.743187Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.743187Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:62e0146b0205cbc49765a48f7347f233d8b35e6e3b18392fdbaf030871101149","observation_id":"f617ee0c-8aa9-4f26-9bbd-47849bdc9c2b","resolution":{"observed_at":"2026-08-07T14:51:35.743187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10789","last_updated":"2022-06-22T01:11:29Z","snapshot_observed_at":"2026-08-18T22:18:02.034966Z","submitted_at":"2022-06-22T01:11:29Z","title":"Scaling Autoregressive Models for Content-Rich Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.10789","snapshot_observed_at":"2026-08-07T14:51:35.831619Z","title":"Scaling autoregressive models for content-rich text-to-image generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.831619Z"},"links":{"cited_paper":"/paper/2206.10789","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:78fa427bccd5edc2894f3c24288a119b42b551543837039f760d368896cb6bbc","observation_id":"da2819f2-d93e-4d5c-be32-2e15503fb3be","resolution":{"observed_at":"2026-08-07T14:51:35.831619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:35.946175Z","title":"Autoregressive image generation using residual quantization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:35.946175Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:f4a6d271e0897ce910f5b4800046888988ec69512e68b647677f892ae6d107f7","observation_id":"44de99e3-b8f4-47b1-80e0-1dfd2dd35e50","resolution":{"observed_at":"2026-08-07T14:51:35.946175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:42.563372Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"b15b99c7-9e9a-4d4f-9ef4-22d458796b27","year":2021},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.019159Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:fc8d8d18454222a25c8a9ceee5b9085cb01c6f899e9518ab8322c6e9192bad53","observation_id":"67d90918-9981-4272-917a-35d7cd87f5d9","resolution":{"observed_at":"2026-08-07T14:51:42.674671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:42.339951Z","title":"Cogview: Mastering text-to-image generation via transformers","venue":null,"work_id":"02ed578f-13bd-4af5-98bb-78bfd910a07f","year":2021},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.106126Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:7ad6c8feb1d1bb48715288730ffb124cd477144bb5f77313c54c37f944caf757","observation_id":"0a942605-7717-4ca5-97ea-d740ed3accc4","resolution":{"observed_at":"2026-08-07T14:51:42.448903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:36.203044Z","title":"Maskgit: Masked generative image transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.203044Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:2276c043aba339407c27008c51887f277e28c654dea723e7215ad35c819c447b","observation_id":"0c6278ae-2827-48e3-abbf-c41acfa2dce1","resolution":{"observed_at":"2026-08-07T14:51:36.203044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00704","last_updated":"2023-01-02T14:43:38Z","snapshot_observed_at":"2026-08-16T16:04:52.013149Z","submitted_at":"2023-01-02T14:43:38Z","title":"Muse: Text-To-Image Generation via Masked Generative Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00704","snapshot_observed_at":"2026-08-07T14:51:36.281876Z","title":"Muse: Text-to-image generation via masked generative transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.281876Z"},"links":{"cited_paper":"/paper/2301.00704","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:f7cae2b8d72d6abcbe8d52189acda2370596fd7f5ba3d878c9ded48af2209611","observation_id":"93898f86-93a1-4007-bbe9-fd4ddcd0c70e","resolution":{"observed_at":"2026-08-07T14:51:36.281876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:42.138762Z","title":"Mage: Masked generative encoder to unify representation learning and image synthesis","venue":null,"work_id":"0e908d68-24ed-4d31-bae4-7e7570b6a433","year":2023},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.348766Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:b541634f0651fa60df0f1c7d2cfb6862d2bfb2b40889142ae3d02b9f3523c088","observation_id":"015dee4b-739b-4098-a76c-8689b2828a3a","resolution":{"observed_at":"2026-08-07T14:51:42.216217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:36.470938Z","title":"Autoregressive image generation without vector quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.470938Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:1aed6ec9f9ccfc1a3e7efc9a61060fc5bf7da168878278d955ddfe6078d61a47","observation_id":"6b8602d1-b76f-41e9-ba6b-cdfa0b55c1de","resolution":{"observed_at":"2026-08-07T14:51:36.470938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:36.555721Z","title":"Neural discrete representation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.555721Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:1ded3e859b92db7e52b16d2571f7943d45a693be35e8bf3d7510e50e051a18e5","observation_id":"ace0fd0d-9ea8-49ea-b89c-5d8550a3225a","resolution":{"observed_at":"2026-08-07T14:51:36.555721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:36.625243Z","title":"Generating diverse high-fidelity images with vq-vae-2","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.625243Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:d9f1fe0a1149173e72a36aa3a039f5c638b8218db422f1a4af934a21ac7be5ad","observation_id":"887af349-8cf6-46bb-abf9-dd8d21f3ccff","resolution":{"observed_at":"2026-08-07T14:51:36.625243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:36.707317Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.707317Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:68460dfe834125253866e2b2c3d232b757c376e99e6bd270a14809ffdaa1fbee","observation_id":"13bdb4ab-2099-4c46-b335-46770ba5ffd2","resolution":{"observed_at":"2026-08-07T14:51:36.707317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17453","last_updated":"2024-04-07T00:56:53Z","snapshot_observed_at":"2026-08-14T06:01:54.549199Z","submitted_at":"2023-09-29T17:59:56Z","title":"Efficient Streaming Language Models with Attention Sinks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17453","snapshot_observed_at":"2026-08-07T14:51:36.819702Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.819702Z"},"links":{"cited_paper":"/paper/2309.17453","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:f439f10525d000e1f94a84f00ca4f4e3afbec637c55cab0f1ab42d5045174334","observation_id":"97a60daa-89ff-42b7-95d6-cc77432e1e3e","resolution":{"observed_at":"2026-08-07T14:51:36.819702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:36.918375Z","title":"H2o: Heavy-hitter oracle for efficient generative inference of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.918375Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:520dfc8ff0452c657b806fc0a22e5b9b207daddf2bc56695eb89a10667e7ff55","observation_id":"47b04ec4-31d8-40b4-8531-0e61630506bc","resolution":{"observed_at":"2026-08-07T14:51:36.918375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01801","last_updated":"2024-10-29T18:26:09Z","snapshot_observed_at":"2026-08-14T11:45:47.400186Z","submitted_at":"2023-10-03T05:17:08Z","title":"Model Tells You What to Discard: Adaptive KV Cache Compression for LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01801","snapshot_observed_at":"2026-08-07T14:51:36.998467Z","title":"Model tells you what to discard: Adaptive kv cache compression for llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:36.998467Z"},"links":{"cited_paper":"/paper/2310.01801","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:96926dcd7bcd4efa0794d9cd75347ea9dd8477631380935aeb772b32d559f827","observation_id":"43f963b5-6dfe-4b4f-9014-e939bbd9bbcb","resolution":{"observed_at":"2026-08-07T14:51:36.998467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:41.861771Z","title":"Keyformer: Kv cache reduction through key tokens selection for efficient generative inference","venue":null,"work_id":"a8daea6b-9183-4fbb-aabe-3b1b7a6f5a05","year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.082269Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:50049e13e3a26c85a76f331c4e841ded4f753347e092934cc981e48ffdfc7776","observation_id":"c7b3339b-aa57-4708-80e2-d93519b5d011","resolution":{"observed_at":"2026-08-07T14:51:41.992619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:41.692172Z","title":"Arkvale: Efficient generative llm inference with recallable key-value eviction","venue":null,"work_id":"ffd14363-f5cb-4a93-8b8b-01d658f46b8c","year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.199442Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:9e022e6174c92845c41c15f30c2c50316ff6130e1d759fa017e4e865cf0c5d37","observation_id":"0bcdc309-b746-4e0d-8edc-f25d29288da5","resolution":{"observed_at":"2026-08-07T14:51:41.797671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10774","last_updated":"2024-08-26T21:01:02Z","snapshot_observed_at":"2026-08-14T18:53:06.624928Z","submitted_at":"2024-06-16T01:33:02Z","title":"Quest: Query-Aware Sparsity for Efficient Long-Context LLM Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10774","snapshot_observed_at":"2026-08-07T14:51:37.284507Z","title":"Quest: Query-aware sparsity for efficient long-context llm inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.284507Z"},"links":{"cited_paper":"/paper/2406.10774","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:3e2f461d4480c26397c8367e00a4671649752180c3d12140aad6ca5a3d79d010","observation_id":"3329ceac-9a9b-4278-b3a4-40badbf4fc78","resolution":{"observed_at":"2026-08-07T14:51:37.284507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16211","last_updated":"2024-12-08T19:55:36Z","snapshot_observed_at":"2026-08-16T13:15:48.133270Z","submitted_at":"2024-09-24T16:12:12Z","title":"MaskBit: Embedding-free Image Generation via Bit Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16211","snapshot_observed_at":"2026-08-07T14:51:37.368918Z","title":"Maskbit: Embedding-free image generation via bit tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.368918Z"},"links":{"cited_paper":"/paper/2409.16211","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:f7c68e55fd575d313923546aa8054c2788d0126160e9b459581036a0dae39048","observation_id":"51afbdb6-c529-42c8-bc39-60d2fd5d1e14","resolution":{"observed_at":"2026-08-07T14:51:37.368918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:41.441695Z","title":"Improved masked image generation with token-critic","venue":null,"work_id":"682bc3ef-ffc3-4371-a322-88cdec1f96c9","year":2022},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.436193Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:fdaa44484fec5bc3977abe7a37bb01e8e14c3a23128ec932fdd158ab339a4852","observation_id":"1e63f68a-2ffd-4d4b-af1c-8accd9f5c043","resolution":{"observed_at":"2026-08-07T14:51:41.572898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:37.543931Z","title":"Dpm-solver: A fast ode solver for diffusion probabilistic model sampling in around 10 steps","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.543931Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:621f0fbc8f95e3462419e35d115a031f4e116d225e1234a6fbe6c78c387fd46c","observation_id":"c8fd2eb0-fa39-40c1-9839-eaf5a1b638db","resolution":{"observed_at":"2026-08-07T14:51:37.543931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01095","last_updated":"2025-05-19T07:56:56Z","snapshot_observed_at":"2026-08-18T13:49:48.200480Z","submitted_at":"2022-11-02T13:14:30Z","title":"DPM-Solver++: Fast Solver for Guided Sampling of Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01095","snapshot_observed_at":"2026-08-07T14:51:37.635963Z","title":"Dpm- solver++: Fast solver for guided sampling of diffusion probabilistic models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.635963Z"},"links":{"cited_paper":"/paper/2211.01095","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:fa482d7295150edeb01f551f47a47350975ccb2e02b2ec9aded95916cd7d153e","observation_id":"490547de-cf89-4b24-9cbd-fdb9d30dda34","resolution":{"observed_at":"2026-08-07T14:51:37.635963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:37.695253Z","title":"Oms-dpm: Optimizing the model schedule for diffusion probabilistic models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.695253Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:43bbc84200dc8510d8bb283c47a3187c7cf7804caae3b9c103be0566557a6b23","observation_id":"f779dddb-3e16-4ed4-888c-94759087a487","resolution":{"observed_at":"2026-08-07T14:51:37.695253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:37.784997Z","title":"Mixdq: Memory-efficient few-step text-to-image diffusion models with metric-decoupled mixed precision quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.784997Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:105b20e1c2e1903bea41c756241b74f1e25d9baea0379b89cd54bbd094951d23","observation_id":"85762a26-6964-4ea9-9e1c-65a5107c739b","resolution":{"observed_at":"2026-08-07T14:51:37.784997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02540","last_updated":"2025-02-22T16:29:03Z","snapshot_observed_at":"2026-08-18T09:54:14.497921Z","submitted_at":"2024-06-04T17:57:10Z","title":"ViDiT-Q: Efficient and Accurate Quantization of Diffusion Transformers for Image and Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02540","snapshot_observed_at":"2026-08-07T14:51:37.905137Z","title":"Vidit-q: Efficient and accu- rate quantization of diffusion transformers for image and video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.905137Z"},"links":{"cited_paper":"/paper/2406.02540","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:2086012f18e03a852f3b17210448b0bdd0d3e117fe7853fac49e1292f920bb9b","observation_id":"dd2ab87b-5330-4308-abda-84b02de2c8f3","resolution":{"observed_at":"2026-08-07T14:51:37.905137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:41.198878Z","title":"Ditfastattn: Attention compression for diffusion transformer models","venue":null,"work_id":"c347a059-7dbe-4886-aeed-98cbbf24426e","year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:37.990389Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:e4ddbb01aa33a2abda8e1f3ffa395a35ffce6b4674a1e09ffdfe4608dc43ad96","observation_id":"756c4c89-9f8e-465d-bbc7-b776da15de36","resolution":{"observed_at":"2026-08-07T14:51:41.291719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:38.106131Z","title":"Deepcache: Accelerating diffusion models for free","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:38.106131Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:5b170b581d6a0c6a846e0c5f1ce5d4a6fcb10570b6413ef74a019ebbb1b6447d","observation_id":"65a89333-3f65-4512-9cb5-47eb406ba394","resolution":{"observed_at":"2026-08-07T14:51:38.106131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:38.221896Z","title":"Cache me if you can: Accelerating diffusion models through block caching","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:38.221896Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:abbcb19b5a9973568ff7c44c0fceddda2b32acf516d51047b669a8fea36741d8","observation_id":"515494ef-31a9-420c-bb8d-3fe28a85a446","resolution":{"observed_at":"2026-08-07T14:51:38.221896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:38.305668Z","title":"Approximate caching for efficiently serving {Text-to-Image} diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:38.305668Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:bedf20f6c221dd0377d3169abcc5cba52d47f11e227c815db7cb704ce424f81c","observation_id":"d7336f79-12f7-4f44-aaa5-347bed5eecce","resolution":{"observed_at":"2026-08-07T14:51:38.305668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03355","last_updated":"2025-03-02T07:45:09Z","snapshot_observed_at":"2026-08-16T13:12:37.517817Z","submitted_at":"2024-10-04T12:21:03Z","title":"LANTERN: Accelerating Visual Autoregressive Models with Relaxed Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03355","snapshot_observed_at":"2026-08-07T14:51:38.393125Z","title":"Lantern: Accelerating visual autoregressive models with relaxed speculative decoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:38.393125Z"},"links":{"cited_paper":"/paper/2410.03355","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:4bcffb82827d155ff2b724769d096b55d95df36ed2110038de8d8d18f4c3d1e7","observation_id":"45cf22a6-689c-474d-a52a-82c9b1c7b3f9","resolution":{"observed_at":"2026-08-07T14:51:38.393125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01699","last_updated":"2025-03-04T04:33:27Z","snapshot_observed_at":"2026-08-16T13:13:17.452400Z","submitted_at":"2024-10-02T16:05:27Z","title":"Accelerating Auto-regressive Text-to-Image Generation with Training-free Speculative Jacobi Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01699","snapshot_observed_at":"2026-08-07T14:51:38.475432Z","title":"Accelerating auto-regressive text-to-image generation with training-free speculative jacobi decoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:38.475432Z"},"links":{"cited_paper":"/paper/2410.01699","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:d2e0fe7c47840ddf39a5d23130bde7381afb499053186bc07103b75d6b8203a7","observation_id":"4a6c1563-eda2-495a-8e40-d4a20d9a33c8","resolution":{"observed_at":"2026-08-07T14:51:38.475432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:40.920054Z","title":"Enat: Rethinking spatial-temporal interactions in token-based image synthesis","venue":null,"work_id":"972dfe25-22cb-46bc-8893-00885f098226","year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:38.600348Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:9d939028c742dd89cf50983afda727cdef574871972cb19db566923eca7577cc","observation_id":"2a326e07-2f4f-4ad0-88f9-bd1fbc76fd85","resolution":{"observed_at":"2026-08-07T14:51:41.044269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12450","last_updated":"2025-03-16T10:54:59Z","snapshot_observed_at":"2026-08-16T12:49:38.155494Z","submitted_at":"2025-03-16T10:54:59Z","title":"LazyMAR: Accelerating Masked Autoregressive Models via Feature Caching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12450","snapshot_observed_at":"2026-08-07T14:51:38.761307Z","title":"Lazymar: Accelerating masked autoregressive models via feature caching","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:38.761307Z"},"links":{"cited_paper":"/paper/2503.12450","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:98a2e45d330416d0d7ad4c86311f03396d1ef524d579fa761ccc4d74cd601151","observation_id":"dcc9f420-d816-4a04-9646-0e35d4fab642","resolution":{"observed_at":"2026-08-07T14:51:38.761307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00382","last_updated":"2025-02-01T09:41:01Z","snapshot_observed_at":"2026-08-18T22:49:11.753880Z","submitted_at":"2025-02-01T09:41:01Z","title":"Masked Generative Nested Transformers with Decode Time Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00382","snapshot_observed_at":"2026-08-07T14:51:38.875000Z","title":"Masked generative nested transformers with decode time scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:38.875000Z"},"links":{"cited_paper":"/paper/2502.00382","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:0343d836433ff1b598ba56172e5217dc9bd37999d2ca90b2a8ac1c407af87579","observation_id":"3061cc74-1719-4ceb-9d97-6717f4f92a8a","resolution":{"observed_at":"2026-08-07T14:51:38.875000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:40.629614Z","title":"Efficient attention: Attention with linear complexities","venue":null,"work_id":"e31212df-4c28-48a0-905e-0a2e6b2c1502","year":2021},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.026651Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:016e65a769caaa8460959c0c058a8aeae1dd3aca20cf92952454c0e35a4117df","observation_id":"f330e986-a343-4de0-9d9f-8c6ae8c5029e","resolution":{"observed_at":"2026-08-07T14:51:40.789777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:39.140239Z","title":"Flashattention: Fast and memory-efficient exact attention with io-awareness","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.140239Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:4358ae80479bb5db35fce2a4582a85525ac31d34be5f505d7771fad6ec8ba73e","observation_id":"2cf67de3-23ae-4f53-b387-378b4ccab314","resolution":{"observed_at":"2026-08-07T14:51:39.140239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-07T14:51:39.254887Z","title":"Flashattention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.254887Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:df4f94a63af44c2e81038f48973e03f26f25c7ed6a997c78bec0431e4f5aff9a","observation_id":"bf542ecc-b918-4352-98c5-5b023fd7ce06","resolution":{"observed_at":"2026-08-07T14:51:39.254887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:40.429662Z","title":"Flashattention-3: Fast and accurate attention with asynchrony and low-precision","venue":null,"work_id":"170e8fd4-fdb2-4c53-a315-4f959be1dc07","year":2024},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.367546Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:439ddec0f0a5eea77c7d8c83217acac2d5f2bb179ca94b1305f3c9fadd2e74af","observation_id":"c6cf25e8-9611-42a6-9ec6-5d564c585d18","resolution":{"observed_at":"2026-08-07T14:51:40.532249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:40.170004Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":"18a6f15d-0fbe-4ac8-b433-9ff42c234f22","year":2017},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.443033Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:026b96b9b54f36ee7484d7c27a194ca5de7577567d1714b2cb518c9367b8f648","observation_id":"efafe7c4-52bf-4e40-8d87-a92f2602e5b1","resolution":{"observed_at":"2026-08-07T14:51:40.270692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:39.555453Z","title":"Improved techniques for training gans","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.555453Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:cbcc5a4b4d2b63101560f8c6aee9f36f0aceaf2f40a8612493336d5a96c975c2","observation_id":"0bff735c-a713-4f48-a045-ce9662e3d156","resolution":{"observed_at":"2026-08-07T14:51:39.555453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:39.955429Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"674cc116-3d23-4489-aab1-84f85b4682b8","year":2023},"citing_paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.674630Z"},"links":{"citing_paper":"/paper/2506.12035"},"observation_digest":"sha256:8eb95658c5583aa80e09cb691b70658e585fc53085e93b268954dfd06763786c","observation_id":"2c401573-b2a1-4ffc-a390-69b76c7df4a8","resolution":{"observed_at":"2026-08-07T14:51:40.037165Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.12035","last_updated":"2025-05-22T23:26:56Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T05:10:41.170285Z","submitted_at":"2025-05-22T23:26:56Z","title":"MARch\\'e: Fast Masked Autoregressive Image Generation with Cache-Aware Attention"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2506.12035."}