{"as_of":"2026-08-09T21:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e753a2d4396805171075465369ea32707ca5f818f0db8d4fb2a9f26ca32cab02","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T11:08:05.138583Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2510.06928/citation-record","integrity":"/paper/2510.06928/integrity","json":"/paper/2510.06928/citation-record.json","paper":"/paper/2510.06928"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:07:57.678343Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:57.678343Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:8019dd86fb73325d08a5ff2a78773aba9e674940646370aeb3979f78d6320b31","observation_id":"049e532f-322e-46a0-9149-4b3ca1dcc867","resolution":{"observed_at":"2026-08-04T11:07:57.678343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:07:57.835177Z","title":"Generative adversarial networks,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:57.835177Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:fb4617e9edee6ba9bef71f67d357a9e138fad4d05005e2b57bd7469b90616b9c","observation_id":"817fc176-9f49-44dd-8b3b-cb063ec2393f","resolution":{"observed_at":"2026-08-04T11:07:57.835177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-04T11:07:58.021332Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:58.021332Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:3dda35a8fd0ee5a1b028d2bccc137196dd526ee2599721c2c26ad1af524f453c","observation_id":"fc6d9cc3-8c20-474c-a676-7d08bceea912","resolution":{"observed_at":"2026-08-04T11:07:58.021332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:07:58.213585Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:58.213585Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:657efbef625276183343855cd5e0d0a66333219040aca52684e14c243d480cde","observation_id":"2e6ea523-e037-4a4f-aff3-18cdda40f4bb","resolution":{"observed_at":"2026-08-04T11:07:58.213585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:07:58.380273Z","title":"Maskgit: Masked generative image transformer,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:58.380273Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:185c64c890f8453ff5fdbfb9d61e8b5c41bfcefc852116bd746612f48a43cce5","observation_id":"381eadbb-4f8c-4b4c-82b0-ccaa6ede6780","resolution":{"observed_at":"2026-08-04T11:07:58.380273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08261","last_updated":"2025-03-13T15:09:10Z","snapshot_observed_at":"2026-07-06T19:31:23.072307Z","submitted_at":"2024-10-10T17:59:17Z","title":"Meissonic: Revitalizing Masked Generative Transformers for Efficient High-Resolution Text-to-Image Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08261","snapshot_observed_at":"2026-08-04T11:07:58.472324Z","title":"Meissonic: Revitalizing masked generative transformers for efficient high-resolution text-to-image synthesis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:58.472324Z"},"links":{"cited_paper":"/paper/2410.08261","citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:3a2550f277f93f8b19dd8eaa6be72196408ad1c2466bee3158c8a9ad40b0ec49","observation_id":"5a085bde-fa9e-46be-82c3-6fa89a314576","resolution":{"observed_at":"2026-08-04T11:07:58.472324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:07:58.563464Z","title":"Language models are unsupervised multitask learners,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:58.563464Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:3e771d7731e9b2ba24b35105c4b09c1e02028ec49d397c947a8bc2cd37d589bf","observation_id":"c0d69211-7e13-4d99-8f49-3c55d52e8b1f","resolution":{"observed_at":"2026-08-04T11:07:58.563464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-04T11:07:58.657610Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:58.657610Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:b6ea6a6d50900b8715df6a929d2b98fe5627ec37ce64a87a309745413dc392b2","observation_id":"141fef8d-5b33-4383-83b1-5affbc034a69","resolution":{"observed_at":"2026-08-04T11:07:58.657610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:07:58.804101Z","title":"Improving autoregressive visual generation with cluster- oriented token prediction,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:58.804101Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:0ead99cfbeca083d365f09f9ef2310e35a5131af9ca196f5cc776a67a9d444c9","observation_id":"73bd5896-2478-4386-a3d0-946df4c9c1c6","resolution":{"observed_at":"2026-08-04T11:07:58.804101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:07:59.011255Z","title":"Neural discrete representation learning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:59.011255Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:0086add8e758121875dbc10dae7867191f58af53d754ce73476d3a936c5fe060","observation_id":"74c07eca-867c-4cd3-a99d-5d2cacdbc4e2","resolution":{"observed_at":"2026-08-04T11:07:59.011255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:07:59.175824Z","title":"Taming transformers for high-resolution image synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:59.175824Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:01650d1bcb10ec7451f02c4c755d4128094a2f48eb8b2b685027aa29e7cec568","observation_id":"4d902f05-6f1a-413c-964a-abaab4025f38","resolution":{"observed_at":"2026-08-04T11:07:59.175824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04627","last_updated":"2022-06-05T01:57:58Z","snapshot_observed_at":"2026-07-06T11:56:10.689708Z","submitted_at":"2021-10-09T18:36:00Z","title":"Vector-quantized Image Modeling with Improved VQGAN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04627","snapshot_observed_at":"2026-08-04T11:07:59.306875Z","title":"Vector-quantized image modeling with improved vqgan,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:59.306875Z"},"links":{"cited_paper":"/paper/2110.04627","citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:3e35789728daa8d95311faefd2526be8cfb1ae64643a08189f75305b51d6844f","observation_id":"c59bdd39-6e8e-4d3b-b20b-5de37ae60c6b","resolution":{"observed_at":"2026-08-04T11:07:59.306875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:07:59.410546Z","title":"Autoregressive image generation using residual quantization,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:59.410546Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:d7de863b979fa00bfd881893a8b0731b5b308fb84fb8e5d2fc46ec84d76d067c","observation_id":"d7de1890-d585-4e75-bf32-b7df17ec1747","resolution":{"observed_at":"2026-08-04T11:07:59.410546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16681","last_updated":"2024-11-27T17:04:36Z","snapshot_observed_at":"2026-08-09T11:29:26.795376Z","submitted_at":"2024-11-25T18:59:53Z","title":"Factorized Visual Tokenization and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16681","snapshot_observed_at":"2026-08-04T11:07:59.517713Z","title":"Factorized visual tokenization and generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:59.517713Z"},"links":{"cited_paper":"/paper/2411.16681","citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:a1005a53bdf6cf180960c0a942e56d0dbef17f70e7c5118ea680b52b29536f3f","observation_id":"2400ffc2-4e56-4b21-8087-6ff3ed36557e","resolution":{"observed_at":"2026-08-04T11:07:59.517713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:07:59.619389Z","title":"Unitok: A unified tokenizer for visual generation and understanding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:59.619389Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:074628ddfa71abdcdbaf52860abe14eb0316968c977335b9d0829b9d94886411","observation_id":"8bc022df-8025-437d-83e4-13865dcab879","resolution":{"observed_at":"2026-08-04T11:07:59.619389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:07:59.708123Z","title":"Tokenflow: Unified image tokenizer for multimodal understanding and generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:59.708123Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:5d168d8fac964a663a215ddc7326ec4d5c1eff969562cbd99f1754c5b438e96e","observation_id":"fcf17e71-158a-43e9-9532-e21e9ff67449","resolution":{"observed_at":"2026-08-04T11:07:59.708123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:07:59.788744Z","title":"Magvit: Masked generative video transformer,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:59.788744Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:378bbb5efa6cb478601c8d95894c805491234ade25ccf066b2106a426004ed86","observation_id":"dbf25c43-b95b-49e3-9629-48b7949e0184","resolution":{"observed_at":"2026-08-04T11:07:59.788744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04410","last_updated":"2025-02-09T08:59:19Z","snapshot_observed_at":"2026-08-06T03:43:29.067278Z","submitted_at":"2024-09-06T17:14:53Z","title":"Open-MAGVIT2: An Open-Source Project Toward Democratizing Auto-regressive Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04410","snapshot_observed_at":"2026-08-04T11:07:59.892644Z","title":"Open- magvit2: An open-source project toward democratizing auto- regressive visual generation,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:59.892644Z"},"links":{"cited_paper":"/paper/2409.04410","citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:28ac66cc98c199374ee3b56633bbf667871a9725fe6734e3dd2532f86daee416","observation_id":"e4be6a38-5275-463f-bdea-3801fea22e07","resolution":{"observed_at":"2026-08-04T11:07:59.892644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14324","last_updated":"2026-04-20T17:55:12Z","snapshot_observed_at":"2026-08-02T12:34:37.994590Z","submitted_at":"2025-03-18T14:56:46Z","title":"DualToken: Towards Unifying Visual Understanding and Generation with Dual Visual Vocabularies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14324","snapshot_observed_at":"2026-08-04T11:07:59.996610Z","title":"Dualtoken: Towards unifying visual understanding and generation with dual visual vocabularies,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T11:07:59.996610Z"},"links":{"cited_paper":"/paper/2503.14324","citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:007af49642e60c88b18cf2c12b00e80311d3ec3b2779719f4df6a4ea52151971","observation_id":"1cd94d0a-20d1-43da-9808-d94a8aaace40","resolution":{"observed_at":"2026-08-04T11:07:59.996610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1411.1784","last_updated":"2014-11-06T22:33:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-11-06T22:33:22Z","title":"Conditional Generative Adversarial Nets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.1784","snapshot_observed_at":"2026-08-04T11:08:00.147719Z","title":"Conditional generative adversarial nets,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:00.147719Z"},"links":{"cited_paper":"/paper/1411.1784","citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:a15a5d7067e7118000730332b3e39fb9c175865d3e5d53a0aec3271ae65d51bd","observation_id":"d2b1ef64-4928-4254-bae3-e9df120c4756","resolution":{"observed_at":"2026-08-04T11:08:00.147719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06434","last_updated":"2016-01-07T23:09:39Z","snapshot_observed_at":"2026-08-04T04:34:27.861448Z","submitted_at":"2015-11-19T22:50:32Z","title":"Unsupervised Representation Learning with Deep Convolutional Generative Adversarial Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06434","snapshot_observed_at":"2026-08-04T11:08:00.220632Z","title":"Unsupervised represen- tation learning with deep convolutional generative adversarial networks,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:00.220632Z"},"links":{"cited_paper":"/paper/1511.06434","citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:a1a58875708703e33052c65ebc40a0c4f64d0f9ed358fdd74bd910dc7dbcfc6a","observation_id":"a99e9f13-352a-4056-a186-8e662886d8eb","resolution":{"observed_at":"2026-08-04T11:08:00.220632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:00.290489Z","title":"Improved techniques for training gans,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:00.290489Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:3e32e7eb8f81cc7ea11fd9d64f39043dc3e04e2dfcadbd2f05cb2c61b0e04bba","observation_id":"b4357031-547e-4ee6-aa1d-c2bc99a4a801","resolution":{"observed_at":"2026-08-04T11:08:00.290489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:00.363392Z","title":"Image-to-image translation with conditional adversarial networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:00.363392Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:3381a504929e956b81fba474c2394d275f7666e262aa64433af4e8fdf18261ce","observation_id":"c3006ce8-63a8-41ee-8724-1a73aebd4b21","resolution":{"observed_at":"2026-08-04T11:08:00.363392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:00.462818Z","title":"Unpaired image-to- image translation using cycle-consistent adversarial networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:00.462818Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:abcd6c7243d4d5305368197dc259df2000b5a01b100a35c81e4f340f1b687fdc","observation_id":"092b3bfd-0ff3-45e4-b28e-40d641a9dde5","resolution":{"observed_at":"2026-08-04T11:08:00.462818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:00.560643Z","title":"A style-based generator archi- tecture for generative adversarial networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:00.560643Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:f9834e5edf456bbdf52d470c8b321979d067212e7e7f52059d884abba526af1c","observation_id":"8c98fdfb-c6b6-48e2-bdb7-499590fe307a","resolution":{"observed_at":"2026-08-04T11:08:00.560643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:00.653459Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:00.653459Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:5dfb7a8fe49a4227fd8f03724af500020066d4f3aef54a91f85190763f16cdc4","observation_id":"6c2103d3-d86c-4730-ab43-f127b5b51517","resolution":{"observed_at":"2026-08-04T11:08:00.653459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:00.743523Z","title":"Improved denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:00.743523Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:053a06bc8ecc81eae3c2c016ca388c002686c32c3220f6edaea72c997cf3b4d3","observation_id":"d37b2c90-e42a-4876-8925-beecaa522797","resolution":{"observed_at":"2026-08-04T11:08:00.743523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-04T11:08:00.896222Z","title":"Denoising diffusion implicit models,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:00.896222Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:d9dadd0f19da87221cd910659909fcc263498c7ea5021d50ad0265be3d51ead6","observation_id":"69cc972d-34fe-4598-9dd2-29c50472995a","resolution":{"observed_at":"2026-08-04T11:08:00.896222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:01.006082Z","title":"Diffusion models beat gans on image synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:01.006082Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:f5b3cbb85121c358aeb76755c1068bdd720a6da0c52b71540c662f9c29e48ed4","observation_id":"e0ab263b-f96f-4207-b143-523d59cbbf59","resolution":{"observed_at":"2026-08-04T11:08:01.006082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:01.092735Z","title":"Photorealistic text-to-image diffusion models with deep language understanding,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:01.092735Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:3da4acf970142ae7030dcdcfe3b9140c30a3fea25f9d1592bd8cf032f032a964","observation_id":"8059375d-323a-4a5b-a22a-22e20179b6eb","resolution":{"observed_at":"2026-08-04T11:08:01.092735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:01.271129Z","title":"High-resolution image synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:01.271129Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:15a6b98095d64a48f7a0aea96cb8484265c42616f723afca89c8a2c85d623dd3","observation_id":"e0addd0a-fb11-453f-8e64-068b52f13a65","resolution":{"observed_at":"2026-08-04T11:08:01.271129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-04T11:08:01.525490Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:01.525490Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:b7fb4ab8a88946fa250f58700521fa8766622cd177dd97856db0b0ac37657f6b","observation_id":"446dc884-0c04-4bea-9fb6-69cfff0f61f9","resolution":{"observed_at":"2026-08-04T11:08:01.525490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:01.775661Z","title":"Zero-shot text-to-image generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:01.775661Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:c9ce8d996b16eb3b8091618d0cf261c55e7eb70ef275edb86497118bdf034c3d","observation_id":"201511b3-627a-4413-a899-39a702aa962b","resolution":{"observed_at":"2026-08-04T11:08:01.775661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10789","last_updated":"2022-06-22T01:11:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-06-22T01:11:29Z","title":"Scaling Autoregressive Models for Content-Rich Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.10789","snapshot_observed_at":"2026-08-04T11:08:01.939270Z","title":"Scaling autoregressive models for content-rich text-to-image generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:01.939270Z"},"links":{"cited_paper":"/paper/2206.10789","citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:4de1b0510852c1865f5a92433a40a166d8a1e4673dc208ed56a83192752deac3","observation_id":"1c0875f4-5e9b-44e3-b2cb-6dfe9f159174","resolution":{"observed_at":"2026-08-04T11:08:01.939270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-04T11:08:02.036688Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:02.036688Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:8ec1e876b6704b467c3b09a110006bc2887e322b5c1cc8b5c8aacc5689d21b37","observation_id":"3af00f49-1437-462d-b75b-f8ec10a8c087","resolution":{"observed_at":"2026-08-04T11:08:02.036688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:02.207818Z","title":"Maskgit: Masked generative image transformer,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:02.207818Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:86b62f1652b1c51eef02365fdf22b72501ede421f3c9e775fb26b97c026c34d8","observation_id":"137b03ea-6317-4dde-8497-24c62edf34f4","resolution":{"observed_at":"2026-08-04T11:08:02.207818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00704","last_updated":"2023-01-02T14:43:38Z","snapshot_observed_at":"2026-08-03T00:33:47.397969Z","submitted_at":"2023-01-02T14:43:38Z","title":"Muse: Text-To-Image Generation via Masked Generative Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00704","snapshot_observed_at":"2026-08-04T11:08:02.386459Z","title":"Muse: Text-to-image generation via masked generative trans- formers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:02.386459Z"},"links":{"cited_paper":"/paper/2301.00704","citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:e3cf166e6335d0870b1714c64b78cd313246954b2bd8520bc0376a7327b60066","observation_id":"5b9524c7-760c-40a4-b39b-46c5de90dd0f","resolution":{"observed_at":"2026-08-04T11:08:02.386459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05737","last_updated":"2024-03-29T17:44:41Z","snapshot_observed_at":"2026-08-02T18:23:02.746177Z","submitted_at":"2023-10-09T14:10:29Z","title":"Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05737","snapshot_observed_at":"2026-08-04T11:08:02.602491Z","title":"Language model beats diffusion–tokenizer is key to visual generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:02.602491Z"},"links":{"cited_paper":"/paper/2310.05737","citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:36e628edf5e4ebef969c671e5e383accff6e767921021e1d456dd2fc7854b054","observation_id":"ed0b44ed-8e16-4de4-b403-31258fdda2e3","resolution":{"observed_at":"2026-08-04T11:08:02.602491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:02.749548Z","title":"Taming transformers for high-resolution image synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:02.749548Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:e52369f4a984076553112ab461ae8e057a8185a51bb9cc21ae25af9201dac998","observation_id":"84a294b4-809a-4dc0-8c1a-ffc9b8121f82","resolution":{"observed_at":"2026-08-04T11:08:02.749548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:02.908070Z","title":"The unreasonable effectiveness of deep features as a perceptual metric,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:02.908070Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:252f50c962a5eb91eafae0139768c47b4a95b785acf93aa4ec18c2cebc804674","observation_id":"19a32505-eb1f-4aee-9915-60d2abf49c0a","resolution":{"observed_at":"2026-08-04T11:08:02.908070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:03.061359Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:03.061359Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:fe866f71eb1db83a5274c5ecb15c8b8128c82412db89cf3c499a98777f112ca0","observation_id":"ced8aee8-81e9-4dae-988f-d6370fe23285","resolution":{"observed_at":"2026-08-04T11:08:03.061359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:03.191412Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:03.191412Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:231ac60bfa4e87401d3d15b1f8b415fb9cecc9a1968c0195619e43d3fabd2e51","observation_id":"c20957e1-e251-468c-a243-c0cb5cfe5472","resolution":{"observed_at":"2026-08-04T11:08:03.191412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:03.327397Z","title":"Improved techniques for training gans,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:03.327397Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:fd4ecd3b501b989ed2878a9c283e07fc79e39db579833ff9b0d9750ba1abbf23","observation_id":"25664f64-3df2-4c82-8da6-723bdf38c6d7","resolution":{"observed_at":"2026-08-04T11:08:03.327397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:03.465430Z","title":"Improved precision and recall metric for assessing generative models,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:03.465430Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:f6bbef8b0a6a9c8e08ce48362847ab618d7169e005b75056ea2f8477e25ca56b","observation_id":"c19836a4-bdd3-402a-8527-fdecc91f943a","resolution":{"observed_at":"2026-08-04T11:08:03.465430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.11096","last_updated":"2019-02-25T21:32:06Z","snapshot_observed_at":"2026-07-06T07:04:57.275371Z","submitted_at":"2018-09-28T15:38:49Z","title":"Large Scale GAN Training for High Fidelity Natural Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.11096","snapshot_observed_at":"2026-08-04T11:08:03.625805Z","title":"Large scale gan training for high fidelity natural image synthesis,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:03.625805Z"},"links":{"cited_paper":"/paper/1809.11096","citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:7d816f2ec85e379cc2def55700d9b3af5982d58de38461e8d9d96fbdbf2acfeb","observation_id":"1a3f05f8-1d4a-4865-bf52-35b27eb85039","resolution":{"observed_at":"2026-08-04T11:08:03.625805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:03.743292Z","title":"Scaling up gans for text-to-image synthesis,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:03.743292Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:237297ef14e72097507897188c471496027a65c854759c19e13286cfa9197fce","observation_id":"cbb8200f-8e06-4c83-8a57-35b14393a5fa","resolution":{"observed_at":"2026-08-04T11:08:03.743292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:03.844318Z","title":"Stylegan-xl: Scaling stylegan to large diverse datasets,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:03.844318Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:56bd26565e168657a936ec99c5e5a1763b43670115fa8454d159f6709104d1e7","observation_id":"0b47daef-fd94-4808-b910-d215bafb59ea","resolution":{"observed_at":"2026-08-04T11:08:03.844318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:03.942201Z","title":"Diffusion models beat gans on image synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:03.942201Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:b0e8570211be6c298abb84693615607df5963afada0ed2c57acf9182f2f0bb5b","observation_id":"8dafaa0f-355e-488e-addd-7fd7fe875638","resolution":{"observed_at":"2026-08-04T11:08:03.942201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:04.039939Z","title":"Cascaded diffusion models for high fidelity image generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:04.039939Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:a5c10d87595b10d97c45178ebf05c61fb8a7a94d9446bf3c2c52964adfb5bad6","observation_id":"5b12bb73-fe92-415b-976c-136c7bd1e58d","resolution":{"observed_at":"2026-08-04T11:08:04.039939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:04.135330Z","title":"High-resolution image synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:04.135330Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:d249e146b0f8e657369a97b2aa1864b89f50f4b276142057d582e20954dddd1f","observation_id":"519013a7-8363-4b70-ac48-d88bddf7a157","resolution":{"observed_at":"2026-08-04T11:08:04.135330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:04.265110Z","title":"Scalable diffusion models with transform- ers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:04.265110Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:b6b224525872f53258915248ef534c747cbff8f367f7f2526875fcb36d1bb19e","observation_id":"0f77ae0a-6dde-4096-9966-1c126c8eb854","resolution":{"observed_at":"2026-08-04T11:08:04.265110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:04.359012Z","title":"Vector-quantized image modeling with improved vqgan,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:04.359012Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:9e9d122b578c4a8f5785f98d01baab79efb03e38b23b0915127757904fc29544","observation_id":"1a434572-3206-4f60-8afb-ff5335379d42","resolution":{"observed_at":"2026-08-04T11:08:04.359012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:04.515888Z","title":"Autoregressive image generation using residual quantization,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:04.515888Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:92402a15da1b9a0023ee15c702b9c3b6f48aa710c54b3804b58a51a5e51a072d","observation_id":"d36aaa9c-ee82-427a-ba0f-7ee6494dbf8e","resolution":{"observed_at":"2026-08-04T11:08:04.515888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:04.674653Z","title":"Min- ing top-k frequent itemsets through progressive sampling,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:04.674653Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:66d93b743f2bb35e2ee9ebd1f7819338dc5708416d81ad5d7dd00e48584cb64d","observation_id":"80e58c32-d972-4274-bc27-275e71a2ebe5","resolution":{"observed_at":"2026-08-04T11:08:04.674653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:04.839950Z","title":"The curious case of neural text degeneration,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:04.839950Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:f3ec8a973c2a9bc13bc21d9ef7d9db32dda397ebfa533a57b3e2a6b72fa4faee","observation_id":"6b0eb96c-f1e1-4e55-8433-38883a9593d8","resolution":{"observed_at":"2026-08-04T11:08:04.839950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:04.975467Z","title":"A learning algorithm for boltzmann machines,","venue":null,"work_id":null,"year":1985},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:04.975467Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:4a1ee2546b1c4083ef1add9a83925c071734b095ebf3e1a54588e1fdcb517686","observation_id":"c69697e7-4a6a-494f-80a9-e67315609030","resolution":{"observed_at":"2026-08-04T11:08:04.975467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:08:05.138583Z","title":"Synthetic literature: Writing science fiction in a co-creative process,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-04T11:08:05.138583Z"},"links":{"citing_paper":"/paper/2510.06928"},"observation_digest":"sha256:2e3ba2920cced68a7402fd54a91b97840548caeecb77b0719ea63a638d14ba7b","observation_id":"bcc94a5e-70b7-41c4-b80b-063ef30bb31f","resolution":{"observed_at":"2026-08-04T11:08:05.138583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.06928","last_updated":"2026-05-27T05:34:49Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T16:33:37.475163Z","submitted_at":"2025-10-08T12:08:21Z","title":"IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":57,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2510.06928."}