{"as_of":"2026-08-14T23:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:698c103987408fd75d7f6d700c8b5d96f9a80771c404b3aba139c0f4c4928950","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T23:15:46.631242Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T11:37:42.137388Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T01:12:13.502929Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-11T11:37:42.137388Z","title":"Taming scalable visual tok- enizer for autoregressive image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15321","last_updated":"2025-03-19T06:16:54Z","snapshot_observed_at":"2026-08-14T22:45:56.271530Z","submitted_at":"2024-12-19T18:59:36Z","title":"Next Patch Prediction for Autoregressive Visual Generation","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T11:37:42.137388Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2412.15321"},"observation_digest":"sha256:32da21419d5b9343b4039bc5a66e5d5971a2a00e1cf58316c0ce9d7a5a348ba9","observation_id":"e81aac83-706a-4d85-957a-9aaccec93474","resolution":{"observed_at":"2026-08-11T11:37:42.137388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-10T14:00:26.800718Z","title":"arXiv preprint arXiv:2412.02692 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15798","last_updated":"2025-01-27T05:49:06Z","snapshot_observed_at":"2026-08-12T17:55:13.744630Z","submitted_at":"2025-01-27T05:49:06Z","title":"MM-Retinal V2: Transfer an Elite Knowledge Spark into Fundus Vision-Language Pretraining","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T14:00:26.800718Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2501.15798"},"observation_digest":"sha256:71d156798b586e7c04f01de5ce3cff3b77906267739ea4e7f430cf2ff82ec893","observation_id":"b3a0c147-47a2-45ca-bd7e-dbceeb853e86","resolution":{"observed_at":"2026-08-10T14:00:26.800718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-06T23:01:49.760298Z","title":"Taming scalable visual tokenizer for autoregressive image generation.arXiv preprint arXiv:2412.02692, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20214","last_updated":"2025-07-08T07:46:39Z","snapshot_observed_at":"2026-08-09T16:18:48.711928Z","submitted_at":"2025-06-25T07:57:09Z","title":"UniCode$^2$: Cascaded Large-scale Codebooks for Unified Multimodal Understanding and Generation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T23:01:49.760298Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2506.20214"},"observation_digest":"sha256:2a9cdc7d19947fec769a1acd713b74e19e391794af9540f79578994379c65e3c","observation_id":"c99e1186-de25-478d-9674-808f355f0b44","resolution":{"observed_at":"2026-08-06T23:01:49.760298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-06T21:07:24.825964Z","title":"Taming scalable visual tok- enizer for autoregressive image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01016","last_updated":"2025-07-01T17:59:44Z","snapshot_observed_at":"2026-08-13T09:50:12.385424Z","submitted_at":"2025-07-01T17:59:44Z","title":"VQ-VLA: Improving Vision-Language-Action Models via Scaling Vector-Quantized Action Tokenizers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:24.825964Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2507.01016"},"observation_digest":"sha256:e545978ee97e7ecd448b3c395d0f8660d0a5ee863fe15a2d3c33687c789fc80b","observation_id":"3a536382-8929-4bb4-a7a0-e36e558a26ef","resolution":{"observed_at":"2026-08-06T21:07:24.825964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-06T20:49:41.987348Z","title":"Taming scalable visual tok- enizer for autoregressive image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-14T20:40:32.970220Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.987348Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:3b574b29afe2f33fde0371b27a6dde0121648ea4b2fef0427dde864c89d92ab7","observation_id":"7d998c79-5c41-4e98-a1c7-c77f1abbcc66","resolution":{"observed_at":"2026-08-06T20:49:41.987348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-06T05:45:11.216892Z","title":"arXiv:2412.02692","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02739","last_updated":"2025-08-02T13:15:59Z","snapshot_observed_at":"2026-08-13T02:32:16.463935Z","submitted_at":"2025-08-02T13:15:59Z","title":"Kronos: A Foundation Model for the Language of Financial Markets","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T05:45:11.216892Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2508.02739"},"observation_digest":"sha256:b3e20c51e1e3bac0c7b83f37954a84a99c371cd8afbf61b6375e097ff5242767","observation_id":"0fc17554-4fcc-4426-a7db-ce63894ee92f","resolution":{"observed_at":"2026-08-06T05:45:11.216892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-05T20:49:51.769898Z","title":"Taming scalable visual tokenizer for autoregressive image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09858","last_updated":"2025-08-13T14:50:19Z","snapshot_observed_at":"2026-08-10T07:55:10.749018Z","submitted_at":"2025-08-13T14:50:19Z","title":"HumanGenesis: Agent-Based Geometric and Generative Modeling for Synthetic Human Dynamics","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T20:49:51.769898Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2508.09858"},"observation_digest":"sha256:1b1d8269e0887c786d7ed618ad822e99341894a5310388bc55ac3baba9f4f24e","observation_id":"323e0566-9621-438f-8860-1313bcde4de7","resolution":{"observed_at":"2026-08-05T20:49:51.769898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-04T18:12:47.447503Z","title":"Taming scalable visual tokenizer for autoregressive image generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10140","last_updated":"2025-09-12T11:08:21Z","snapshot_observed_at":"2026-08-14T09:20:13.451816Z","submitted_at":"2025-09-12T11:08:21Z","title":"Scalable Training for Vector-Quantized Networks with 100% Codebook Utilization","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T18:12:47.447503Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2509.10140"},"observation_digest":"sha256:ce23b624e3df179a0f5e53d4bcd0117d5492d8aa17bc30d66e68519057d19bad","observation_id":"84c704ae-008d-48e2-9e95-1752a04f3115","resolution":{"observed_at":"2026-08-04T18:12:47.447503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":"2412.02692","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable image tokenization with index backpropagation quantization","venue":null,"work_id":"b3f063c5-ab7b-406a-b2cb-5c4a550bde24","year":2024},"citing_paper":{"arxiv_id":"2510.26583","last_updated":"2025-10-30T15:11:16Z","snapshot_observed_at":"2026-08-11T01:57:48.271968Z","submitted_at":"2025-10-30T15:11:16Z","title":"Emu3.5: Native Multimodal Models are World Learners","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-18T01:12:13.426640Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2510.26583"},"observation_digest":"sha256:eb69c841ae8011c7fcc56e4394fd8fec70b3a3d8b990c0ed4c91d606396b8c89","observation_id":"ae32dae3-3d6b-46d0-a3d7-3906182ad645","resolution":{"observed_at":"2026-05-18T01:12:13.504973Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-01T05:45:49.675083Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization.arXiv preprint arXiv:2412.02692, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22148","last_updated":"2026-07-24T09:47:32Z","snapshot_observed_at":"2026-08-10T14:26:51.007657Z","submitted_at":"2026-07-24T09:47:32Z","title":"dRAE: Representation Autoencoder with Hyper-Spherical Codes","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T05:45:49.675083Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2607.22148"},"observation_digest":"sha256:843c69535bb662e135df9954cab9a9e9d189071eee8a3b25c0a1636bfa7d971f","observation_id":"8acbf257-b51b-49fe-903b-fffef47608a8","resolution":{"observed_at":"2026-08-01T05:45:49.675083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.02692/citation-record","integrity":"/paper/2412.02692/integrity","json":"/paper/2412.02692/citation-record.json","paper":"/paper/2412.02692"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-11T23:15:46.081907Z","title":"Cosmos world foun- dation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.081907Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:af0db23a3dc5726c5d880d5fc47fcae6f34fa601dbee9e45cf8f52abc8b58d55","observation_id":"1c19259e-e996-4fd6-a9db-f334e62c254e","resolution":{"observed_at":"2026-08-11T23:15:46.081907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.05453","last_updated":"2020-02-16T18:35:27Z","snapshot_observed_at":"2026-08-11T05:38:01.369830Z","submitted_at":"2019-10-12T00:55:06Z","title":"vq-wav2vec: Self-Supervised Learning of Discrete Speech Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.05453","snapshot_observed_at":"2026-08-11T23:15:46.089540Z","title":"vq- wav2vec: Self-supervised learning of discrete speech repre- sentations","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.089540Z"},"links":{"cited_paper":"/paper/1910.05453","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:75b2dc117f37eb31f8f4a87483179eb999dafb58ba0b9649684c7ee7584b45f8","observation_id":"6cb689c4-cabb-413c-86e2-2fc7fd27fe21","resolution":{"observed_at":"2026-08-11T23:15:46.089540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08254","last_updated":"2022-09-03T14:11:33Z","snapshot_observed_at":"2026-08-13T16:48:25.566954Z","submitted_at":"2021-06-15T16:02:37Z","title":"BEiT: BERT Pre-Training of Image Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08254","snapshot_observed_at":"2026-08-11T23:15:46.100160Z","title":"Beit: Bert pre-training of image transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.100160Z"},"links":{"cited_paper":"/paper/2106.08254","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:4a17ec8976ad43f9e82fdf9df7daffb47c8a4362ccd0b82374fb054aa8166684","observation_id":"2a6fa680-d9c9-4403-baec-d762a69803d4","resolution":{"observed_at":"2026-08-11T23:15:46.100160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-08-14T04:51:04.817737Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-11T23:15:46.108354Z","title":"10 (a) (b) (a) (b) (a) (b) Figure 9","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.108354Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:e54b9b3fc95927614df637dd1ecc16bcf4350edb96dda8c370f528ce76071574","observation_id":"d56bd9a5-3f38-4d48-b70a-cfc9f4e5caf1","resolution":{"observed_at":"2026-08-11T23:15:46.108354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.743741Z","title":"Audiolm: a language modeling approach to audio genera- tion","venue":null,"work_id":"656a5b39-f8b8-4270-852c-bae26f4515f3","year":2023},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.143412Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:c1473ad06fb2af4cd997120ef1b3340337daf8d7a281544567ec2bbbd3ed4b2c","observation_id":"21e50a14-0504-49a6-9b98-af9eb5a1c122","resolution":{"observed_at":"2026-08-11T23:15:48.760471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.704898Z","title":"Language models are 12 few-shot learners","venue":null,"work_id":"3d968906-9472-4af1-8480-6de50cd4aafc","year":1901},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.154879Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:10fb374db32517faebad4adf2140fcce2ec1e2e6c9ff9a700aed90b29e77982b","observation_id":"7893aef8-f709-485c-bdfb-0f49996ebcbc","resolution":{"observed_at":"2026-08-11T23:15:48.720562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.668158Z","title":null,"venue":null,"work_id":"f3baa1db-6122-4fba-bfae-8493226ad087","year":2022},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.162145Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:d8e0e57ad82326f03f5338a1a287fb98579a2da61a6b24b958b8a5ffe8bc5985","observation_id":"f19a545e-4df8-458a-aa34-84ecc1bc1fc5","resolution":{"observed_at":"2026-08-11T23:15:48.679688Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.630718Z","title":"Conceptual 12m: Pushing web-scale image-text pre- training to recognize long-tail visual concepts","venue":null,"work_id":"cf81dab9-0232-4d46-b69b-4577c55c7ecb","year":2021},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.178641Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:6008390a7b9ecc63ca800f2b586d865b533c276d60a136bedf5c324dfe753889","observation_id":"eed4fa51-4f08-4b8c-a08b-8e02db6f6f63","resolution":{"observed_at":"2026-08-11T23:15:48.637141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.608470Z","title":"ImageNet: A large-scale hierarchical image database","venue":null,"work_id":"f2d38d69-6dd6-4b65-891d-ec3fa2a56e3c","year":2009},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.184202Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:840bbce656e104a5d1e0114e3033471eb1962cd040028ed22e3b463143acf34e","observation_id":"c8dbe700-c005-4fe3-8d3b-4a4a3a10eed1","resolution":{"observed_at":"2026-08-11T23:15:48.614459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:46.188607Z","title":"Diffusion mod- els beat gans on image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.188607Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:72794d2191d56d64531271d9f359f3b5ec8c0cd77fe8754276fe59c632266880","observation_id":"5aed4109-b1b2-40ed-9bc4-d7a81edcd04d","resolution":{"observed_at":"2026-08-11T23:15:46.188607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.532197Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"16cd01a4-f050-47b2-bdba-a75d44ec9080","year":2021},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.194982Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:700bb804d2db87178e92e06293d9a6e9dbe79976500815e8b106959f91a035cc","observation_id":"cd048b85-1d90-4584-928d-cf4afe6e2bfb","resolution":{"observed_at":"2026-08-11T23:15:48.545028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04431","last_updated":"2025-06-17T15:32:20Z","snapshot_observed_at":"2026-08-11T21:21:39.369697Z","submitted_at":"2024-12-05T18:53:02Z","title":"Infinity: Scaling Bitwise AutoRegressive Modeling for High-Resolution Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04431","snapshot_observed_at":"2026-08-11T23:15:46.208605Z","title":"Infinity: Scaling bit- wise autoregressive modeling for high-resolution image syn- thesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.208605Z"},"links":{"cited_paper":"/paper/2412.04431","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:6105277bd52228fdc57d3fcb6131cd48cf896666f55086879f0bfc7991459151","observation_id":"b5156830-aacf-4bbb-8c53-0de0c8326482","resolution":{"observed_at":"2026-08-11T23:15:46.208605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.499631Z","title":"GANs trained by a two time-scale update rule converge to a local nash equi- librium","venue":null,"work_id":"97218cd2-21e6-483a-a2cc-18c9aaa7a9f4","year":2017},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.217531Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:714f03b11eb02a6fdb76255b58046899c64ded30479934f6cc1255e6eab0f3d3","observation_id":"4f6e10cd-fc52-4db6-acf4-b6d170c8ed06","resolution":{"observed_at":"2026-08-11T23:15:48.515936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.461943Z","title":"Cascaded diffusion models for high fidelity image generation","venue":null,"work_id":"267cf91e-948e-4975-9305-5fbfb91d9024","year":null},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.222209Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:54f95c54a829456a8bb731dd9e58ab20db2faf3b9e2ca0ffb1656ba933bc051b","observation_id":"a664c603-a593-49cf-baba-6f60d2874b22","resolution":{"observed_at":"2026-08-11T23:15:48.476615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.399610Z","title":"Towards accurate image coding: Improved au- toregressive image generation with dynamic vector quantiza- tion","venue":null,"work_id":"47d95030-9d0b-4281-9dc7-0b28568447ab","year":2023},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.228706Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:4a0c0414259e63c1955d877b2ac7593ea824b15762ef4085751f7d870c6c2ce9","observation_id":"4d321c40-506b-4860-9e16-e7997574809a","resolution":{"observed_at":"2026-08-11T23:15:48.415351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.360544Z","title":null,"venue":null,"work_id":"183d4baf-acb6-4f73-8817-5def1996d0cb","year":2017},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.238731Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:675f52099ad345f577f6baa018f370565e029413e985107eff61ead0ef2f829c","observation_id":"678b01ed-1d31-4952-8ab3-ab3f0e75e1d8","resolution":{"observed_at":"2026-08-11T23:15:48.375947Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-11T23:15:46.247755Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.247755Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:606b36b9c9809b3799df41a8d7794a1f4c888dc4546739e233f1d45cafb798d8","observation_id":"3ccde305-39b5-4d73-896a-9803ab24c329","resolution":{"observed_at":"2026-08-11T23:15:46.247755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-14T18:51:16.666127Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-11T23:15:46.264532Z","title":"Adam: A method for stochastic opti- mization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.264532Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:07f0d26b238d7621c4b9307a20ed9362c1ac1e61bf1b195d0e52908eb0a1339d","observation_id":"c76f3202-3e98-4347-8d4d-8d65581f43d9","resolution":{"observed_at":"2026-08-11T23:15:46.264532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.329443Z","title":"Improved precision and recall met- ric for assessing generative models","venue":null,"work_id":"e896dc8b-0211-4850-a0f1-9c02059aa470","year":2019},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.278599Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:4a53acdd973548b80fb06bf79f9a01a4fd542c9c260cb767589c746149319107","observation_id":"3a2a60bb-4181-4083-8e49-0211625528a2","resolution":{"observed_at":"2026-08-11T23:15:48.340988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.309037Z","title":"Laion-coco 600m","venue":null,"work_id":"4b15f5e4-33bf-49a9-907b-ec9fa7f23b2e","year":2022},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.307892Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:8528204279c05b1bea8d1471ab05be2b0a915e102a0666ad915110a6f8287978","observation_id":"f0b627d3-87c0-456c-b8d5-04be9935adb9","resolution":{"observed_at":"2026-08-11T23:15:48.314638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.282905Z","title":"Autoregressive image generation using residual quantization","venue":null,"work_id":"176a102c-4bbf-45d1-bc33-c663b168e897","year":2022},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.314501Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:8170a93e43042da28dde8c0718b93dbab6b45265dae2e3a071358f77d438c783","observation_id":"07467f0a-ae65-4c64-92e4-cb6137de697b","resolution":{"observed_at":"2026-08-11T23:15:48.291641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.254371Z","title":"Mage: Masked generative encoder to unify representation learning and image synthe- sis","venue":null,"work_id":"d0dd0d1c-d8b0-4676-979c-c8e8f0de424d","year":2023},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.324261Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:5b743af34a43f442562771289c382036a5f41215c0c9f4e2d45b5cb410399c68","observation_id":"c9eb4038-ed65-40d0-974f-7893f58c903b","resolution":{"observed_at":"2026-08-11T23:15:48.260348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11838","last_updated":"2024-11-01T14:45:36Z","snapshot_observed_at":"2026-08-14T09:04:40.967071Z","submitted_at":"2024-06-17T17:59:58Z","title":"Autoregressive Image Generation without Vector Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11838","snapshot_observed_at":"2026-08-11T23:15:46.336301Z","title":"Autoregressive image generation without vec- tor quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.336301Z"},"links":{"cited_paper":"/paper/2406.11838","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:8b8ad00b1331403c1a8f3483ec61515679667633f4a68e6a775059a7bea13945","observation_id":"b8d07e5a-a12e-4aeb-963e-069d483ce525","resolution":{"observed_at":"2026-08-11T23:15:46.336301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-11T23:15:46.352519Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.352519Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:0bcc3b5ce592926f996bc2006167d0c465a9f7a65b85d36346421eec9058123e","observation_id":"d25316ae-3050-489c-91e1-81c1907e1d53","resolution":{"observed_at":"2026-08-11T23:15:46.352519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04410","last_updated":"2025-02-09T08:59:19Z","snapshot_observed_at":"2026-08-14T02:43:25.975990Z","submitted_at":"2024-09-06T17:14:53Z","title":"Open-MAGVIT2: An Open-Source Project Toward Democratizing Auto-regressive Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04410","snapshot_observed_at":"2026-08-11T23:15:46.358367Z","title":"Open-magvit2: An open-source project toward democratizing auto-regressive visual gener- ation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.358367Z"},"links":{"cited_paper":"/paper/2409.04410","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:a012816e2fa768592a3923ffc84a0eae96ab2bbf8dc99cdd7c800a3feb4024a5","observation_id":"c2d735d8-4fb1-4c58-bd9c-c8d5abe60ea5","resolution":{"observed_at":"2026-08-11T23:15:46.358367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T23:15:46.373663Z","title":"GPT-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.373663Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:48fda8a31509cead6a5832b637f9682d2b786e43c361f30789a858e8113fd30f","observation_id":"3f051b61-9bbe-44b8-bd0d-2f2be3097991","resolution":{"observed_at":"2026-08-11T23:15:46.373663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.00716","last_updated":"2023-10-28T11:46:07Z","snapshot_observed_at":"2026-08-14T07:22:52.580615Z","submitted_at":"2023-07-03T02:39:08Z","title":"JourneyDB: A Benchmark for Generative Image Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.00716","snapshot_observed_at":"2026-08-11T23:15:46.385279Z","title":"Journeydb: A benchmark for generative im- age understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.385279Z"},"links":{"cited_paper":"/paper/2307.00716","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:8497488ed39caf6f52c96e4ccf32b9225b0d06589b7286327832de9644b21196","observation_id":"f050d890-6a36-4aab-afcc-1961181d30c7","resolution":{"observed_at":"2026-08-11T23:15:46.385279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.223526Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"5456cd37-fea7-449e-b9a7-034e5db0c39a","year":2023},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.402930Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:0edec0abd2ec3615cd398001fe26ec523db80c5272479fdedfde27edcda58bb0","observation_id":"deef5838-042f-4b7f-a04e-6dba772fbdf3","resolution":{"observed_at":"2026-08-11T23:15:48.232003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03069","last_updated":"2025-08-07T09:08:33Z","snapshot_observed_at":"2026-08-14T01:35:56.896431Z","submitted_at":"2024-12-04T06:46:55Z","title":"TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03069","snapshot_observed_at":"2026-08-11T23:15:46.411334Z","title":"Tokenflow: Unified image tokenizer for multimodal understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.411334Z"},"links":{"cited_paper":"/paper/2412.03069","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:df6c96b14b047c6980e6ae2e124a3f46de7c50f9fbba9cccbb71a49c9caed7d1","observation_id":"88f6eeff-8513-4a51-849a-7144f2448515","resolution":{"observed_at":"2026-08-11T23:15:46.411334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:46.422729Z","title":"Gener- ating diverse high-fidelity images with vq-vae-2","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.422729Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:cfc59433bc1d19cf4f6cd0f86835cd36ef433f016b293f117df804e8f53922c1","observation_id":"190310fb-b769-4d30-b8dc-5ac71c3ac427","resolution":{"observed_at":"2026-08-11T23:15:46.422729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.165694Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"5f67a588-de9d-4661-8eb4-1eab845e23a7","year":2022},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.433441Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:bce53240fb690bd82a628cd8db856b5dc6362404d760f2f4077399e30d69328e","observation_id":"78854822-a3b7-476c-a918-efcdc3977be2","resolution":{"observed_at":"2026-08-11T23:15:48.172311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.122451Z","title":"Improved techniques for training gans","venue":null,"work_id":"98d95dc3-07a4-4ea3-826e-94a1fb9497ba","year":2016},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.442194Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:f8454febb53720475d646e0726498ddef5ae5f6dec03cf4d3eb84a464bcd63b2","observation_id":"af7a047e-dc8a-4a02-8eae-9f633e097406","resolution":{"observed_at":"2026-08-11T23:15:48.128728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.070095Z","title":"Laion- aesthetics","venue":null,"work_id":"adaf8e6e-1a05-4381-aff0-87a5e399fa87","year":2022},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.449225Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:813fac708386a70ec5eb5ea7984b513128d08e70ef4e0cb16b1e0af48ec63b78","observation_id":"a9c0e8c2-7bec-4ab6-9dcc-05f67116d3b8","resolution":{"observed_at":"2026-08-11T23:15:48.094988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.046718Z","title":"Conceptual captions: A cleaned, hypernymed, im- age alt-text dataset for automatic image captioning","venue":null,"work_id":"a892f28f-0a7d-4f28-abbf-9bdde95bd2c0","year":2018},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.456138Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:e195a5cffe1441e3d06ad08ebb9848143c82bd0f4fab58839e49a1bf999bcb5a","observation_id":"2824b972-8490-4ad6-927f-e5fa739e1fde","resolution":{"observed_at":"2026-08-11T23:15:48.052735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-08-11T06:21:56.129166Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-11T23:15:46.469089Z","title":"Glu variants improve transformer","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.469089Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:1d7a744afe27ec82694396cafb9ad1b551da000b68244b92392d976e5f7034d4","observation_id":"15775df0-948b-425a-acb0-0d89d3cfc0be","resolution":{"observed_at":"2026-08-11T23:15:46.469089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:48.009942Z","title":"Roformer: Enhanced transformer with rotary position embedding, 2024","venue":null,"work_id":"1333da3c-9def-4ac3-a271-aa512c94e350","year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.487259Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:5d8a69d69e081ff59dcd5ea8f56857d5f3db61f4db0a04a07e7b54f5fa5fcd02","observation_id":"0077a49a-cb0b-4dfc-82a0-a347db82d687","resolution":{"observed_at":"2026-08-11T23:15:48.020523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-08-13T22:05:34.844117Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-11T23:15:46.494182Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.494182Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:1d3d500785d12745d22266d86a5617402547282d9f7feb22d61172683ab63b00","observation_id":"ff8a588a-d5d9-4421-b2c2-d94d19edd861","resolution":{"observed_at":"2026-08-11T23:15:46.494182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09818","last_updated":"2025-03-21T05:54:00Z","snapshot_observed_at":"2026-08-12T11:54:14.007649Z","submitted_at":"2024-05-16T05:23:41Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09818","snapshot_observed_at":"2026-08-11T23:15:46.504301Z","title":"Chameleon: Mixed-modal early-fusion foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.504301Z"},"links":{"cited_paper":"/paper/2405.09818","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:1b95935c754c13d11b6da7993ac7946c911ef95049a77c6547387b8e9606bccf","observation_id":"994cf689-b3f6-4855-b697-31a630ffee3f","resolution":{"observed_at":"2026-08-11T23:15:46.504301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02905","last_updated":"2024-06-10T17:59:07Z","snapshot_observed_at":"2026-08-13T06:27:06.478433Z","submitted_at":"2024-04-03T17:59:53Z","title":"Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02905","snapshot_observed_at":"2026-08-11T23:15:46.513031Z","title":"Visual autoregressive modeling: Scalable im- age generation via next-scale prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.513031Z"},"links":{"cited_paper":"/paper/2404.02905","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:cb41038303f30f0814aaffdfc497e2da954b84bcaf4a6a83e9cdc809950eb4b3","observation_id":"2d5ecb2f-f1e6-43a7-8309-05dafaba5851","resolution":{"observed_at":"2026-08-11T23:15:46.513031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-11T23:15:46.530869Z","title":"Llama 2: Open foundation and fine- tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.530869Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:2b06c3d37028e371f74053a80927055559d279a2898ceec6cc84c5741e7a7760","observation_id":"24979fbd-7709-4f97-928a-c0da2d9928f1","resolution":{"observed_at":"2026-08-11T23:15:46.530869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:47.976603Z","title":"Regularizing generative adversarial networks under limited data","venue":null,"work_id":"4a598c2b-6fd7-4910-8904-b708b2f8d3e6","year":2021},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.539496Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:d440e65936a5605346d6dcacd5d4ac562dbd9c50443ab8571fc2d54a1e5ddb43","observation_id":"f7b0ee27-8150-4157-82d4-696e6985a341","resolution":{"observed_at":"2026-08-11T23:15:47.986132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:47.945572Z","title":"Neural discrete representation learning","venue":null,"work_id":"57b38e86-23fb-433d-8018-8d7e85967d07","year":2017},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.547873Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:bd2eed99614aba865d294ffa39ff43309606c36855bae3399754333540cd7e11","observation_id":"62104cbc-e791-4722-ae01-dc0a720b95b8","resolution":{"observed_at":"2026-08-11T23:15:47.955205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:46.559335Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.559335Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:c4a86417b6112bf7377fc77ff0b91d31adaf01df3e9864290628757961c00f8e","observation_id":"9e78af58-c271-4b7b-a7a0-928b496f9a8d","resolution":{"observed_at":"2026-08-11T23:15:46.559335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-11T23:15:46.565959Z","title":"Emu3: Next-token prediction is all you need","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.565959Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:87a26736e1268726b95e56e938c2ecc530be325fb44b5cc3ca089e06f87e6b51","observation_id":"9326b1c5-61e6-45a2-ae3f-ddf4fb9dc587","resolution":{"observed_at":"2026-08-11T23:15:46.565959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-11T23:15:46.575073Z","title":"Show-o: One single transformer to unify multimodal understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.575073Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:dcfa20069285a74d61ee49d8e08344edea3bfeeaccb97cb0b0e15731d03bc8b8","observation_id":"b4c5e717-0984-41f9-b049-f308745b3e69","resolution":{"observed_at":"2026-08-11T23:15:46.575073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:47.876580Z","title":"Vector-quantized image modeling with improved VQGAN","venue":null,"work_id":"dc019f8a-e5c8-478a-8528-321ac26e160c","year":2022},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.585833Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:a5ca288f24f469cefe5ea72435ce0f885a6dc560caf905e7bacdc06b78929d02","observation_id":"d6411964-b629-4cac-90a4-db6bc27e6b22","resolution":{"observed_at":"2026-08-11T23:15:47.884809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:47.816165Z","title":"Language model beats diffusion - tokenizer is key to visual generation","venue":null,"work_id":"f7abe6fe-880f-4e85-9f93-3245b244f9d2","year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.590453Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:a4e6494078fe5b93de0332c962dc42147fced005d15d8755ae415ddff69e019f","observation_id":"fcd1baf0-fd55-484f-bcea-0bcaa4f495fd","resolution":{"observed_at":"2026-08-11T23:15:47.848386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:47.781474Z","title":"Capsfu- sion: Rethinking image-text data at scale","venue":null,"work_id":"361723d3-f11c-48a5-86cd-2a26f1072d2e","year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.599327Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:05ba419d78f781e6ecca270289405dbaffaa98e14a3e9191f122f22c0552ae6e","observation_id":"01e709bf-636d-40b9-beba-d67c383da024","resolution":{"observed_at":"2026-08-11T23:15:47.788311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07550","last_updated":"2024-06-11T17:59:56Z","snapshot_observed_at":"2026-08-12T23:45:15.377628Z","submitted_at":"2024-06-11T17:59:56Z","title":"An Image is Worth 32 Tokens for Reconstruction and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07550","snapshot_observed_at":"2026-08-11T23:15:46.604883Z","title":"An image is worth 32 tokens for reconstruction and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.604883Z"},"links":{"cited_paper":"/paper/2406.07550","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:72e8e6577a3eae89f1b3b5eb3989c17c9be2c2797b9b55d0132e5674a05eb82e","observation_id":"1f870dfc-649d-44de-9619-d55ad2ee8873","resolution":{"observed_at":"2026-08-11T23:15:46.604883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:15:47.717174Z","title":"Efros, Eli Shecht- man, and Oliver Wang","venue":null,"work_id":"813c14ab-c742-483c-a165-7459b0da513b","year":2018},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.615387Z"},"links":{"citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:300b572162f3fa14341b4be0e6fe8f4edfc1a49e26953b026e421ae1ccab66b5","observation_id":"64675680-7cfe-4b94-b862-9aba4124e937","resolution":{"observed_at":"2026-08-11T23:15:47.725523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-11T23:15:46.620482Z","title":"Diab, Xian Li, Xi Victoria Lin, Todor Mihaylov, Myle Ott, Sam Shleifer, Kurt Shuster, Daniel Simig, Punit Singh Koura, Anjali Sridhar, Tianlu Wang, and Luke Zettlemoyer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.620482Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:ff241784656e7a51857f7d6204132dab9895cc00f83a9b61b93d8a4c737afeb2","observation_id":"df6f8be6-e9b5-4b62-b210-883d855a4a67","resolution":{"observed_at":"2026-08-11T23:15:46.620482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11837","last_updated":"2024-06-17T17:59:57Z","snapshot_observed_at":"2026-08-12T23:40:45.834749Z","submitted_at":"2024-06-17T17:59:57Z","title":"Scaling the Codebook Size of VQGAN to 100,000 with a Utilization Rate of 99%","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11837","snapshot_observed_at":"2026-08-11T23:15:46.631242Z","title":"Scaling the codebook size of vqgan to 100,000 with a utilization rate of 99%","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:46.631242Z"},"links":{"cited_paper":"/paper/2406.11837","citing_paper":"/paper/2412.02692"},"observation_digest":"sha256:9bf813dd219c91e3453b3320ade5cc24a1efa802857b3a86dc137481c69b965d","observation_id":"ec26adc0-ca0f-4719-a6af-816c9277ff18","resolution":{"observed_at":"2026-08-11T23:15:46.631242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T11:16:32.406442Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 10 inbound Pith citation observations for arXiv:2412.02692."}