{"as_of":"2026-08-09T21:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8283d20ef2452480b6976fe1e2cb509fc78175f1cc0ef98347a1428b347c271f","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:49:43.861863Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.01756/citation-record","integrity":"/paper/2507.01756/integrity","json":"/paper/2507.01756/citation-record.json","paper":"/paper/2507.01756"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T20:49:40.410671Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.410671Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:0595526bcb905f2a2a14d909975bfac6613553a62a876b7ad8c6d22afaee8cc4","observation_id":"a309802a-78df-415a-b8d5-1b36b700a450","resolution":{"observed_at":"2026-08-06T20:49:40.410671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:45.908600Z","title":"Maskgit: Masked generative image transformer","venue":null,"work_id":"904f61de-a96b-49f3-824d-0d7041075427","year":2022},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.464546Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:dec88bb1c33a7536d63b0181c63264d2fa40c74da6997e18ef44fdf5c91cdc3c","observation_id":"cae5366e-7bf8-4e17-83ae-97c1d5955c93","resolution":{"observed_at":"2026-08-06T20:49:46.043806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10958","last_updated":"2025-03-14T22:22:40Z","snapshot_observed_at":"2026-07-06T20:07:10.352535Z","submitted_at":"2024-12-14T20:29:29Z","title":"SoftVQ-VAE: Efficient 1-Dimensional Continuous Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10958","snapshot_observed_at":"2026-08-06T20:49:40.554531Z","title":"Softvq-vae: Efficient 1-dimensional con- tinuous tokenizer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.554531Z"},"links":{"cited_paper":"/paper/2412.10958","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:245c73df5deb546ed36b323f25cd2d15a928354f43b689bc80d661043345e9f7","observation_id":"00cb8b07-238c-497a-97e4-1ca54dcd4c11","resolution":{"observed_at":"2026-08-06T20:49:40.554531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08698","last_updated":"2023-07-17T17:57:56Z","snapshot_observed_at":"2026-08-04T12:09:15.933692Z","submitted_at":"2023-07-17T17:57:56Z","title":"Flow Matching in Latent Space","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08698","snapshot_observed_at":"2026-08-06T20:49:40.625491Z","title":"Flow matching in latent space","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.625491Z"},"links":{"cited_paper":"/paper/2307.08698","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:a28225b8c00661ffed121c55811c5ca4f3667fc53d1811cde476f1b097140fa1","observation_id":"4319f330-b1b1-4e59-82b4-f7799b5cbc7d","resolution":{"observed_at":"2026-08-06T20:49:40.625491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:40.685526Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.685526Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:93299c058e3897ff977fda7abe8120651fffebc844422957961b4c8fe45901b9","observation_id":"cd55c8ec-1eab-4532-b5ef-62cb9c5f1a27","resolution":{"observed_at":"2026-08-06T20:49:40.685526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:40.758768Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.758768Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:dd2f914717ecd83e17994979012f6e9a792591f6affb507039b0461b76fab558","observation_id":"6e6c8853-496e-4ccf-96fc-b243ef21d0e2","resolution":{"observed_at":"2026-08-06T20:49:40.758768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13863","last_updated":"2024-10-17T17:59:59Z","snapshot_observed_at":"2026-08-07T22:15:46.490983Z","submitted_at":"2024-10-17T17:59:59Z","title":"Fluid: Scaling Autoregressive Text-to-image Generative Models with Continuous Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13863","snapshot_observed_at":"2026-08-06T20:49:40.829577Z","title":"Fluid: Scaling autoregressive text-to-image generative models with continuous tokens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.829577Z"},"links":{"cited_paper":"/paper/2410.13863","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:d7f41bfde11bf296ba06a037e10608f889482fd0d01c2281b4b9a34d38778a74","observation_id":"84ddbe34-a503-4eb4-a725-9b3fdef2f40f","resolution":{"observed_at":"2026-08-06T20:49:40.829577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-06T20:49:40.899190Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.899190Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:28dd56ee21adcc53d315e2f5e6e4bc81cbb64655bed56e3c8f80e318e839289e","observation_id":"5989a483-4b75-4a5c-b7af-aa9ee27973ad","resolution":{"observed_at":"2026-08-06T20:49:40.899190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:40.947061Z","title":"Generative adversarial nets","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.947061Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:ec150c86558c274b34d9733f4a3f5d32cd736dde3dfa0bc2dcc4a5ff86191677","observation_id":"9c513895-3858-44e2-801f-35a7c3973e81","resolution":{"observed_at":"2026-08-06T20:49:40.947061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:45.653205Z","title":"Rethinking the objectives of vector- quantized tokenizers for image synthesis","venue":null,"work_id":"4e3feb71-f230-48a3-8d35-b88081084da6","year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.014819Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:d0dac852691d572cfa5294950080d1adfe5061c0446c897546798ed06684c482","observation_id":"89685d0b-7292-4e1c-9d26-b03b9bc061de","resolution":{"observed_at":"2026-08-06T20:49:45.775186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04431","last_updated":"2025-06-17T15:32:20Z","snapshot_observed_at":"2026-08-09T15:27:55.219992Z","submitted_at":"2024-12-05T18:53:02Z","title":"Infinity: Scaling Bitwise AutoRegressive Modeling for High-Resolution Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04431","snapshot_observed_at":"2026-08-06T20:49:41.040335Z","title":"Infinity: Scaling bit- wise autoregressive modeling for high-resolution image syn- thesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.040335Z"},"links":{"cited_paper":"/paper/2412.04431","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:aef9514baa580750386e7a23de3b9db2d09e5dc6fc301a826dc5a8cff98c8237","observation_id":"b0ec6ca0-9a48-423d-809d-19db8a037009","resolution":{"observed_at":"2026-08-06T20:49:41.040335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:41.107673Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.107673Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:dcb59bc6af082b1118d937a5c8c8f81961e8732efdf226c5c5d2f7df45945187","observation_id":"9b89322d-464a-4921-91dd-8a1d9722eb0c","resolution":{"observed_at":"2026-08-06T20:49:41.107673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:41.159888Z","title":"Acdit: Interpolating autoregressive con- ditional modeling and diffusion transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.159888Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:f7af1999b984070646f315fc814667171cbaf18cc419e20a94b37e4807b63e5c","observation_id":"438627f9-f79e-4d63-9689-e9c934ca404e","resolution":{"observed_at":"2026-08-06T20:49:41.159888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:41.208208Z","title":"Auto-encoding vari- ational bayes, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.208208Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:429cd6536d6041cefff77f1c95b3edfb5a44024888ae8a912e5c51c69d2e7055","observation_id":"53ed039c-2ff2-46a5-8a2c-02524a020f09","resolution":{"observed_at":"2026-08-06T20:49:41.208208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:41.274498Z","title":"Autoregressive image generation using residual quantization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.274498Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:e7aae48b5e0e8f6bdd653bbb5cc9da1b14d0572994cba2eb7b92904925340b1c","observation_id":"2c6b71d6-6bb7-47fe-9e94-52c6d830322a","resolution":{"observed_at":"2026-08-06T20:49:41.274498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:45.395921Z","title":"Autoregressive image generation without vec- tor quantization","venue":null,"work_id":"fe116e0d-e869-41b7-80c9-242906c6b0ff","year":2025},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.322404Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:2dcf78cacc433a3a5e27dcc8e8262f9e3a8f344bec6f2ed9eab830940f518941","observation_id":"211cbf41-a61c-4348-acd2-e6d994ebf7a9","resolution":{"observed_at":"2026-08-06T20:49:45.499643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-06T20:49:41.373771Z","title":"Flow matching for generative mod- eling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.373771Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:a2c3b984e524e91619a06383c4a57db7e5154a17f432683eca02048896e75166","observation_id":"6069cb31-1933-46e0-98a6-6c8b52e59d4d","resolution":{"observed_at":"2026-08-06T20:49:41.373771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T20:49:41.433253Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.433253Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:5a70e95cb3fcd0e55f12c13c7fa749562cbb8f602adb1968be5be25d8f6c0152","observation_id":"22711448-6544-4600-b7b1-fa530e1e7e81","resolution":{"observed_at":"2026-08-06T20:49:41.433253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:45.201255Z","title":"Sit: Explor- ing flow and diffusion-based generative models with scalable interpolant transformers","venue":null,"work_id":"a31194df-1e37-44e1-812e-0f467f615182","year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.493078Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:c41efb2a8b4218e8a146d74c99ab4500d18d7625fe821ed7e3b830fbadcb6d15","observation_id":"04eaa166-59c1-43ab-8df6-6b53e76d5a05","resolution":{"observed_at":"2026-08-06T20:49:45.275909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09732","last_updated":"2025-01-16T18:30:37Z","snapshot_observed_at":"2026-07-06T20:22:04.328179Z","submitted_at":"2025-01-16T18:30:37Z","title":"Inference-Time Scaling for Diffusion Models beyond Scaling Denoising Steps","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09732","snapshot_observed_at":"2026-08-06T20:49:41.574998Z","title":"Inference-time scaling for diffu- sion models beyond scaling denoising steps","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.574998Z"},"links":{"cited_paper":"/paper/2501.09732","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:e65bd5d140e919ba7cb1a5584969388f5f8042b5554445cd28d9d07595ca5b8f","observation_id":"a68b95c8-627f-498d-bcf9-ba6bf85e8acb","resolution":{"observed_at":"2026-08-06T20:49:41.574998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:44.977855Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":"f25fb205-e6bb-4370-9e14-3b088298ed78","year":2022},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.624361Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:5e667c972861943c4f28c5542f42514f9d6170a8d555b59e3eab7fce706afa00","observation_id":"67f2e531-6908-4911-8d1d-eda963bcb022","resolution":{"observed_at":"2026-08-06T20:49:45.076547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01827","last_updated":"2025-07-08T00:51:16Z","snapshot_observed_at":"2026-08-04T04:01:49.750596Z","submitted_at":"2024-12-02T18:59:53Z","title":"RandAR: Decoder-only Autoregressive Visual Generation in Random Orders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01827","snapshot_observed_at":"2026-08-06T20:49:41.683560Z","title":"Randar: Decoder-only autoregressive visual generation in random orders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.683560Z"},"links":{"cited_paper":"/paper/2412.01827","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:03d6abf24dee3d08faa54a73ad01fa865f56cfb2af2b90cbe95fe056d49f8739","observation_id":"bf60b8b0-3048-4fb7-ba33-2c4190826b07","resolution":{"observed_at":"2026-08-06T20:49:41.683560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:41.750428Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.750428Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:10d512bad59f17e0fbdf0558e4e983cd700db59d98421b0b1bcd8f156b42a577","observation_id":"2057b161-365f-474f-a842-59ef6ac87f84","resolution":{"observed_at":"2026-08-06T20:49:41.750428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-06T20:49:41.816574Z","title":"Sdxl: Improving latent diffusion mod- els for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.816574Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:5d3557ea2cd728e41699460454ff8e86fb4f1b3afdee02a5f023b0335733c44f","observation_id":"21ac6c67-a52e-4256-8c6e-c813248832d0","resolution":{"observed_at":"2026-08-06T20:49:41.816574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03069","last_updated":"2025-08-07T09:08:33Z","snapshot_observed_at":"2026-07-06T20:01:23.373458Z","submitted_at":"2024-12-04T06:46:55Z","title":"TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03069","snapshot_observed_at":"2026-08-06T20:49:41.857110Z","title":"Tokenflow: Unified image tokenizer for multimodal understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.857110Z"},"links":{"cited_paper":"/paper/2412.03069","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:c676a6ba823a61253efbf7c122afce2e7c2a921202e59a2c4968636a3b582ff8","observation_id":"c1aa9569-6165-4191-ae36-9f863a158d8a","resolution":{"observed_at":"2026-08-06T20:49:41.857110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15205","last_updated":"2024-12-19T18:59:31Z","snapshot_observed_at":"2026-08-05T21:19:08.972222Z","submitted_at":"2024-12-19T18:59:31Z","title":"FlowAR: Scale-wise Autoregressive Image Generation Meets Flow Matching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15205","snapshot_observed_at":"2026-08-06T20:49:41.897149Z","title":"Flowar: Scale-wise autoregres- sive image generation meets flow matching","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.897149Z"},"links":{"cited_paper":"/paper/2412.15205","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:d25d8d64cdefa4a1805a22c091670ad4fe506d59a86d50bb1d394432c941aac1","observation_id":"4f4a7ad5-af68-4dbb-bc80-118f773917b8","resolution":{"observed_at":"2026-08-06T20:49:41.897149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:44.827056Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"337fe751-a78e-4026-9fe3-cb354b49a6b1","year":2022},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.937673Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:54660758b7b88b695fd89a670745e3729ccd54913124c5b84067212421a05f55","observation_id":"b8d68fc7-c92d-4fe1-9665-c0699c2bc5a3","resolution":{"observed_at":"2026-08-06T20:49:44.887548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02692","last_updated":"2025-03-10T09:01:48Z","snapshot_observed_at":"2026-07-06T20:01:05.921085Z","submitted_at":"2024-12-03T18:59:10Z","title":"Scalable Image Tokenization with Index Backpropagation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02692","snapshot_observed_at":"2026-08-06T20:49:41.987348Z","title":"Taming scalable visual tok- enizer for autoregressive image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:41.987348Z"},"links":{"cited_paper":"/paper/2412.02692","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:2f36327d1b170c62f43009784b555589c02a3eb9821820862280a716cc2b400a","observation_id":"7d998c79-5c41-4e98-a1c7-c77f1abbcc66","resolution":{"observed_at":"2026-08-06T20:49:41.987348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15188","last_updated":"2025-02-05T02:26:38Z","snapshot_observed_at":"2026-08-09T19:20:28.819295Z","submitted_at":"2024-12-19T18:56:24Z","title":"LMFusion: Adapting Pretrained Language Models for Multimodal Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15188","snapshot_observed_at":"2026-08-06T20:49:42.028479Z","title":"Llamafu- sion: Adapting pretrained language models for multimodal generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.028479Z"},"links":{"cited_paper":"/paper/2412.15188","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:6871ae6fad0f89b18e3542cf863ef657d1e0064b37ad0975209f37efac9a6214","observation_id":"72d32ee3-09c9-486d-a573-65be95ab85cf","resolution":{"observed_at":"2026-08-06T20:49:42.028479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-06T20:49:42.079729Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.079729Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:da76dea40a8ff76e41b338de116b03534b2ca075f572973e5f9bdb88fe89c793","observation_id":"b9a6b2cb-bbb3-4952-a9d4-990b1c8e0eb4","resolution":{"observed_at":"2026-08-06T20:49:42.079729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10812","last_updated":"2024-10-14T17:59:42Z","snapshot_observed_at":"2026-08-09T17:44:55.180658Z","submitted_at":"2024-10-14T17:59:42Z","title":"HART: Efficient Visual Generation with Hybrid Autoregressive Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10812","snapshot_observed_at":"2026-08-06T20:49:42.131239Z","title":"Hart: Efficient visual generation with hybrid au- toregressive transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.131239Z"},"links":{"cited_paper":"/paper/2410.10812","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:4e54fe5cbb40a9ee2910f5732dc4e537e3e91392b2635bf61718e97971daa2df","observation_id":"e85bd7f2-1e2e-48a9-b97c-fbb89592e658","resolution":{"observed_at":"2026-08-06T20:49:42.131239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09818","last_updated":"2025-03-21T05:54:00Z","snapshot_observed_at":"2026-08-09T20:05:31.409634Z","submitted_at":"2024-05-16T05:23:41Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09818","snapshot_observed_at":"2026-08-06T20:49:42.173644Z","title":"Chameleon: Mixed-modal early-fusion foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.173644Z"},"links":{"cited_paper":"/paper/2405.09818","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:44e8f7695cb5cc8b85be23798e010868063110bf1e6cfb74854f1a8692b3f487","observation_id":"c1306bb1-7de3-49a4-96bc-601b4b48c194","resolution":{"observed_at":"2026-08-06T20:49:42.173644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T20:49:42.212770Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.212770Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:d007b2a7a5d3726bf44810cd427a918256b773e1d32e41c0288a6272874312dd","observation_id":"50dc8932-7767-492f-adae-b699fade339b","resolution":{"observed_at":"2026-08-06T20:49:42.212770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:44.655474Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction","venue":null,"work_id":"ae3b1e0a-f0c8-4914-99a8-5121c5d6d060","year":2025},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.237158Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:212b8b0fc22852486e6dec7061984aa06ae1541e2569ecac9a3ff5cf91b48b3e","observation_id":"7d50339c-010c-4a7f-a9d9-0fd1ef94e139","resolution":{"observed_at":"2026-08-06T20:49:44.758230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14164","last_updated":"2024-12-18T18:58:50Z","snapshot_observed_at":"2026-08-08T15:05:21.947334Z","submitted_at":"2024-12-18T18:58:50Z","title":"MetaMorph: Multimodal Understanding and Generation via Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14164","snapshot_observed_at":"2026-08-06T20:49:42.284132Z","title":"Metamorph: Multimodal understanding and generation via instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.284132Z"},"links":{"cited_paper":"/paper/2412.14164","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:67eea3398a99cbc345ee6d2d204e488ee46bc10ffd0cd132fb2b9172b0bdffb9","observation_id":"322ac4a2-047d-4531-a1be-351033baa8fb","resolution":{"observed_at":"2026-08-06T20:49:42.284132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T20:49:42.287458Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.287458Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:ac7a94095282b5cbe48a71aff443a9e8d9e8e85d6792faaf712e035009f90dda","observation_id":"f18bf4f7-eb8f-4599-b64f-9c7078b711ba","resolution":{"observed_at":"2026-08-06T20:49:42.287458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-06T20:49:42.290451Z","title":"Emu3: Next-token prediction is all you need","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.290451Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:0fe1cdc775f8c1aa85c12d3a5d2b6d797c2ee944eb53a3807a9a88990c31873b","observation_id":"60cf142c-0d1e-4891-8013-64c9eb89867e","resolution":{"observed_at":"2026-08-06T20:49:42.290451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15119","last_updated":"2025-04-03T02:34:24Z","snapshot_observed_at":"2026-07-06T20:10:19.704368Z","submitted_at":"2024-12-19T17:59:54Z","title":"Parallelized Autoregressive Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15119","snapshot_observed_at":"2026-08-06T20:49:42.343208Z","title":"Parallelized autoregressive visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.343208Z"},"links":{"cited_paper":"/paper/2412.15119","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:b357762b8c042b7d5cac87ddcd83e21c43fbd8871bfc90852205d6167da5880e","observation_id":"d1fd3900-2d4a-4d36-ae27-49912d0fd5cb","resolution":{"observed_at":"2026-08-06T20:49:42.343208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16211","last_updated":"2024-12-08T19:55:36Z","snapshot_observed_at":"2026-08-04T16:36:02.143481Z","submitted_at":"2024-09-24T16:12:12Z","title":"MaskBit: Embedding-free Image Generation via Bit Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16211","snapshot_observed_at":"2026-08-06T20:49:42.481613Z","title":"Maskbit: Embedding-free image generation via bit tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.481613Z"},"links":{"cited_paper":"/paper/2409.16211","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:fc89328f51db07241fbdd964ababcba81275baea88e886dd0427380540b7b3e5","observation_id":"85a12cc2-0cc3-45f8-9281-971b9f89b4c1","resolution":{"observed_at":"2026-08-06T20:49:42.481613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13848","last_updated":"2024-10-17T17:58:37Z","snapshot_observed_at":"2026-08-03T03:16:45.693966Z","submitted_at":"2024-10-17T17:58:37Z","title":"Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13848","snapshot_observed_at":"2026-08-06T20:49:42.607415Z","title":"Janus: Decoupling visual encoding for unified multimodal understanding and generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.607415Z"},"links":{"cited_paper":"/paper/2410.13848","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:d23b306da7aff5c69e17299fa37aac5c80c290d838f11053a65d8192fb0bdb36","observation_id":"02909b14-599a-4213-8fb1-3299d79fad49","resolution":{"observed_at":"2026-08-06T20:49:42.607415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04429","last_updated":"2025-03-04T16:31:57Z","snapshot_observed_at":"2026-08-01T23:38:04.510222Z","submitted_at":"2024-09-06T17:49:56Z","title":"VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04429","snapshot_observed_at":"2026-08-06T20:49:42.711070Z","title":"Vila-u: a unified foundation model inte- grating visual understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.711070Z"},"links":{"cited_paper":"/paper/2409.04429","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:afc3eae41346c776ae8a745cf24d19bc56d064c6990d3ea32d8e64c924dd4680","observation_id":"39649940-d2d2-4b84-a25a-18ceaa21d517","resolution":{"observed_at":"2026-08-06T20:49:42.711070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-06T20:49:42.844718Z","title":"Show-o: One single transformer to unify multimodal understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.844718Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:2e45e214505867ceb56006b8f386291eea48ffd2f3ef2df37a3d2bafc82f566d","observation_id":"869db5e1-b857-47b5-8e0a-695c22df2881","resolution":{"observed_at":"2026-08-06T20:49:42.844718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01423","last_updated":"2025-03-10T11:43:42Z","snapshot_observed_at":"2026-08-06T01:13:01.484290Z","submitted_at":"2025-01-02T18:59:40Z","title":"Reconstruction vs. Generation: Taming Optimization Dilemma in Latent Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01423","snapshot_observed_at":"2026-08-06T20:49:42.947470Z","title":"Reconstruction vs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:42.947470Z"},"links":{"cited_paper":"/paper/2501.01423","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:1817461cb1384ad3dc85fbf6d2f6b6c6a4c5a99597249c834b14847a8673c6ca","observation_id":"2f8b32c0-e3f5-4db2-8a04-60aeb491a8b6","resolution":{"observed_at":"2026-08-06T20:49:42.947470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04627","last_updated":"2022-06-05T01:57:58Z","snapshot_observed_at":"2026-07-06T11:56:10.689708Z","submitted_at":"2021-10-09T18:36:00Z","title":"Vector-quantized Image Modeling with Improved VQGAN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04627","snapshot_observed_at":"2026-08-06T20:49:43.043700Z","title":"Vector-quantized image modeling with improved vqgan","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.043700Z"},"links":{"cited_paper":"/paper/2110.04627","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:8e5c74cd18f49f279ae7c3dd23d10cba7590289db2c62df8938dc17fc1fe91b9","observation_id":"4264b34a-0145-43a7-b8a9-af568f2feeb6","resolution":{"observed_at":"2026-08-06T20:49:43.043700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05737","last_updated":"2024-03-29T17:44:41Z","snapshot_observed_at":"2026-08-02T18:23:02.746177Z","submitted_at":"2023-10-09T14:10:29Z","title":"Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05737","snapshot_observed_at":"2026-08-06T20:49:43.124751Z","title":"Language model beats diffusion–tokenizer is key to visual generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.124751Z"},"links":{"cited_paper":"/paper/2310.05737","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:4f01c8172afb5a225c3534ae592737180254b8d6e8233447bfbbbe953a29091a","observation_id":"5243dc39-6e11-4294-8cb1-3398367a1f88","resolution":{"observed_at":"2026-08-06T20:49:43.124751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00776","last_updated":"2024-11-01T17:59:58Z","snapshot_observed_at":"2026-07-06T19:43:42.287026Z","submitted_at":"2024-11-01T17:59:58Z","title":"Randomized Autoregressive Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00776","snapshot_observed_at":"2026-08-06T20:49:43.182816Z","title":"Randomized autoregressive visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.182816Z"},"links":{"cited_paper":"/paper/2411.00776","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:ad226132f5290854b55da9fd76cac2f5fe687ef19fdac12f1f73d4dacf0239f9","observation_id":"bda0f952-1934-40e7-9ecf-3484d0b1c84e","resolution":{"observed_at":"2026-08-06T20:49:43.182816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:49:44.469828Z","title":"An image is worth 32 tokens for reconstruction and generation","venue":null,"work_id":"80b3065e-2edf-49e8-b7b9-30b3ea508638","year":2025},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.247653Z"},"links":{"citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:ac975402a79ed5f567deba06a78ebcc469ca4402841d80785e2a6c8030cb1dc8","observation_id":"15c9e044-620f-4134-bb06-cb48332ec1fc","resolution":{"observed_at":"2026-08-06T20:49:44.528120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06940","last_updated":"2025-06-18T04:35:42Z","snapshot_observed_at":"2026-07-06T19:30:26.233621Z","submitted_at":"2024-10-09T14:34:53Z","title":"Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06940","snapshot_observed_at":"2026-08-06T20:49:43.401412Z","title":"Representation alignment for generation: Training diffu- sion transformers is easier than you think","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.401412Z"},"links":{"cited_paper":"/paper/2410.06940","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:de47da87fefc4368f3388169535ef98e9024a927565e9b708196dd9f1c9e70ff","observation_id":"671bf3f0-4caa-426b-b482-c9e8b2d400ae","resolution":{"observed_at":"2026-08-06T20:49:43.401412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14170","last_updated":"2024-12-19T02:42:46Z","snapshot_observed_at":"2026-08-04T05:10:00.882381Z","submitted_at":"2024-12-18T18:59:53Z","title":"E-CAR: Efficient Continuous Autoregressive Image Generation via Multistage Modeling","version":2},"cited_work":{"arxiv_id":"2412.14170","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.14170","snapshot_observed_at":"2026-08-06T20:49:43.986751Z","title":"E-CAR: Efficient Continuous Autoregressive Image Generation via Multistage Modeling","venue":"cs.CV","work_id":"3b9ea66b-76b8-4780-bed9-617cdfc964ab","year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.543357Z"},"links":{"cited_paper":"/paper/2412.14170","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:0b0c8c6fa2847933214316ee4373c8b52e5f1702281d089518b7afb9e935a29c","observation_id":"8b75ad89-6988-4f41-a8aa-8ed91ed62049","resolution":{"observed_at":"2026-08-06T20:49:44.067966Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-03T18:21:25.175322Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-06T20:49:43.657417Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.657417Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:052fd2ab1fee69a7e3de53511c80a381d642b797d4abd62fd526aee1d5f936cb","observation_id":"13829bd9-c1ef-4d9a-b6d1-7032636d9a26","resolution":{"observed_at":"2026-08-06T20:49:43.657417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11039","last_updated":"2024-08-20T17:48:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-20T17:48:20Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11039","snapshot_observed_at":"2026-08-06T20:49:43.758080Z","title":"Transfusion: Pre- dict the next token and diffuse images with one multi-modal model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.758080Z"},"links":{"cited_paper":"/paper/2408.11039","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:63704e6709010ffae7802d7e1e45f905c0f7894669f8daa9c0db98015b48b43d","observation_id":"ebe5efca-5ca9-4ca0-89f6-547a70e773c0","resolution":{"observed_at":"2026-08-06T20:49:43.758080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11837","last_updated":"2024-06-17T17:59:57Z","snapshot_observed_at":"2026-07-06T18:32:23.999019Z","submitted_at":"2024-06-17T17:59:57Z","title":"Scaling the Codebook Size of VQGAN to 100,000 with a Utilization Rate of 99%","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11837","snapshot_observed_at":"2026-08-06T20:49:43.861863Z","title":"Scaling the codebook size of vqgan to 100,000 with a utilization rate of 99%","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.861863Z"},"links":{"cited_paper":"/paper/2406.11837","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:3893a117b9e13fa18a3f1239c89add9b7a03990a620fee550884f2a77337b346","observation_id":"9739bb18-d759-4093-91f0-3834a5dc1c86","resolution":{"observed_at":"2026-08-06T20:49:43.861863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2507.01756."}