{"as_of":"2026-08-10T15:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:99e9c163eb0778892fa07b315b914aa245982f34a3bd353e32e861279475ef50","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:41:23.831463Z","state":"measured"},{"denominator":76,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":76,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T04:23:08.137866Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T04:23:09.921374Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"cited_work":{"arxiv_id":"2507.04947","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.04947","snapshot_observed_at":"2026-08-06T04:23:09.921374Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","venue":"cs.CV","work_id":"80001308-6a23-4e21-bfd6-10e5f49608fa","year":2025},"citing_paper":{"arxiv_id":"2508.03789","last_updated":"2025-08-22T08:53:37Z","snapshot_observed_at":"2026-08-07T20:35:27.515637Z","submitted_at":"2025-08-05T17:17:13Z","title":"HPSv3: Towards Wide-Spectrum Human Preference Score","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T04:23:08.137866Z"},"links":{"cited_paper":"/paper/2507.04947","citing_paper":"/paper/2508.03789"},"observation_digest":"sha256:0db13591f399b50c27223d61cc7b07b154654fc227b154a56603805d83d6308c","observation_id":"70406000-a5b0-4912-b562-5cf97973bb31","resolution":{"observed_at":"2026-08-06T04:23:09.993343Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.04947/citation-record","integrity":"/paper/2507.04947/integrity","json":"/paper/2507.04947/citation-record.json","paper":"/paper/2507.04947"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.13967","last_updated":"2025-06-04T12:56:23Z","snapshot_observed_at":"2026-08-07T18:04:12.028140Z","submitted_at":"2025-02-19T18:59:44Z","title":"FlexTok: Resampling Images into 1D Token Sequences of Flexible Length","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13967","snapshot_observed_at":"2026-08-06T19:41:23.597184Z","title":"Flextok: Re- sampling images into 1d token sequences of flexible length","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.597184Z"},"links":{"cited_paper":"/paper/2502.13967","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:7422826c2ac95d064a6f2c2fa2e61f776a47ccbdfb942087a0b15eabb0a0e7e7","observation_id":"34dd3310-39fe-4f53-a573-f35974eb1cd1","resolution":{"observed_at":"2026-08-06T19:41:23.597184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08261","last_updated":"2025-03-13T15:09:10Z","snapshot_observed_at":"2026-08-10T04:59:06.124232Z","submitted_at":"2024-10-10T17:59:17Z","title":"Meissonic: Revitalizing Masked Generative Transformers for Efficient High-Resolution Text-to-Image Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08261","snapshot_observed_at":"2026-08-06T19:41:23.601433Z","title":"Meissonic: Revitalizing masked generative trans- formers for efficient high-resolution text-to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.601433Z"},"links":{"cited_paper":"/paper/2410.08261","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:16c1520c806203cb0f0e60f0f1ba1167822356a7a1dec72251cd8d1111411073","observation_id":"12388c83-15cb-42a7-aad7-f388b1f89336","resolution":{"observed_at":"2026-08-06T19:41:23.601433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.599233Z","title":"All are worth words: A vit backbone for diffusion models","venue":null,"work_id":"a169459a-12a0-4b73-8873-9c06cff97f5f","year":2023},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.605018Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:1063ade7eec920e825a1d831eb29548afbaa17be173ef2aa29bc2a9585a331ab","observation_id":"b34dd59c-ddf7-498e-8ecd-29082de15795","resolution":{"observed_at":"2026-08-06T19:41:24.602385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.590219Z","title":"Flux, 2024","venue":null,"work_id":"67cf8832-0d1c-4e46-9603-7311208e6c90","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.608086Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:673335d9d2621f243041d3c196bdd358fac347e434bf89c8910f70b7c32f1517","observation_id":"1b725b72-339a-46c0-8f26-3a378878204c","resolution":{"observed_at":"2026-08-06T19:41:24.593338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.580098Z","title":"Efficientvit: Lightweight multi-scale attention for high- resolution dense prediction","venue":null,"work_id":"2134c057-b32d-456e-812e-693c255ba1ec","year":2023},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.611773Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:2473e235eace69bf500bed18b73d8f9c1a639f256f6a6802f2639dd6a3e94983","observation_id":"4cec7b2a-686c-4369-a2fd-a9e758073b30","resolution":{"observed_at":"2026-08-06T19:41:24.583437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.568660Z","title":"Condition-aware neural network for controlled image generation","venue":null,"work_id":"d83c26dd-a3e5-4eac-9e02-ee5eb8e74363","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.614980Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:67d6c79795690dc74c677bce43e6d78189653098107bbf8c81ce2eee24cb624d","observation_id":"745ad257-39eb-4eba-aade-9af00a02f3e0","resolution":{"observed_at":"2026-08-06T19:41:24.572142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.557367Z","title":"Maskgit: Masked generative image transformer","venue":null,"work_id":"c37e0d24-a64c-46a9-a89d-b12c3f31181d","year":2022},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.617922Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:870a30301e171b555d1b01333789f4f46d211b2ce36ea90d7844d71344ba1a0a","observation_id":"047dad19-1554-4487-9528-3b8954e7e9d6","resolution":{"observed_at":"2026-08-06T19:41:24.560754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00704","last_updated":"2023-01-02T14:43:38Z","snapshot_observed_at":"2026-08-03T00:33:47.397969Z","submitted_at":"2023-01-02T14:43:38Z","title":"Muse: Text-To-Image Generation via Masked Generative Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00704","snapshot_observed_at":"2026-08-06T19:41:23.621281Z","title":"Muse: Text-to-image generation via masked generative transform- ers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.621281Z"},"links":{"cited_paper":"/paper/2301.00704","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:08997e01193728f2880034ee7a16299c1ef1917e05c7ebf16bc816872dec39e0","observation_id":"0757d32b-5882-4aac-a7ab-e83195aef7f6","resolution":{"observed_at":"2026-08-06T19:41:23.621281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10958","last_updated":"2025-03-14T22:22:40Z","snapshot_observed_at":"2026-07-06T20:07:10.352535Z","submitted_at":"2024-12-14T20:29:29Z","title":"SoftVQ-VAE: Efficient 1-Dimensional Continuous Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10958","snapshot_observed_at":"2026-08-06T19:41:23.624757Z","title":"Softvq-vae: Efficient 1-dimensional con- tinuous tokenizer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.624757Z"},"links":{"cited_paper":"/paper/2412.10958","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:9f85dbc6f31a075bb604eced8ea25ab44dfc28275f1a65997df8c1515014b9da","observation_id":"62f40565-28e3-4d95-bbfe-fa5f79d53533","resolution":{"observed_at":"2026-08-06T19:41:23.624757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03444","last_updated":"2025-05-30T05:49:31Z","snapshot_observed_at":"2026-08-09T04:41:07.556668Z","submitted_at":"2025-02-05T18:42:04Z","title":"Masked Autoencoders Are Effective Tokenizers for Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03444","snapshot_observed_at":"2026-08-06T19:41:23.628002Z","title":"Masked autoencoders are effective tokenizers for diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.628002Z"},"links":{"cited_paper":"/paper/2502.03444","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:6c1ac56611385d45e1c97267076fe35e2a6235b28683e81248c25c9c9be8eca4","observation_id":"137e2f05-51d3-4712-84a0-7b96c1511d17","resolution":{"observed_at":"2026-08-06T19:41:23.628002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10733","last_updated":"2025-05-18T21:17:22Z","snapshot_observed_at":"2026-08-08T21:24:29.917572Z","submitted_at":"2024-10-14T17:15:07Z","title":"Deep Compression Autoencoder for Efficient High-Resolution Diffusion Models","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10733","snapshot_observed_at":"2026-08-06T19:41:23.631407Z","title":"Deep compression autoencoder for efficient high-resolution diffu- sion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.631407Z"},"links":{"cited_paper":"/paper/2410.10733","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:4c922ed3b3b9927dce84e2d60e6278272db8663a5d9de4eaf20e8c70d66237ac","observation_id":"a32b09d4-4e31-4bb0-b5a3-beb141350c54","resolution":{"observed_at":"2026-08-06T19:41:23.631407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.546101Z","title":"Pixart- σ: Weak-to-strong training of diffusion transformer for 4k text-to-image generation","venue":null,"work_id":"1bca83d0-345d-4cb9-9893-c67105b29168","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.634884Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:4d6f4c81f652941ad422155e8d441e553c1b115b1fa1835484fdc3c4c63d9aef","observation_id":"4ba7edef-3ab1-4b73-a8ab-98746842fe2c","resolution":{"observed_at":"2026-08-06T19:41:24.550348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05252","last_updated":"2024-01-10T16:27:38Z","snapshot_observed_at":"2026-08-07T04:04:46.527670Z","submitted_at":"2024-01-10T16:27:38Z","title":"PIXART-{\\delta}: Fast and Controllable Image Generation with Latent Consistency Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05252","snapshot_observed_at":"2026-08-06T19:41:23.637843Z","title":"Pixart- {\\delta}: Fast and controllable image generation with latent consis- tency models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.637843Z"},"links":{"cited_paper":"/paper/2401.05252","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:20ce5e78326f8c59912c9c82770d7ddba361c1367093b87e537476a029fe15dc","observation_id":"1ccf0a15-739d-47c5-9915-32ae42beb7c9","resolution":{"observed_at":"2026-08-06T19:41:23.637843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.535529Z","title":"Pixart- α: Fast training of diffusion transformer for photorealistic text-to-image synthesis","venue":null,"work_id":"f2029f22-fb6c-4ab4-a58f-57fa39706389","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.641117Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:7a4f83512fed57edac21cd8bccdcc19ae7c80b51776d3b75ae68e3ad31afb87b","observation_id":"7f6b40b9-ce03-41c3-9da7-c0df6c9da372","resolution":{"observed_at":"2026-08-06T19:41:24.539299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19937","last_updated":"2024-09-30T04:28:55Z","snapshot_observed_at":"2026-08-10T01:20:54.092163Z","submitted_at":"2024-09-30T04:28:55Z","title":"MaskMamba: A Hybrid Mamba-Transformer Model for Masked Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19937","snapshot_observed_at":"2026-08-06T19:41:23.643833Z","title":"Maskmamba: A hybrid mamba-transformer model for masked image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.643833Z"},"links":{"cited_paper":"/paper/2409.19937","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:4cb71c4d40cecfe1d176c8cfae1f2dab3208f32d26e2ce99709bf34dd19a7c48","observation_id":"e8a436c8-2254-4d9e-92f2-2f1249cd3316","resolution":{"observed_at":"2026-08-06T19:41:23.643833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17811","last_updated":"2025-01-29T18:00:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-29T18:00:19Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17811","snapshot_observed_at":"2026-08-06T19:41:23.646952Z","title":"Janus- pro: Unified multimodal understanding and generation with data and model scaling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.646952Z"},"links":{"cited_paper":"/paper/2501.17811","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:97804bcc99b8846928b76a9c041b15c6abffff2edcf94c7c12a891d9345bc137","observation_id":"db8be56c-dd30-42d4-8ed1-30208cf160cb","resolution":{"observed_at":"2026-08-06T19:41:23.646952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17787","last_updated":"2024-11-26T15:13:15Z","snapshot_observed_at":"2026-07-06T19:57:33.013839Z","submitted_at":"2024-11-26T15:13:15Z","title":"Collaborative Decoding Makes Visual Auto-Regressive Modeling Efficient","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17787","snapshot_observed_at":"2026-08-06T19:41:23.650563Z","title":"Collaborative decoding makes visual auto-regressive modeling efficient","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.650563Z"},"links":{"cited_paper":"/paper/2411.17787","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:1696dc33efa5d49245ae9ef8eb479d8d0d42c793a58f26fe1e67cb66e990d000","observation_id":"f3f8b3ac-f320-46cd-8758-8e241995f1bb","resolution":{"observed_at":"2026-08-06T19:41:23.650563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.524247Z","title":"Vqgan-clip: Open domain image generation and editing with natural language guidance","venue":null,"work_id":"4a32be0a-d409-4c3f-9cff-c469f52638ec","year":2022},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.653858Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:e34cf19eee470a1f18bfe8f3daf5c4e21e75d71e1e96381ef0b6f27ee7253b42","observation_id":"1905c30c-1215-4bfb-b4ec-04f85879daa4","resolution":{"observed_at":"2026-08-06T19:41:24.528012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.513507Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"840ab2da-0e89-47ba-8f4e-3cb44e992736","year":2009},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.656533Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:4c50b83752d541d11a24bdf4bb4a133843899a6f4b56a3da44d070d985295ad4","observation_id":"2e503436-5d51-4628-b25e-9fff171b8223","resolution":{"observed_at":"2026-08-06T19:41:24.517000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:23.659371Z","title":"Bert: Pre-training of deep bidirectional trans- formers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.659371Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:94c4f68f0c51da2e1952dc9fc9c600923dd2ab4fd9fb391b829aa53d0cfc4351","observation_id":"3dc5b9e6-e0b5-4149-b72d-e91cbb5a07dd","resolution":{"observed_at":"2026-08-06T19:41:23.659371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.495818Z","title":"Cogview: Mastering text-to-image generation via transformers","venue":null,"work_id":"c8492f28-a9a1-49b6-8225-61664befc13e","year":2021},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.662520Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:aa3efed8f9d8e4a7ad9d84ee1e90e6c3536f4d04be17470e472728041ad7109d","observation_id":"b26dfbd7-02f7-408d-a6c8-daa19cfa3668","resolution":{"observed_at":"2026-08-06T19:41:24.499523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.484033Z","title":"Cogview2: Faster and better text-to-image generation via hierarchical transformers","venue":null,"work_id":"177f8a1b-e202-443f-af0a-0a54131a1708","year":2022},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.665292Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:7bfecd981508429c7efd6b06961771f5ac1a9d1d6fc5e9e0522215bf2175d733","observation_id":"ed0c676b-6098-46ad-aa37-1aa6ec6573e9","resolution":{"observed_at":"2026-08-06T19:41:24.487740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:23.668024Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.668024Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:7469e620e9ccd5e94ffc7221027a3b5a0ea5df9bef5b4d25c4b07ff4b222d2a3","observation_id":"bf37ec64-e006-42f6-a2c2-d3cb9b640474","resolution":{"observed_at":"2026-08-06T19:41:23.668024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:23.670970Z","title":"Scaling recti- fied flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.670970Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:db60380df4e626d4ebaeadecd14b074a69c9b58795914f027c73e352c32e97cd","observation_id":"bd3707a4-1393-4e79-a4a8-870fe9598436","resolution":{"observed_at":"2026-08-06T19:41:23.670970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13863","last_updated":"2024-10-17T17:59:59Z","snapshot_observed_at":"2026-08-07T22:15:46.490983Z","submitted_at":"2024-10-17T17:59:59Z","title":"Fluid: Scaling Autoregressive Text-to-image Generative Models with Continuous Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13863","snapshot_observed_at":"2026-08-06T19:41:23.673806Z","title":"Fluid: Scaling autoregressive text-to-image generative models with continuous tokens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.673806Z"},"links":{"cited_paper":"/paper/2410.13863","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:32df64ae976f58c3f2701f1255d665d2fe551bd9c67421f1802b47b8eb770329","observation_id":"ff003569-80a0-4a66-a324-9c1a05f1c1a9","resolution":{"observed_at":"2026-08-06T19:41:23.673806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.449483Z","title":"Make-a-scene: Scene- based text-to-image generation with human priors","venue":null,"work_id":"be516d64-195b-4cce-b1c4-d9955b83f8df","year":2022},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.677307Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:3c305ab29d487bfca34693bbb8447df6db235325799dc418114cc44702e0d236","observation_id":"5cbe8f3e-1ded-4354-af83-b2672b2a4d1d","resolution":{"observed_at":"2026-08-06T19:41:24.453151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.439056Z","title":"Geneval: An object-focused framework for evaluating text- to-image alignment","venue":null,"work_id":"0583afaf-d9fc-429c-bd41-4adee3f54a04","year":2023},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.680293Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:ae28b3913c4cfe396df1421c701f48491a1a03b618cc96ef17fb09ed27bffe93","observation_id":"02221b71-5d38-4501-90ea-30a1900a85e3","resolution":{"observed_at":"2026-08-06T19:41:24.442337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04431","last_updated":"2025-06-17T15:32:20Z","snapshot_observed_at":"2026-08-10T00:43:25.712379Z","submitted_at":"2024-12-05T18:53:02Z","title":"Infinity: Scaling Bitwise AutoRegressive Modeling for High-Resolution Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04431","snapshot_observed_at":"2026-08-06T19:41:23.683029Z","title":"Infinity: Scaling bit- wise autoregressive modeling for high-resolution image syn- thesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.683029Z"},"links":{"cited_paper":"/paper/2412.04431","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:915adf2747e836ec4ca3d98f2d1aa29226ab376dcef2a85e440658a6ae2a7617","observation_id":"4ad5d9f1-7fac-4d07-8739-4632c1a45992","resolution":{"observed_at":"2026-08-06T19:41:23.683029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:23.685861Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.685861Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:22f228ee4c46a5907ee81916ca2c38ef076380ef2f0260cf020123390096f6e0","observation_id":"188553c7-4b49-4eb3-a5f5-8047a6497060","resolution":{"observed_at":"2026-08-06T19:41:23.685861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03355","last_updated":"2025-03-02T07:45:09Z","snapshot_observed_at":"2026-07-06T19:27:37.936219Z","submitted_at":"2024-10-04T12:21:03Z","title":"LANTERN: Accelerating Visual Autoregressive Models with Relaxed Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03355","snapshot_observed_at":"2026-08-06T19:41:23.688829Z","title":"Lantern: Accelerating visual autoregressive mod- els with relaxed speculative decoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.688829Z"},"links":{"cited_paper":"/paper/2410.03355","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:53319ca8c6244d07725942a98aa66e4f7bbbaaafa82c2ef8ce0ae2f26e278e57","observation_id":"7737570e-471b-4ad9-8965-39b0e94ec915","resolution":{"observed_at":"2026-08-06T19:41:23.688829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07730","last_updated":"2025-08-02T07:11:16Z","snapshot_observed_at":"2026-07-06T20:20:37.632750Z","submitted_at":"2025-01-13T22:37:17Z","title":"Democratizing Text-to-Image Masked Generative Models with Compact Text-Aware One-Dimensional Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07730","snapshot_observed_at":"2026-08-06T19:41:23.691857Z","title":"Democra- tizing text-to-image masked generative models with com- pact text-aware one-dimensional tokens","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.691857Z"},"links":{"cited_paper":"/paper/2501.07730","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:8d3a42d0218c7579f3a0e8c7d00eefda582d9d3c345fa64b4d185711be3c3ce0","observation_id":"60d468d8-6607-4641-8640-b7445fdc2ca0","resolution":{"observed_at":"2026-08-06T19:41:23.691857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.421517Z","title":"Videopoet: A large language model for zero-shot video gen- eration","venue":null,"work_id":"52fd5291-d84d-4c05-a1e7-1b984a798eff","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.694896Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:51922e36d862410b5dde5e5b342c0b455edd8c5c851732e6c950af7350c6cc2f","observation_id":"14c41753-a012-4487-a846-551f7d8cc919","resolution":{"observed_at":"2026-08-06T19:41:24.425715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17245","last_updated":"2024-02-27T06:31:52Z","snapshot_observed_at":"2026-07-06T17:36:01.939242Z","submitted_at":"2024-02-27T06:31:52Z","title":"Playground v2.5: Three Insights towards Enhancing Aesthetic Quality in Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17245","snapshot_observed_at":"2026-08-06T19:41:23.697555Z","title":"Playground v2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.697555Z"},"links":{"cited_paper":"/paper/2402.17245","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:5644460602c6f7115c02914556c6b414b98633dd21e71d6118058c43451bd784","observation_id":"ad64d74f-3a96-4457-af1b-4ad3542c923a","resolution":{"observed_at":"2026-08-06T19:41:23.697555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:23.700734Z","title":"Mage: Masked generative encoder to unify representation learning and image synthe- sis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.700734Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:de8eabb7df8fc0746fb6ea4478e570d005b1e8ee3a431e211e51220d13f3080b","observation_id":"d018cac0-b23c-4277-9dc4-1541957b1376","resolution":{"observed_at":"2026-08-06T19:41:23.700734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.403175Z","title":"Autoregressive image generation without vec- tor quantization","venue":null,"work_id":"ea5ce072-4308-4bc3-b516-750b502be73c","year":2025},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.704341Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:8656cef6c4f310cb9ef45dc0d707a2e209a856c5e4cda8ff99cf354269699fc0","observation_id":"6b558d4a-4b2c-4a46-acf1-1aa8dd686bf9","resolution":{"observed_at":"2026-08-06T19:41:24.406704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09750","last_updated":"2024-10-02T02:10:26Z","snapshot_observed_at":"2026-07-06T18:30:46.405694Z","submitted_at":"2024-06-14T06:35:33Z","title":"ControlVAR: Exploring Controllable Visual Autoregressive Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09750","snapshot_observed_at":"2026-08-06T19:41:23.707412Z","title":"Controlvar: Exploring con- trollable visual autoregressive modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.707412Z"},"links":{"cited_paper":"/paper/2406.09750","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:da939063b21b0db77dd175b4f0e6edd20116c72fd6eb968b40ac3c9d53597d56","observation_id":"da46fd01-6f63-4522-9731-2f592007beca","resolution":{"observed_at":"2026-08-06T19:41:23.707412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.392159Z","title":"Vila: On pre-training for vi- sual language models","venue":null,"work_id":"1c67d9f3-0dcc-4d1c-a67d-ac2f3467f547","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.710603Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:e47944523e38daa5cad2c68b7a210d3358d539a05dba5d7f62481fb8fadd1eea","observation_id":"61176306-b6d5-4f11-adea-42bbed8557de","resolution":{"observed_at":"2026-08-06T19:41:24.395848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10695","last_updated":"2024-10-21T20:01:13Z","snapshot_observed_at":"2026-07-06T19:16:23.103921Z","submitted_at":"2024-09-16T19:52:24Z","title":"Playground v3: Improving Text-to-Image Alignment with Deep-Fusion Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10695","snapshot_observed_at":"2026-08-06T19:41:23.713635Z","title":"Playground v3: Im- proving text-to-image alignment with deep-fusion large lan- guage models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.713635Z"},"links":{"cited_paper":"/paper/2409.10695","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:d5ce741c360b743e49809f5dd9c0443d3c7a15412ec97dd05951eae2aa04d1b9","observation_id":"7a3d0dcb-6129-494c-8159-78cd2e95eefa","resolution":{"observed_at":"2026-08-06T19:41:23.713635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02657","last_updated":"2025-04-24T16:16:27Z","snapshot_observed_at":"2026-08-05T15:40:56.937227Z","submitted_at":"2024-08-05T17:46:53Z","title":"Lumina-mGPT: Illuminate Flexible Photorealistic Text-to-Image Generation with Multimodal Generative Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02657","snapshot_observed_at":"2026-08-06T19:41:23.716761Z","title":"Lumina-mgpt: Illuminate flexible photorealistic text-to-image generation with multimodal generative pretraining","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.716761Z"},"links":{"cited_paper":"/paper/2408.02657","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:0e687c40704f497ff6da12c638c2c9d7ebe4094b701f2c2dd84c66c990dd9ce1","observation_id":"d2bd89df-c72d-4e5d-8a5c-2f7b2e9f196a","resolution":{"observed_at":"2026-08-06T19:41:23.716761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08268","last_updated":"2025-02-03T21:47:31Z","snapshot_observed_at":"2026-08-05T16:01:06.026395Z","submitted_at":"2024-02-13T07:47:36Z","title":"World Model on Million-Length Video And Language With Blockwise RingAttention","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08268","snapshot_observed_at":"2026-08-06T19:41:23.720034Z","title":"World model on million-length video and language with blockwise ringattention","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.720034Z"},"links":{"cited_paper":"/paper/2402.08268","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:4277c47e75bd14aaec785dd8a29a09e0270e261f6ee635775f9d9a3b532a99a0","observation_id":"10e17c38-ac4e-4510-a198-8794726844f2","resolution":{"observed_at":"2026-08-06T19:41:23.720034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.381502Z","title":"Exploring the role of large language models in prompt encoding for diffusion models","venue":null,"work_id":"810354fa-45e9-41b0-9ed2-9c2d27d582a9","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.723272Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:c19d3d623695a564dd05380b2940d21074bb79fe4035f728984bf18cf9c422cb","observation_id":"05608fb7-ecfb-41a0-b473-66459712bb50","resolution":{"observed_at":"2026-08-06T19:41:24.385166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10797","last_updated":"2025-02-19T06:00:55Z","snapshot_observed_at":"2026-07-06T18:31:36.504766Z","submitted_at":"2024-06-16T03:45:45Z","title":"STAR: Scale-wise Text-conditioned AutoRegressive image generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10797","snapshot_observed_at":"2026-08-06T19:41:23.726623Z","title":"Star: Scale-wise text-to- image generation via auto-regressive representations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.726623Z"},"links":{"cited_paper":"/paper/2406.10797","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:a79438513dfa6cb559d24049806a6fad9523eb631feba1aaa50294814af471b9","observation_id":"217bf85a-1191-4a80-8f3b-3e43d2497ea0","resolution":{"observed_at":"2026-08-06T19:41:23.726623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.369139Z","title":"Hello gpt-4o, 2024","venue":null,"work_id":"10c3c0d3-05af-4571-990e-c5c8116451ed","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.729953Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:336d1ecca4bf7a912ac71c58f4db29de8d361b1d1bf978b60093b2b85c18f3b8","observation_id":"3a459c38-41de-4b25-bb4f-1463c15ff854","resolution":{"observed_at":"2026-08-06T19:41:24.373082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:23.732818Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.732818Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:9c91ad95493ef144573a66c5120f742cd29bb98195259512ba65debbb1a2655a","observation_id":"e70fe837-c7d5-4f4b-b432-cad4b1270b93","resolution":{"observed_at":"2026-08-06T19:41:23.732818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.352206Z","title":"W ¨urstchen: An ef- ficient architecture for large-scale text-to-image diffusion models","venue":null,"work_id":"0f209184-105f-4f6a-90f0-7de23e8c3205","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.736414Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:ff79940ebbb030aa96a0fa08cdc3389729bb7c7ebd84a438a75cbde07b59407e","observation_id":"d32be879-4738-4d53-8d2a-1f2e9962b981","resolution":{"observed_at":"2026-08-06T19:41:24.356049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.341745Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":"3f5b3515-1c7b-4e41-aa66-5d6310e8836d","year":2023},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.740004Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:1b44b25f58ba05036ce9d969754e1f165662d2cf89fac052e0bf2cdf383fbea7","observation_id":"387bf42c-f125-42aa-942a-126750c839f8","resolution":{"observed_at":"2026-08-06T19:41:24.345544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03069","last_updated":"2025-08-07T09:08:33Z","snapshot_observed_at":"2026-07-06T20:01:23.373458Z","submitted_at":"2024-12-04T06:46:55Z","title":"TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03069","snapshot_observed_at":"2026-08-06T19:41:23.743296Z","title":"Tokenflow: Unified image tokenizer for multimodal understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.743296Z"},"links":{"cited_paper":"/paper/2412.03069","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:1d2c49e3370cab52b7d7e37237ddbbcfa13acfaef680fdb3839308d87db98d1c","observation_id":"e77a85cc-3c45-4774-b6cd-e6648a3feeb8","resolution":{"observed_at":"2026-08-06T19:41:23.743296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.331391Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":"3c8fe0ec-b3dd-4ee9-816a-b44db2a464dc","year":2020},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.746402Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:c93c8addb6e26d2797a56e3bdbbd60d15b416e3cb56b45b408ba95f545a18fa0","observation_id":"96036b35-5845-4c61-89e6-8ba9814ae24e","resolution":{"observed_at":"2026-08-06T19:41:24.334820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:23.749368Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.749368Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:e97858fc8b923546b2c2c227c2f24bcd2663283abe88f7b257fcf1b72ae6f893","observation_id":"514fabfe-dc50-4fb9-8220-db01381d887b","resolution":{"observed_at":"2026-08-06T19:41:23.749368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:23.752473Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.752473Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:67ebae19a2f9aba43c21dd543d39c36a655e9a0c5c91f291f8965fb4e5380d1b","observation_id":"b59c94d5-6f14-4b37-a016-3c49affc816d","resolution":{"observed_at":"2026-08-06T19:41:23.752473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.307000Z","title":"Journeydb: A benchmark for generative im- age understanding","venue":null,"work_id":"9014983b-3ea8-4cb6-88b1-ee00c72ae467","year":2023},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.755319Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:994658245d801aaa9af144919e68d23872f3a1f5a760d9d80505e3880299e553","observation_id":"98a0a5e4-7bc7-4417-86af-e1c317274499","resolution":{"observed_at":"2026-08-06T19:41:24.310911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-06T19:41:23.758914Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.758914Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:402c3daea75f25849edfb0c4285e647e849ca13e7085bf3f39d4d3d84060b43f","observation_id":"b3db0879-fb1b-466e-8256-142c6ec613f1","resolution":{"observed_at":"2026-08-06T19:41:23.758914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10812","last_updated":"2024-10-14T17:59:42Z","snapshot_observed_at":"2026-08-09T17:44:55.180658Z","submitted_at":"2024-10-14T17:59:42Z","title":"HART: Efficient Visual Generation with Hybrid Autoregressive Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10812","snapshot_observed_at":"2026-08-06T19:41:23.762860Z","title":"Hart: Efficient visual generation with hybrid au- toregressive transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.762860Z"},"links":{"cited_paper":"/paper/2410.10812","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:cca918c91419822feda9c0117c026b75a380c42c49d35e3bd24dbc085c2b0de4","observation_id":"32ffb138-09c0-44ba-ae2e-ee0063776e3d","resolution":{"observed_at":"2026-08-06T19:41:23.762860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.296588Z","title":"Introducing auraflow v0","venue":null,"work_id":"0c953d0e-3147-403f-9304-fae90e8bde9d","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.766316Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:5216152f0742e3feee5d4d741aba1bde81b42086bf12e48f04478084e223c1c1","observation_id":"ef40a9a9-7bfc-4dea-91d1-b34525e77634","resolution":{"observed_at":"2026-08-06T19:41:24.299918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T19:41:23.769261Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.769261Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:018c7fbf12a8509879140354d7a435745d828157d3a4a3977b9fb71edc10ca40","observation_id":"ea4877f2-701f-4f21-a926-cce601e32e35","resolution":{"observed_at":"2026-08-06T19:41:23.769261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.285824Z","title":"Kolors: Effective training of diffusion model for photorealistic text-to-image synthesis","venue":null,"work_id":"5d822cb9-3067-4df3-a25a-68e496406f15","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.772210Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:1eed5e76df5e6100f34c66f9fe1413d6e5da155d3eb36447388201cb0322b1b5","observation_id":"05c6b64d-7efb-40a4-b309-aa4736357ae1","resolution":{"observed_at":"2026-08-06T19:41:24.289469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.273323Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction","venue":null,"work_id":"3d7aa734-5d7d-466b-963c-685818e61bad","year":2025},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.775229Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:01edffb06ad0e4e92b19a91b156c0e781dac5c1d84a9148ab7893c005d304404","observation_id":"47186ff9-ba17-4818-a852-85093f69afeb","resolution":{"observed_at":"2026-08-06T19:41:24.277788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:23.778537Z","title":"Neural discrete representation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.778537Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:6fc76ed1d68e6c6cb777e28e96fa7629005fa021ee89103c0af328aef509e686","observation_id":"24ca1245-6f49-4bc6-8998-30b18845bdf7","resolution":{"observed_at":"2026-08-06T19:41:23.778537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02399","last_updated":"2022-10-05T17:18:28Z","snapshot_observed_at":"2026-08-04T09:09:48.463217Z","submitted_at":"2022-10-05T17:18:28Z","title":"Phenaki: Variable Length Video Generation From Open Domain Textual Description","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02399","snapshot_observed_at":"2026-08-06T19:41:23.781644Z","title":"Phenaki: Variable length video generation from open domain textual description","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.781644Z"},"links":{"cited_paper":"/paper/2210.02399","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:60d0e2be6018d1205eba215245bb23d6a42aa74f89b2431ef717512cd0e664fa","observation_id":"e18e3c3e-01c1-45dd-a062-775cf528945c","resolution":{"observed_at":"2026-08-06T19:41:23.781644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-06T19:41:23.784989Z","title":"Emu3: Next-token prediction is all you need","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.784989Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:c5909de9045582479ea83401f92834cecc0458fb937e1292ba7906a9da702cc1","observation_id":"9b48ac4f-56d7-4001-9c42-9910aba55a29","resolution":{"observed_at":"2026-08-06T19:41:23.784989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15119","last_updated":"2025-04-03T02:34:24Z","snapshot_observed_at":"2026-07-06T20:10:19.704368Z","submitted_at":"2024-12-19T17:59:54Z","title":"Parallelized Autoregressive Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15119","snapshot_observed_at":"2026-08-06T19:41:23.788082Z","title":"Parallelized autoregressive visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.788082Z"},"links":{"cited_paper":"/paper/2412.15119","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:7c8a7140909c6813a360301db944280e438b873cd8c525378d43dc646342b1da","observation_id":"aeb2ad6d-4043-4c25-9816-35067e89fed0","resolution":{"observed_at":"2026-08-06T19:41:23.788082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.255365Z","title":"Maskbit: Embedding-free image generation via bit tokens","venue":null,"work_id":"8a153977-a129-4bef-be36-8bb85d3e7c6a","year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.791122Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:edfa43566be09b52aeaf009110bbf3244ae6e552ff1004d6a3041cc952fd41a6","observation_id":"10e389e7-0f61-43f6-b4b9-303926d15be5","resolution":{"observed_at":"2026-08-06T19:41:24.258779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13848","last_updated":"2024-10-17T17:58:37Z","snapshot_observed_at":"2026-08-03T03:16:45.693966Z","submitted_at":"2024-10-17T17:58:37Z","title":"Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13848","snapshot_observed_at":"2026-08-06T19:41:23.793876Z","title":"Janus: Decoupling visual encoding for unified multimodal understanding and generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.793876Z"},"links":{"cited_paper":"/paper/2410.13848","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:1eaa7d071d647e37131997788352091d6fad3b751f8f6c687d502ea15bc01b90","observation_id":"b6830a1d-9454-4d9e-9dc4-fdfa04d5e7f3","resolution":{"observed_at":"2026-08-06T19:41:23.793876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04429","last_updated":"2025-03-04T16:31:57Z","snapshot_observed_at":"2026-08-01T23:38:04.510222Z","submitted_at":"2024-09-06T17:49:56Z","title":"VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04429","snapshot_observed_at":"2026-08-06T19:41:23.796917Z","title":"Vila-u: a unified foundation model inte- grating visual understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.796917Z"},"links":{"cited_paper":"/paper/2409.04429","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:b50abde7006cfe1f8715714899da48b017bdb709487bc418b9cec501f96ac0b3","observation_id":"6d49930b-816d-492d-a59a-bb82a5337018","resolution":{"observed_at":"2026-08-06T19:41:23.796917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10629","last_updated":"2024-10-20T14:35:31Z","snapshot_observed_at":"2026-07-06T19:33:08.264958Z","submitted_at":"2024-10-14T15:36:42Z","title":"SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10629","snapshot_observed_at":"2026-08-06T19:41:23.799913Z","title":"Sana: Efficient high-resolution image syn- thesis with linear diffusion transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.799913Z"},"links":{"cited_paper":"/paper/2410.10629","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:86b21774903f9c7fe7830982ad6b8689c9e215813bfe000522d189e84adee7c4","observation_id":"3a94fa02-2984-48fc-8485-0a6fe88377f3","resolution":{"observed_at":"2026-08-06T19:41:23.799913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18427","last_updated":"2025-05-17T13:26:31Z","snapshot_observed_at":"2026-08-09T23:29:58.320860Z","submitted_at":"2025-01-30T15:31:48Z","title":"SANA 1.5: Efficient Scaling of Training-Time and Inference-Time Compute in Linear Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18427","snapshot_observed_at":"2026-08-06T19:41:23.803601Z","title":"Sana 1.5: Efficient scaling of training-time and inference-time compute in linear diffusion transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.803601Z"},"links":{"cited_paper":"/paper/2501.18427","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:64110bd2bf584a3a60c8e36e4ef0a9d935e7c0a5b43954d1478390f0d5112443","observation_id":"17170477-082e-4982-9a7a-c920950cf2bd","resolution":{"observed_at":"2026-08-06T19:41:23.803601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-06T19:41:23.806841Z","title":"Show-o: One single transformer to unify multimodal understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.806841Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:51bdb8e8f3a7b92c2bf98e29c2968089f469b62334895ab29d9fe1d82f1c0226","observation_id":"7d9a9c8d-afb2-4b25-9f0c-0017bc5bd809","resolution":{"observed_at":"2026-08-06T19:41:23.806841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04671","last_updated":"2024-10-07T00:55:42Z","snapshot_observed_at":"2026-08-10T14:53:36.098046Z","submitted_at":"2024-10-07T00:55:42Z","title":"CAR: Controllable Autoregressive Modeling for Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04671","snapshot_observed_at":"2026-08-06T19:41:23.810106Z","title":"Car: Controllable autoregressive modeling for visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.810106Z"},"links":{"cited_paper":"/paper/2410.04671","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:188d3453ac75e3cb0bb9d8cd589482b043b054ea8ae372ceee622e1bbe2c405a","observation_id":"7220a54c-9e3d-467b-bfcd-98c904db1064","resolution":{"observed_at":"2026-08-06T19:41:23.810106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.244126Z","title":"Scaling autoregres- sive models for content-rich text-to-image generation.Trans","venue":null,"work_id":"e0af3a5f-75a6-42de-985d-0d316b8a7b0e","year":2022},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.813094Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:52a1010fa2c8e7960d506c73f3078835b859bb6316c94f8058e80e6fa9259e08","observation_id":"9d469825-40e3-496d-81ae-64fe1f51a583","resolution":{"observed_at":"2026-08-06T19:41:24.247703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.233654Z","title":"Magvit: Masked generative video transformer","venue":null,"work_id":"0e4af14a-4662-487a-97f0-5057f367c8ab","year":2023},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.816090Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:6d48bc7979d6d48b52d01892b4c13e2a87270c4d71a25633c525d6184719a103","observation_id":"a4399186-bebf-4829-8b73-eacedc0fa28e","resolution":{"observed_at":"2026-08-06T19:41:24.237240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.222823Z","title":"An image is worth 32 tokens for reconstruction and generation","venue":null,"work_id":"c9cf48cd-987e-4635-ab4e-9dc74138fbbb","year":2025},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.818931Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:70a32a0e8b400598e71c8ea67a310b8f5ffdd9d1107bb162eb60dfa46e8ab062","observation_id":"852f6685-331f-4262-8912-dd1508fe325f","resolution":{"observed_at":"2026-08-06T19:41:24.226993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21772","last_updated":"2024-08-04T22:13:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-31T17:48:14Z","title":"ShieldGemma: Generative AI Content Moderation Based on Gemma","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21772","snapshot_observed_at":"2026-08-06T19:41:23.821729Z","title":"Shield- gemma: Generative ai content moderation based on gemma","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.821729Z"},"links":{"cited_paper":"/paper/2407.21772","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:ded0d977cfbe89235e6b9fad9d1fea5f5469b3c86121a64df5dbb201046c0e24","observation_id":"0cbbcf26-880c-45f5-b390-3b08383a86aa","resolution":{"observed_at":"2026-08-06T19:41:23.821729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05796","last_updated":"2025-04-05T18:15:41Z","snapshot_observed_at":"2026-07-06T20:03:20.752332Z","submitted_at":"2024-12-08T03:18:17Z","title":"Language-Guided Image Tokenization for Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05796","snapshot_observed_at":"2026-08-06T19:41:23.825012Z","title":"Language- guided image tokenization for generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.825012Z"},"links":{"cited_paper":"/paper/2412.05796","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:8800b977507de458c33655e00cede2bc128e7f1b25b0df5e9a61fcfc8972a97d","observation_id":"04a282f2-e224-4651-b17e-bd2a670c7af5","resolution":{"observed_at":"2026-08-06T19:41:23.825012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01181","last_updated":"2024-08-02T11:03:22Z","snapshot_observed_at":"2026-08-08T04:14:05.977486Z","submitted_at":"2024-08-02T11:03:22Z","title":"VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01181","snapshot_observed_at":"2026-08-06T19:41:23.828655Z","title":"Var-clip: Text-to-image gen- erator with visual auto-regressive modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.828655Z"},"links":{"cited_paper":"/paper/2408.01181","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:69ef58200d0881bc3723fe4103709c29bbb86f6d4f2e6fc40d9649f9f119e6bd","observation_id":"43ad1ff8-72f0-4a82-99e6-2f3e1f952c7e","resolution":{"observed_at":"2026-08-06T19:41:23.828655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:41:24.210632Z","title":"A red heart","venue":null,"work_id":"6cf43064-c5c6-49b7-8cf7-0ff2e015fdcf","year":2018},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.831463Z"},"links":{"citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:e48bebfe0e1c70e3a170c7e9af5d61f6f7cca1603bbbd8b95d5a2caad8aba7fc","observation_id":"6b79ced7-fa55-4df9-a90c-e187a0b47102","resolution":{"observed_at":"2026-08-06T19:41:24.215300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T07:36:03.612176Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":0,"verified_fuzzy":30},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 1 inbound Pith citation observation for arXiv:2507.04947."}