{"as_of":"2026-08-16T13:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e3a6bc0f76c0d16e91c0853b3887b2407fd42fc19126b64a565fe8debf7d135a","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:49:43.764805Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.20454/citation-record","integrity":"/paper/2507.20454/integrity","json":"/paper/2507.20454/citation-record.json","paper":"/paper/2507.20454"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.10945","last_updated":"2024-12-25T01:27:01Z","snapshot_observed_at":"2026-08-16T13:25:10.173572Z","submitted_at":"2024-08-20T15:34:27Z","title":"HiRED: Attention-Guided Token Dropping for Efficient Inference of High-Resolution Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10945","snapshot_observed_at":"2026-08-15T17:49:43.567557Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.567557Z"},"links":{"cited_paper":"/paper/2408.10945","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:e875cfe6a7509b40be02ed141db2c47348985b5892b940bcdce93d579529c776","observation_id":"2673a3a8-503a-4558-a7d8-6d51e7f17b77","resolution":{"observed_at":"2026-08-15T17:49:43.567557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.614874Z","title":"Improving image generation with better captions","venue":null,"work_id":"5b11906d-9c58-40f7-b98e-0e58c746bfab","year":2023},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.573722Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:1175a4d841b220f6a2199121be8da03f37d1eec312f467a11bc50f8c59bbc795","observation_id":"19813d58-be82-4795-bfbd-c2a369eb603d","resolution":{"observed_at":"2026-08-15T17:49:44.619893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.599354Z","title":"Token merging: Your vit but faster","venue":null,"work_id":"a8b0a896-4a37-4d8b-8f07-21e7b8cf2e6c","year":2023},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.579009Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:cc3db2a8ef67faa8720ed55f53d319afe622c100052e9996cb90b96a32ba2ab3","observation_id":"0a533aa9-4233-4f3d-b910-ae671e816faa","resolution":{"observed_at":"2026-08-15T17:49:44.604465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.583863Z","title":"T., Luo, P., Lu, H., and Li, Z","venue":null,"work_id":"b2433155-a2b8-491b-a714-9fac602c8913","year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.584456Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:6e6d674d8d9857cac487f237f359251d5af6e8c0db7b567c27430d41aab64e95","observation_id":"89bc5f6a-de99-40e9-ba42-d58725db678e","resolution":{"observed_at":"2026-08-15T17:49:44.588983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.567819Z","title":"An image is worth 1/2 tokens after layer 2: Plug-and-play inference acceleration for large vision-language models","venue":null,"work_id":"ad02fa14-40f4-47ef-a2e3-1de551503fdb","year":null},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.590436Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:046517fda62d3c15ef65400cea02af34acdb9910468fce83b54f717c7daf5b7e","observation_id":"8c1b5a97-4442-4f85-91bc-63c843152e49","resolution":{"observed_at":"2026-08-15T17:49:44.573182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.552295Z","title":"Optical flow distillation: Towards efficient and stable video style transfer","venue":null,"work_id":"520c9ff2-1c04-482e-8b3a-c17fe74e4b8d","year":2020},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.596343Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:1dff709be3ddef812a466027608f803f8880775a022c6daa6f2be96cbb98c844","observation_id":"873b5584-1493-43b0-bf7c-265f7e756d8a","resolution":{"observed_at":"2026-08-15T17:49:44.557325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.535579Z","title":"Cogview: Mastering text-to-image generation via trans- formers","venue":null,"work_id":"651f0b9d-0cf1-45ee-963d-a8d9e8ffb325","year":2021},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.601647Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:d484c4476b21d7a079adf9178ab63982bb9fb87334b48325e1a564d429856c63","observation_id":"bdf189ac-d1c7-4a95-b060-5fb0c009c972","resolution":{"observed_at":"2026-08-15T17:49:44.540530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.520442Z","title":"Taming trans- formers for high-resolution image synthesis","venue":null,"work_id":"07828971-1a40-4f01-a14c-b7ea122c7336","year":2021},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.607495Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:b65a784c9983b2e1f4548cb6020a7f2a44009a23f2ede87a518b5827c6827fd0","observation_id":"1959baa0-3a5b-4553-a27e-800627fc6ad8","resolution":{"observed_at":"2026-08-15T17:49:44.525314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.505323Z","title":"Geneval: An object-focused framework for evaluating text-to-image alignment","venue":null,"work_id":"84f5ead4-5479-42d3-9170-bc06d55d59e0","year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.612577Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:10738bdd26549e61b32060db6f0258eeb9e52ffa290a861dadf005f5dd53230f","observation_id":"a1fa6cfb-3c7b-4913-9ede-c6504ff96a88","resolution":{"observed_at":"2026-08-15T17:49:44.510385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04431","last_updated":"2025-06-17T15:32:20Z","snapshot_observed_at":"2026-08-15T00:31:45.808844Z","submitted_at":"2024-12-05T18:53:02Z","title":"Infinity: Scaling Bitwise AutoRegressive Modeling for High-Resolution Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04431","snapshot_observed_at":"2026-08-15T17:49:43.617614Z","title":"Infinity: Scaling bitwise autore- gressive modeling for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.617614Z"},"links":{"cited_paper":"/paper/2412.04431","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:d1ccf5b9512b0ac88c1a82e970e3a999bcd1235f38c943b7c3e37220c8f9ef08","observation_id":"75e6fdd2-f518-4e99-a147-92d905e4ee43","resolution":{"observed_at":"2026-08-15T17:49:43.617614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04062","last_updated":"2025-06-29T07:13:36Z","snapshot_observed_at":"2026-08-14T01:36:02.031381Z","submitted_at":"2024-12-05T10:57:08Z","title":"ZipAR: Parallel Auto-regressive Image Generation through Spatial Locality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04062","snapshot_observed_at":"2026-08-15T17:49:43.623259Z","title":"Zipar: Accelerating autoregressive im- age generation through spatial locality","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.623259Z"},"links":{"cited_paper":"/paper/2412.04062","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:be4a7019c0dbd14ceda44ee75331915978171aab59d8a253691e7cd1013f3a88","observation_id":"6a5a3f70-b144-4e6f-99c3-241ef755b679","resolution":{"observed_at":"2026-08-15T17:49:43.623259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08584","last_updated":"2024-12-18T07:45:11Z","snapshot_observed_at":"2026-08-16T13:10:26.290770Z","submitted_at":"2024-10-11T07:24:21Z","title":"ZipVL: Efficient Large Vision-Language Models with Dynamic Token Sparsification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08584","snapshot_observed_at":"2026-08-15T17:49:43.628605Z","title":"Zipvl: Efficient large vision-language models with dynamic token sparsification and kv cache compression","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.628605Z"},"links":{"cited_paper":"/paper/2410.08584","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:a653aba66c2bdc7ced993190a5fb38e36bc54307b8c1e0f8c643dfd8c601f0d3","observation_id":"658dd267-ee19-4576-932e-8682694f9af2","resolution":{"observed_at":"2026-08-15T17:49:43.628605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05135","last_updated":"2024-03-08T08:08:10Z","snapshot_observed_at":"2026-08-12T17:58:56.652054Z","submitted_at":"2024-03-08T08:08:10Z","title":"ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05135","snapshot_observed_at":"2026-08-15T17:49:43.633946Z","title":"Ella: Equip diffusion models with llm for enhanced semantic alignment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.633946Z"},"links":{"cited_paper":"/paper/2403.05135","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:96b4a2c07e328d63bc938721bf73f7dc958d96f52ca255e56cbc36f6271cc3a1","observation_id":"7569a03a-2990-4226-a87a-9ea4afc6cb64","resolution":{"observed_at":"2026-08-15T17:49:43.633946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.487910Z","title":"Autoregressive image generation using residual quantization","venue":null,"work_id":"1d6cea0c-23bf-46e7-9cc8-884575483808","year":2022},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.639096Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:42efff741362626a043d901d0524008bd1fa42523efd276ff09a0d6056456eb9","observation_id":"8af07939-e1d3-4e06-b0f0-8f25311ad09d","resolution":{"observed_at":"2026-08-15T17:49:44.492751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.472286Z","title":"Autoregressive image generation using residual quantization","venue":null,"work_id":"fd33a556-9b03-42fd-a46a-dec9dbf25bc4","year":2022},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.643797Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:14849204c0abf776af07facb819043df352c20949318a2aaf77257a54a93fda0","observation_id":"843afbb6-346e-4d6a-8ba0-9b7033520c51","resolution":{"observed_at":"2026-08-15T17:49:44.477290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23782","last_updated":"2024-10-31T09:55:32Z","snapshot_observed_at":"2026-08-16T13:04:13.203209Z","submitted_at":"2024-10-31T09:55:32Z","title":"Video Token Merging for Long-form Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23782","snapshot_observed_at":"2026-08-15T17:49:43.649427Z","title":"Video token merging for long-form video understand- ing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.649427Z"},"links":{"cited_paper":"/paper/2410.23782","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:5a331cdd3de89b0bb1ff3bb4e003abc06587fe14c8b30657212a42d9c259fe97","observation_id":"50a05d97-ecda-4775-aa76-eda03233ec33","resolution":{"observed_at":"2026-08-15T17:49:43.649427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.456743Z","title":"Control- lable text-to-image generation","venue":null,"work_id":"131ada25-ca5c-4228-9883-e8c7ce488bfa","year":2019},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.654523Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:ff80c871ec9c8e799c0a3420aa87ecf5707919412d11089a00c14e817fd3407d","observation_id":"9de9e9de-fa8d-4156-bfa7-cb7d3791f8db","resolution":{"observed_at":"2026-08-15T17:49:44.461713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01756","last_updated":"2024-12-03T20:32:52Z","snapshot_observed_at":"2026-08-16T13:13:16.202764Z","submitted_at":"2024-10-02T17:06:39Z","title":"ImageFolder: Autoregressive Image Generation with Folded Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01756","snapshot_observed_at":"2026-08-15T17:49:43.659509Z","title":"Imagefolder: Autoregressive image generation with folded tokens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.659509Z"},"links":{"cited_paper":"/paper/2410.01756","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:a599d3eeb5503e47d313c0dd3cd70df229ba14f710a7f4549fd070ed67425b57","observation_id":"9a15ce32-99b5-49ca-8d2d-4d3790e7d293","resolution":{"observed_at":"2026-08-15T17:49:43.659509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09750","last_updated":"2024-10-02T02:10:26Z","snapshot_observed_at":"2026-08-16T13:43:05.371593Z","submitted_at":"2024-06-14T06:35:33Z","title":"ControlVAR: Exploring Controllable Visual Autoregressive Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09750","snapshot_observed_at":"2026-08-15T17:49:43.665348Z","title":"Controlvar: Exploring control- lable visual autoregressive modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.665348Z"},"links":{"cited_paper":"/paper/2406.09750","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:535b2dc6d4fcb53f2e30404ff49ad31b74526db7491b07adef6c7754bc053c5a","observation_id":"0d8ce180-5a53-410c-b5ad-4ba1056be509","resolution":{"observed_at":"2026-08-15T17:49:43.665348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.441628Z","title":"Finite scalar quantization: Vq-vae made simple","venue":null,"work_id":"73d039bb-9065-4216-a0dd-ecef37a6882a","year":null},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.670253Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:7798bf39effceae2b5eb1af688bc8adaa16826af4ae7b096befb2616de0dceb6","observation_id":"46de1876-4c62-45c2-9e0c-e3f7aaa106b7","resolution":{"observed_at":"2026-08-15T17:49:44.446559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.426391Z","title":"SDXL: improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":"b29616c1-0436-448c-91f3-0d2b1bb77b3c","year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.675150Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:1ac1da7b9f676c4994537f237b7df9752f301ee95a39c5c6b3495320262d26af","observation_id":"3b004722-083b-4f3e-bac6-58c4d0aacc0f","resolution":{"observed_at":"2026-08-15T17:49:44.431592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.409495Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":"e92be7b2-481e-4b62-8f59-1735bd23c183","year":2021},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.680696Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:043e4560369ebea2584688171c5fef70db4d4276f902f5442823e7c4844c7a54","observation_id":"c07c7db6-21c2-4b2f-b66e-937e70adc882","resolution":{"observed_at":"2026-08-15T17:49:44.414650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.393976Z","title":"Gen- erating diverse high-fidelity images with vq-vae-2","venue":null,"work_id":"8e71ff2e-1950-4891-b908-860e78eb8981","year":2019},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.685562Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:0d1b31c1e19f610ad3614685bbd1404f0a63500e10e39b4827212b5ca105d281","observation_id":"8c9a1963-ba82-447d-8ec7-e1e3687d8490","resolution":{"observed_at":"2026-08-15T17:49:44.398969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.378441Z","title":"Generative adversarial text to image synthesis","venue":null,"work_id":"e2106f31-9cbb-497e-8955-943697ef1d18","year":2016},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.690441Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:d0c020446d3923de3ba7fdd6dbacacc69be8b2d969a60d9e497d9a7c51761d75","observation_id":"0a542497-8a0b-454e-9509-090612fc2155","resolution":{"observed_at":"2026-08-15T17:49:44.383454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.362306Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"e3d0a813-7f93-4bd8-a11f-6637e18836ae","year":2022},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.695983Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:ef5591d2ee980b0127bf6b40d335a8006d1f140b8b2625b478b87c828a092c0e","observation_id":"e51d9640-cf19-401d-ad68-c504403289e4","resolution":{"observed_at":"2026-08-15T17:49:44.367449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:43.700781Z","title":"J., and Yan, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.700781Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:c334bed47a37182f3d7834738bbb2cc849132dfb4cdfca27c446a71c8e9bac98","observation_id":"67ab8691-930f-4d70-908c-725a5ef630e9","resolution":{"observed_at":"2026-08-15T17:49:43.700781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-08-13T22:05:34.844117Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-15T17:49:43.706738Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.706738Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:4b4ef2919b9d97adb5e5baa8023899078edd78d736d990d9041fc216e9144bf3","observation_id":"bf81c526-0afb-438f-8ef3-56c05e271e80","resolution":{"observed_at":"2026-08-15T17:49:43.706738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10812","last_updated":"2024-10-14T17:59:42Z","snapshot_observed_at":"2026-08-16T13:09:29.086289Z","submitted_at":"2024-10-14T17:59:42Z","title":"HART: Efficient Visual Generation with Hybrid Autoregressive Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10812","snapshot_observed_at":"2026-08-15T17:49:43.711960Z","title":"Hart: Ef- ficient visual generation with hybrid autoregressive transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.711960Z"},"links":{"cited_paper":"/paper/2410.10812","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:2a4cab5e54882cc8c7be752c1e304b7d723b7b25fe06ccf6c451084b5856d5e3","observation_id":"e5ed191a-5c52-4ac6-8140-3cdc4794067e","resolution":{"observed_at":"2026-08-15T17:49:43.711960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.344543Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction","venue":null,"work_id":"fdd25a23-a3fc-4229-9fde-29901df1534c","year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.717358Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:a6e7f9410834f4cf82453ff7b3adf27f0b6de6f660c4933d5b7b23b5640692fa","observation_id":"77f02810-04e8-47dd-b53f-ac68ff7cb72d","resolution":{"observed_at":"2026-08-15T17:49:44.350215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.327374Z","title":"Neural discrete representation learning","venue":null,"work_id":"01703202-674d-463b-9317-a339aa34a840","year":2017},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.721899Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:4107751b48663a7a89b0802d474bb147af18324fde260c509b27b5e9486c4173","observation_id":"502b412c-c872-4aa7-9263-08700e9519ff","resolution":{"observed_at":"2026-08-15T17:49:44.333379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.309890Z","title":"Tag dis- entangled generative adversarial networks for object image re-rendering","venue":null,"work_id":"ecfe6b5e-d077-491e-aceb-c348b651b1c6","year":2017},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.726461Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:8b7a58b430275f4d8443c49e4b7a417a5fc4da032bb252415a491aa34469e1b3","observation_id":"70900018-08b8-4252-b0c3-2aff8dc20083","resolution":{"observed_at":"2026-08-15T17:49:44.314959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-15T17:49:43.732191Z","title":"Emu3: Next-token prediction is all you need","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.732191Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:eed79757d2417da81e9bca789bf77a8a9f4c86aaf041c3f2876d55b7a167b7c1","observation_id":"561d413c-edf3-4347-8c39-8b820f23954b","resolution":{"observed_at":"2026-08-15T17:49:43.732191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09341","last_updated":"2023-09-25T08:19:23Z","snapshot_observed_at":"2026-08-14T02:46:25.655503Z","submitted_at":"2023-06-15T17:59:31Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09341","snapshot_observed_at":"2026-08-15T17:49:43.737120Z","title":"Human preference score v2: A solid benchmark for evaluating human preferences of text- to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.737120Z"},"links":{"cited_paper":"/paper/2306.09341","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:74b87d0caf9ada32493e4c5524f243c7112122273e758cd815c71715aeea8b29","observation_id":"e0542dc5-7ffc-4a7c-847c-b17d3d6956ba","resolution":{"observed_at":"2026-08-15T17:49:43.737120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.294748Z","title":"Imagereward: Learning and evalu- ating human preferences for text-to-image generation","venue":null,"work_id":"0234fd7a-54be-4429-8d85-3ce1bdbf62f3","year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.742650Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:78b6e9ae3da19395babf2af5dd879c67f760c520bc621bbaa5f138c6f5afdb81","observation_id":"9ec1fa05-9e90-49f2-b053-f031e013e85a","resolution":{"observed_at":"2026-08-15T17:49:44.299516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.278423Z","title":"Attngan: Fine-grained text to image generation with attentional generative adversar- ial networks","venue":null,"work_id":"c4f46962-a5a9-483e-894b-b26bb2c6f45f","year":2018},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.749094Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:3988d461d3b55e337da169d0810ef3286d99b0f634d70373acd875bebc5372a6","observation_id":"3e6893ed-108a-48de-8e52-3e8fd8a1b00b","resolution":{"observed_at":"2026-08-15T17:49:44.284008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04627","last_updated":"2022-06-05T01:57:58Z","snapshot_observed_at":"2026-08-13T12:11:58.325060Z","submitted_at":"2021-10-09T18:36:00Z","title":"Vector-quantized Image Modeling with Improved VQGAN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04627","snapshot_observed_at":"2026-08-15T17:49:43.753809Z","title":"Y ., Zhang, H., Pang, R., Qin, J., Ku, A., Xu, Y ., Baldridge, J., and Wu, Y","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.753809Z"},"links":{"cited_paper":"/paper/2110.04627","citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:508658a2370fb6dd95b4c439b01f15ddcb40a88825310f8d82341e54d4e51486","observation_id":"d34253de-c952-43f1-816a-b8e69778b900","resolution":{"observed_at":"2026-08-15T17:49:43.753809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.261521Z","title":"B., Versari, L., Sohn, K., Minnen, D., Cheng, Y ., Gupta, A., Gu, X., Hauptmann, A","venue":null,"work_id":"f00590c0-62ff-4d51-9ecb-4152a956d46a","year":null},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.759129Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:6ea08e7462d5ae386cc402610f6b753ff5a0aa385d82d75fd336d4522b0cde83","observation_id":"d991820e-6168-441d-a48d-82337ef23314","resolution":{"observed_at":"2026-08-15T17:49:44.266556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:49:44.242442Z","title":"B., Versari, L., Sohn, K., Minnen, D., Cheng, Y ., Gupta, A., Gu, X., Hauptmann, A","venue":null,"work_id":"f0b9e4aa-474b-4aae-a0c2-7758cfca9b02","year":2024},"citing_paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T17:49:43.764805Z"},"links":{"citing_paper":"/paper/2507.20454"},"observation_digest":"sha256:b89e4358493e78e6b06db37dbf19b7154506359dbf075883f540985c0190149c","observation_id":"4b4950a1-23f5-40ed-9467-3a88d532bd65","resolution":{"observed_at":"2026-08-15T17:49:44.250140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.20454","last_updated":"2025-07-28T01:13:24Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T19:58:53.420400Z","submitted_at":"2025-07-28T01:13:24Z","title":"Frequency-Aware Autoregressive Modeling for Efficient High-Resolution Image Synthesis"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2507.20454."}