{"as_of":"2026-08-19T08:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b1a282c61a30034b67cb1049a0a967deeb91cb5765a8db3898c5f088d2dd7b56","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:16:20.927090Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T06:03:03.062322Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T07:58:07.594523Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"cited_work":{"arxiv_id":"2505.19602","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19602","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Memory-efficient visual au- toregressive modeling with scale-aware kv cache compression","venue":null,"work_id":"749ed683-89fb-49a6-b565-8f46daab3fe4","year":2025},"citing_paper":{"arxiv_id":"2605.01220","last_updated":"2026-07-06T12:26:12Z","snapshot_observed_at":"2026-08-11T16:26:25.816251Z","submitted_at":"2026-05-02T03:23:17Z","title":"Visual Implicit Autoregressive Modeling","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-09T15:20:03.981830Z"},"links":{"cited_paper":"/paper/2505.19602","citing_paper":"/paper/2605.01220"},"observation_digest":"sha256:af927baa78084bc56d979c419a275a4feedcc5fdeafafbd22d777e4894cb10c4","observation_id":"1a3ca253-3931-42c1-bdfb-79ffa010f511","resolution":{"observed_at":"2026-05-11T16:41:18.325747Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"cited_work":{"arxiv_id":"2505.19602","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19602","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Memory-efficient visual au- toregressive modeling with scale-aware kv cache compression","venue":null,"work_id":"749ed683-89fb-49a6-b565-8f46daab3fe4","year":2025},"citing_paper":{"arxiv_id":"2605.19660","last_updated":"2026-05-19T10:53:03Z","snapshot_observed_at":"2026-08-15T05:49:17.926349Z","submitted_at":"2026-05-19T10:53:03Z","title":"OScaR: The Occam's Razor for Extreme KV Cache Quantization in LLMs and Beyond","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T07:57:51.032025Z"},"links":{"cited_paper":"/paper/2505.19602","citing_paper":"/paper/2605.19660"},"observation_digest":"sha256:6cb97e800e59228c6fd3b00162d21599c166c68d01cbc6d2a655d19de099e15a","observation_id":"348b6ba1-7a44-4b8c-91ef-076c5be59bb4","resolution":{"observed_at":"2026-05-20T07:58:07.596260Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19602","snapshot_observed_at":"2026-08-04T06:03:03.062322Z","title":"arXiv preprint arXiv:2505.19602 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02504","last_updated":"2026-08-03T17:05:15Z","snapshot_observed_at":"2026-08-15T09:04:12.226421Z","submitted_at":"2026-08-03T17:05:15Z","title":"Token Radius Attention for Efficient Video Generation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T06:03:03.062322Z"},"links":{"cited_paper":"/paper/2505.19602","citing_paper":"/paper/2608.02504"},"observation_digest":"sha256:0348e9e2a278343223196413217914b6f3bba784a34fa47937f58a2eb18ffa09","observation_id":"14f8186d-8235-4945-ba0f-c792e5ebda9f","resolution":{"observed_at":"2026-08-04T06:03:03.062322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19602/citation-record","integrity":"/paper/2505.19602/integrity","json":"/paper/2505.19602/citation-record.json","paper":"/paper/2505.19602"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-07T14:16:12.031316Z","title":"Longformer: The long-document transformer.arXiv preprint arXiv:2004.05150, 2020","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.031316Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:07968efa6ab4a76109815c8e71e707f7296491a30f260ea6d861348605310811","observation_id":"293a0609-f139-43f6-8037-2b43a274623d","resolution":{"observed_at":"2026-08-07T14:16:12.031316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:12.089620Z","title":"Improving image generation with better captions.Computer Science","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.089620Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:5178509bf367ed9c454ab0737e0642859147af97f51a6b18b2a6106a0a9bd308","observation_id":"a6f5049a-cb1c-4012-92fc-54079f5ef1b7","resolution":{"observed_at":"2026-08-07T14:16:12.089620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-08-13T04:39:30.300015Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-07T14:16:12.217814Z","title":"Pyramidkv: Dynamic kv cache compression based on pyramidal information funneling.arXiv preprint arXiv:2406.02069, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.217814Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:e01b678ada2607981a60dd0d169698c53a5d8fb903a28f81460980c2a085385a","observation_id":"dffea209-3858-47ca-a9a0-3affff8ba103","resolution":{"observed_at":"2026-08-07T14:16:12.217814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:12.340496Z","title":"Maskgit: Masked generative image transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.340496Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:585cbbfb772a57e7d6ff9a2eed435f3a831392ccc23e6152e31e526b862a2a71","observation_id":"e9ea3931-fa9a-4d77-8236-6c48319287f0","resolution":{"observed_at":"2026-08-07T14:16:12.340496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:24.018135Z","title":"PixArt-Sigma: Weak-to-strong training of diffusion transformer for 4k text-to-image generation","venue":null,"work_id":"20219db7-c97f-4534-a900-b07e642c859b","year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.414680Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:bf8504814e5ca7add40aa07b0c9dabc1c12e30ad0543c955f62c92a90c11ba0e","observation_id":"646555be-1f9c-4df6-9c80-d2e0bfdc8a28","resolution":{"observed_at":"2026-08-07T14:16:24.117531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:12.543575Z","title":"Generative pretraining from pixels","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.543575Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:dd05114b9092d985b689f4eb5d206d02fdb2ed41af1b4469fd70787d511bb290","observation_id":"a14d7039-3002-422e-b24d-f6c3e6c903e8","resolution":{"observed_at":"2026-08-07T14:16:12.543575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17787","last_updated":"2024-11-26T15:13:15Z","snapshot_observed_at":"2026-08-18T18:28:07.208499Z","submitted_at":"2024-11-26T15:13:15Z","title":"Collaborative Decoding Makes Visual Auto-Regressive Modeling Efficient","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17787","snapshot_observed_at":"2026-08-07T14:16:12.670870Z","title":"Collaborative decoding makes visual auto-regressive modeling efficient.arXiv preprint arXiv:2411.17787, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.670870Z"},"links":{"cited_paper":"/paper/2411.17787","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:f26d95a18e4b2fe2a539600ae6bf09e9b9508387a444ec966389882cd21e46c0","observation_id":"aa1f79b0-8e6d-406e-8dfa-1e8a18d509a4","resolution":{"observed_at":"2026-08-07T14:16:12.670870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:12.835884Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:12.835884Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:469b7114a6a122d126f2f249afceb6775c959df361b3093e49356dc2f17c28b9","observation_id":"0fad3e3f-9146-4a5f-beae-d73abe0a52dc","resolution":{"observed_at":"2026-08-07T14:16:12.835884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01199","last_updated":"2024-12-02T07:05:39Z","snapshot_observed_at":"2026-08-17T18:54:15.379489Z","submitted_at":"2024-12-02T07:05:39Z","title":"TinyFusion: Diffusion Transformers Learned Shallow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01199","snapshot_observed_at":"2026-08-07T14:16:13.014126Z","title":"Tinyfusion: Diffusion transformers learned shallow.arXiv preprint arXiv:2412.01199, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.014126Z"},"links":{"cited_paper":"/paper/2412.01199","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:80d065b1aaf3857d8c4fe0f073198657fe17abb0ae96026727dd15483aa5272b","observation_id":"0a678a28-5f88-44c4-8487-7a8823fc6d0f","resolution":{"observed_at":"2026-08-07T14:16:13.014126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11550","last_updated":"2025-10-16T13:25:38Z","snapshot_observed_at":"2026-08-12T20:32:53.188699Z","submitted_at":"2024-07-16T09:53:32Z","title":"Ada-KV: Optimizing KV Cache Eviction by Adaptive Budget Allocation for Efficient LLM Inference","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11550","snapshot_observed_at":"2026-08-07T14:16:13.138387Z","title":"Ada-kv: Optimizing kv cache eviction by adaptive budget allocation for efficient llm inference.arXiv preprint arXiv:2407.11550, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.138387Z"},"links":{"cited_paper":"/paper/2407.11550","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:48fc463aafbd0e193472701e537d492d80e5d5344cd4f6fc8db7fb0fb14b5428","observation_id":"2e6847e7-cbbb-4746-be02-7c97c4414363","resolution":{"observed_at":"2026-08-07T14:16:13.138387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:13.258212Z","title":"Not all heads matter: A head-level kv cache compression method with integrated retrieval and reasoning.arXiv preprint arXiv:2410.19258, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.258212Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:62c328d0f546dc3bd91cd21016c531459f74454f65551605b8750de4b025d31e","observation_id":"8fd9a677-964d-498e-8609-a9f486163db0","resolution":{"observed_at":"2026-08-07T14:16:13.258212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01801","last_updated":"2024-10-29T18:26:09Z","snapshot_observed_at":"2026-08-14T11:45:47.400186Z","submitted_at":"2023-10-03T05:17:08Z","title":"Model Tells You What to Discard: Adaptive KV Cache Compression for LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01801","snapshot_observed_at":"2026-08-07T14:16:13.413395Z","title":"Model tells you what to discard: Adaptive kv cache compression for llms.arXiv preprint arXiv:2310.01801, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.413395Z"},"links":{"cited_paper":"/paper/2310.01801","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:5e8d6d60a00ac13582802e243c70447bbd5fc713c538aa144f965d47362b7d5d","observation_id":"814de7f5-fdf4-4a33-9933-76925e214302","resolution":{"observed_at":"2026-08-07T14:16:13.413395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:23.779438Z","title":"Geneval: An object-focused framework for evaluating text-to-image alignment","venue":null,"work_id":"2420255c-e93d-4cb9-848b-19ac06ef9c56","year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.530092Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:a95c2bfab246d4453ca1b4ddd8a71bb9f3bb2596e7efa6c10a5751d6aea3c05f","observation_id":"dc481280-ccd0-491c-af0e-50b4974a2be8","resolution":{"observed_at":"2026-08-07T14:16:23.862112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08159","last_updated":"2025-01-23T17:08:57Z","snapshot_observed_at":"2026-08-16T13:10:36.203586Z","submitted_at":"2024-10-10T17:41:54Z","title":"DART: Denoising Autoregressive Transformer for Scalable Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08159","snapshot_observed_at":"2026-08-07T14:16:13.622854Z","title":"Dart: Denoising autoregressive transformer for scalable text-to-image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.622854Z"},"links":{"cited_paper":"/paper/2410.08159","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:b513616473ca055ee8385c9aec0a5b1e83ccc4a0af6a5e54d3d8d53a345be7ff","observation_id":"22f15021-513d-40bb-a2ad-7b7af0fd1226","resolution":{"observed_at":"2026-08-07T14:16:13.622854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23367","last_updated":"2025-07-08T12:34:10Z","snapshot_observed_at":"2026-08-16T12:45:38.172700Z","submitted_at":"2025-03-30T08:51:19Z","title":"FastVAR: Linear Visual Autoregressive Modeling via Cached Token Pruning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23367","snapshot_observed_at":"2026-08-07T14:16:13.693484Z","title":"Fastvar: Linear visual autoregressive modeling via cached token pruning.arXiv preprint arXiv:2503.23367, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.693484Z"},"links":{"cited_paper":"/paper/2503.23367","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:0dbdffc195f9addb4c8133d36eb0fcb1403ae12120eac7e1a992c15d0f05e97e","observation_id":"0d51690e-64bf-4e93-9317-19ab2db69ce6","resolution":{"observed_at":"2026-08-07T14:16:13.693484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:13.770499Z","title":"Infinity: Scaling bitwise autoregressive modeling for high-resolution image synthesis, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.770499Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:fd8b39def9fa8592550ffc820d5c364f0eae6d4148fae090f29e57bf561ce37c","observation_id":"c8144f2e-57d3-4053-bc65-a0aff67de974","resolution":{"observed_at":"2026-08-07T14:16:13.770499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14256","last_updated":"2024-05-23T07:37:16Z","snapshot_observed_at":"2026-08-16T13:50:20.836322Z","submitted_at":"2024-05-23T07:37:16Z","title":"ZipCache: Accurate and Efficient KV Cache Quantization with Salient Token Identification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14256","snapshot_observed_at":"2026-08-07T14:16:13.857590Z","title":"Zipcache: Accurate and efficient kv cache quantization with salient token identification.arXiv preprint arXiv:2405.14256, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.857590Z"},"links":{"cited_paper":"/paper/2405.14256","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:0d3484df08a0206fdfb6081b081db6c8d356e1a86c3c0f0aadadb82c25862194","observation_id":"e9cccbfa-a369-4d8f-bf85-2dddd7291d5f","resolution":{"observed_at":"2026-08-07T14:16:13.857590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:13.948063Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:13.948063Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:e7407976551637f34864489cfd03929dab89fd550e410d806c4b775dbd98b280","observation_id":"90c1a4be-0e2a-4a36-8855-c9899a98340c","resolution":{"observed_at":"2026-08-07T14:16:13.948063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-07T14:16:14.033748Z","title":"Distilling the knowledge in a neural network.arXiv preprint arXiv:1503.02531, 2(7), 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:14.033748Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:f6acc6cad8598cc2281a25bbff9d9c3cc2ed40e1832bc958d051656020d86881","observation_id":"b128b49e-cda3-4642-9df2-5a338a5297d4","resolution":{"observed_at":"2026-08-07T14:16:14.033748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05135","last_updated":"2024-03-08T08:08:10Z","snapshot_observed_at":"2026-08-12T17:58:56.652054Z","submitted_at":"2024-03-08T08:08:10Z","title":"ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05135","snapshot_observed_at":"2026-08-07T14:16:14.124213Z","title":"Ella: Equip diffusion models with llm for enhanced semantic alignment.arXiv preprint arXiv:2403.05135, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:14.124213Z"},"links":{"cited_paper":"/paper/2403.05135","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:7c17c7cc17c0f50381efd8e69b3081303a349e3f89cad46bdfe2764087e3f8ed","observation_id":"a26ea0ad-6364-4f16-92b9-5d354a338c16","resolution":{"observed_at":"2026-08-07T14:16:14.124213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T14:16:14.194123Z","title":"Gpt-4o system card.arXiv preprint arXiv:2410.21276, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:14.194123Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:539c7b2ea7ffaf21f681e65d31cbaa30940347c52d7a80b520cd399edcc932b9","observation_id":"e4045744-1d75-4e87-b00d-b7d213d10524","resolution":{"observed_at":"2026-08-07T14:16:14.194123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05527","last_updated":"2024-09-30T22:44:58Z","snapshot_observed_at":"2026-08-16T14:11:31.440997Z","submitted_at":"2024-03-08T18:48:30Z","title":"GEAR: An Efficient KV Cache Compression Recipe for Near-Lossless Generative Inference of LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05527","snapshot_observed_at":"2026-08-07T14:16:14.282281Z","title":"Gear: An efficient kv cache compression recipefor near-lossless generative inference of llm.arXiv preprint arXiv:2403.05527, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:14.282281Z"},"links":{"cited_paper":"/paper/2403.05527","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:ac34e91640d822d780a1f946daebc7f4bfcaff9fb21e92e103ca67ac750c8a79","observation_id":"38eff18d-581c-469e-8f75-d9b88ac6bfaf","resolution":{"observed_at":"2026-08-07T14:16:14.282281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:14.444559Z","title":"Scalable autoregressive image generation with mamba.arXiv preprint arXiv:2408.12245, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:14.444559Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:57da0886bbf429dbe62a07eb49f66bc891e5006aca9e519f9b35e33fba8c0593","observation_id":"c1402ed7-f490-4546-badd-4fd7f608e0b5","resolution":{"observed_at":"2026-08-07T14:16:14.444559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:14.611793Z","title":"Svdquant: Absorbing outliers by low-rank components for 4-bit diffusion models.arXiv preprint arXiv:2411.05007, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:14.611793Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:636d936e0a4cd60bd08b508d129f03326f8d9dc73cd0c7cf90cd8ad9f0815d01","observation_id":"2b8bf013-ee0a-40cf-bd57-999abc287a7f","resolution":{"observed_at":"2026-08-07T14:16:14.611793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09608","last_updated":"2024-10-15T07:11:11Z","snapshot_observed_at":"2026-08-16T14:34:30.236988Z","submitted_at":"2023-12-15T08:46:43Z","title":"Faster Diffusion: Rethinking the Role of the Encoder for Diffusion Model Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09608","snapshot_observed_at":"2026-08-07T14:16:14.731278Z","title":"Faster diffusion: Rethinking the role of unet encoder in diffusion models.arXiv preprint arXiv:2312.09608, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:14.731278Z"},"links":{"cited_paper":"/paper/2312.09608","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:9991b4985cc60094dd9b927411731f8d4efd63eb1f44bc0d7e90e4a564111b63","observation_id":"06423f51-cfd0-4ae9-88ef-0b4c16487a02","resolution":{"observed_at":"2026-08-07T14:16:14.731278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11838","last_updated":"2024-11-01T14:45:36Z","snapshot_observed_at":"2026-08-16T13:42:07.461220Z","submitted_at":"2024-06-17T17:59:58Z","title":"Autoregressive Image Generation without Vector Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11838","snapshot_observed_at":"2026-08-07T14:16:14.884901Z","title":"Autoregressive image generation without vector quantization.arXiv preprint arXiv:2406.11838, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:14.884901Z"},"links":{"cited_paper":"/paper/2406.11838","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:f56b47e7c3c68519f6ae9051d09e2909e951b7583df0a4748c000f2c69b539a1","observation_id":"cb8defb5-873d-46e9-9eb1-3f9540d81714","resolution":{"observed_at":"2026-08-07T14:16:14.884901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09750","last_updated":"2024-10-02T02:10:26Z","snapshot_observed_at":"2026-08-16T13:43:05.371593Z","submitted_at":"2024-06-14T06:35:33Z","title":"ControlVAR: Exploring Controllable Visual Autoregressive Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09750","snapshot_observed_at":"2026-08-07T14:16:15.022702Z","title":"Controlvar: Exploring controllable visual autoregressive modeling.arXiv preprint arXiv:2406.09750, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:15.022702Z"},"links":{"cited_paper":"/paper/2406.09750","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:7adb0b84f13e212aac08acdc782613c76f753981eacd5df74650ecd5dddb24e4","observation_id":"62903964-d2cc-40eb-8e34-f2ca28e166b2","resolution":{"observed_at":"2026-08-07T14:16:15.022702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:15.125418Z","title":"Q-diffusion: Quantizing diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:15.125418Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:089078706d11a3d6a9c0f064ecccfaf70cf26ca421a8d57930b9bbca9e505ce6","observation_id":"4026be12-2d5f-44b1-a227-95b768acf7cd","resolution":{"observed_at":"2026-08-07T14:16:15.125418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:23.449716Z","title":"Snapfusion: Text-to-image diffusion model on mobile devices within two seconds.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"9a6b9984-52f8-4218-bd68-664cc0ec5587","year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:15.281994Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:96de03fad986f6a764ad0b99b0e1df26878371dbcaa072cbe35edb6d7219b177","observation_id":"29d6db59-5830-46f1-a198-ef87d091c6e3","resolution":{"observed_at":"2026-08-07T14:16:23.563170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14469","last_updated":"2024-06-17T03:01:58Z","snapshot_observed_at":"2026-08-14T12:21:04.886717Z","submitted_at":"2024-04-22T17:42:58Z","title":"SnapKV: LLM Knows What You are Looking for Before Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14469","snapshot_observed_at":"2026-08-07T14:16:15.378042Z","title":"Snapkv: Llm knows what you are looking for before generation.arXiv preprint arXiv:2404.14469, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:15.378042Z"},"links":{"cited_paper":"/paper/2404.14469","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:3b31424f816a9fa5168fb5d6243c5afb544d2e46a1f596c0b16344bf035a9ae0","observation_id":"8e0543e4-440f-4b44-b65f-4a42fa18ac23","resolution":{"observed_at":"2026-08-07T14:16:15.378042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02705","last_updated":"2025-03-10T06:33:37Z","snapshot_observed_at":"2026-08-16T13:12:52.742022Z","submitted_at":"2024-10-03T17:28:07Z","title":"ControlAR: Controllable Image Generation with Autoregressive Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02705","snapshot_observed_at":"2026-08-07T14:16:15.523883Z","title":"Controlar: Controllable image generation with autoregressive models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:15.523883Z"},"links":{"cited_paper":"/paper/2410.02705","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:27d9e53320ebf7242cbfc292e4394a9772dd43b13eb931d10dd7302cca4911fd","observation_id":"6fd371e8-a244-47b5-b834-3ef570d38900","resolution":{"observed_at":"2026-08-07T14:16:15.523883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:15.657471Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:15.657471Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:3de7379531bcd0968ef11e3371f847154dde95fd67b15ee74bab7883ecfde32b","observation_id":"a495cb52-b5cc-4ba3-9c05-bbf931b8765b","resolution":{"observed_at":"2026-08-07T14:16:15.657471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14366","last_updated":"2024-09-07T02:52:29Z","snapshot_observed_at":"2026-08-18T11:14:01.928809Z","submitted_at":"2024-05-23T09:43:52Z","title":"MiniCache: KV Cache Compression in Depth Dimension for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14366","snapshot_observed_at":"2026-08-07T14:16:15.805734Z","title":"Minicache: Kv cache compression in depth dimension for large language models.arXiv preprint arXiv:2405.14366, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:15.805734Z"},"links":{"cited_paper":"/paper/2405.14366","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:699c0427959882b95391f5bee2ea8f24ac40288d9ed946493b8db2ce2920b9e4","observation_id":"46aec037-8f7c-40db-bf10-3ec3a2194891","resolution":{"observed_at":"2026-08-07T14:16:15.805734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02657","last_updated":"2025-04-24T16:16:27Z","snapshot_observed_at":"2026-08-16T13:28:23.779681Z","submitted_at":"2024-08-05T17:46:53Z","title":"Lumina-mGPT: Illuminate Flexible Photorealistic Text-to-Image Generation with Multimodal Generative Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02657","snapshot_observed_at":"2026-08-07T14:16:15.891755Z","title":"Lumina-mgpt: Illuminate flexible photorealistic text-to-image generation with multimodal generative pretraining.arXiv preprint arXiv:2408.02657, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:15.891755Z"},"links":{"cited_paper":"/paper/2408.02657","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:9956735a03b334043ba955257e0b49e7e98049b2af43e8b89b4b6e8d8fdbd301","observation_id":"1adb9af2-121c-41eb-81d2-c622f8fed257","resolution":{"observed_at":"2026-08-07T14:16:15.891755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:16.016184Z","title":"Scissorhands: Exploiting the persistence of importance hypothesis for llm kv cache compression at test time.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:16.016184Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:8a00ff6b8004c2b20347a16b4c9873d27d4e319f7cca37314e4ba7ba340cc7d3","observation_id":"bebf9bab-5a0c-4ab4-b687-370c985bcc0a","resolution":{"observed_at":"2026-08-07T14:16:16.016184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02750","last_updated":"2024-07-25T09:16:05Z","snapshot_observed_at":"2026-08-12T17:03:50.984887Z","submitted_at":"2024-02-05T06:06:47Z","title":"KIVI: A Tuning-Free Asymmetric 2bit Quantization for KV Cache","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02750","snapshot_observed_at":"2026-08-07T14:16:16.195264Z","title":"Kivi: A tuning-free asymmetric 2bit quantization for kv cache.arXiv preprint arXiv:2402.02750, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:16.195264Z"},"links":{"cited_paper":"/paper/2402.02750","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:2870cfa9d233e4cd376206723e6c4cf0b3c367a29bfaba2bf2987cc0474f71e9","observation_id":"6c237317-f6f2-4a3b-8185-92f5aef59083","resolution":{"observed_at":"2026-08-07T14:16:16.195264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04378","last_updated":"2023-10-06T17:11:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-06T17:11:58Z","title":"Latent Consistency Models: Synthesizing High-Resolution Images with Few-Step Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04378","snapshot_observed_at":"2026-08-07T14:16:16.358206Z","title":"Latent consistency models: Synthesizing high-resolution images with few-step inference.arXiv preprint arXiv:2310.04378, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:16.358206Z"},"links":{"cited_paper":"/paper/2310.04378","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:8bdbaf7a51497f3b770280ca817a3bf2007cd28b7715cae9fd242287b8f2cd41","observation_id":"f0675899-2855-42d8-8823-4a6794e46234","resolution":{"observed_at":"2026-08-07T14:16:16.358206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04410","last_updated":"2025-02-09T08:59:19Z","snapshot_observed_at":"2026-08-16T13:20:41.485941Z","submitted_at":"2024-09-06T17:14:53Z","title":"Open-MAGVIT2: An Open-Source Project Toward Democratizing Auto-regressive Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04410","snapshot_observed_at":"2026-08-07T14:16:16.536400Z","title":"Open-magvit2: An open- source project toward democratizing auto-regressive visual generation.arXiv preprint arXiv:2409.04410, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:16.536400Z"},"links":{"cited_paper":"/paper/2409.04410","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:2be0e46653289965efb438e92694829b45c450bbfe1a7236869e24607392ab90","observation_id":"d5edde25-459b-4fdb-8432-9e94b657d3a9","resolution":{"observed_at":"2026-08-07T14:16:16.536400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12524","last_updated":"2022-05-30T03:13:08Z","snapshot_observed_at":"2026-08-18T11:03:43.086481Z","submitted_at":"2022-05-25T06:40:09Z","title":"Accelerating Diffusion Models via Early Stop of the Diffusion Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12524","snapshot_observed_at":"2026-08-07T14:16:16.665647Z","title":"Accelerating diffusion models via early stop of the diffusion process.arXiv preprint arXiv:2205.12524, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:16.665647Z"},"links":{"cited_paper":"/paper/2205.12524","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:42ef459cdf52b9e1f4d49b62c6c29b0b89ba66e4f6fc62066dabc3a1e042728a","observation_id":"6133ddb2-fc52-429d-8bbf-4dcf6ebadf01","resolution":{"observed_at":"2026-08-07T14:16:16.665647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10797","last_updated":"2025-02-19T06:00:55Z","snapshot_observed_at":"2026-08-18T11:01:01.238927Z","submitted_at":"2024-06-16T03:45:45Z","title":"STAR: Scale-wise Text-conditioned AutoRegressive image generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10797","snapshot_observed_at":"2026-08-07T14:16:16.780411Z","title":"Star: Scale-wise text-to-image generation via auto-regressive representations.arXiv preprint arXiv:2406.10797, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:16.780411Z"},"links":{"cited_paper":"/paper/2406.10797","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:581ba602726531fe5f5a60289629849060ef53873534fd4c3359163f2e0f1995","observation_id":"4eb1f813-b788-4468-b191-0668b04482d3","resolution":{"observed_at":"2026-08-07T14:16:16.780411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00858","last_updated":"2023-12-07T17:24:18Z","snapshot_observed_at":"2026-08-16T14:38:24.791760Z","submitted_at":"2023-12-01T17:01:06Z","title":"DeepCache: Accelerating Diffusion Models for Free","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00858","snapshot_observed_at":"2026-08-07T14:16:16.890592Z","title":"Deepcache: Accelerating diffusion models for free.arXiv preprint arXiv:2312.00858, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:16.890592Z"},"links":{"cited_paper":"/paper/2312.00858","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:1f62d5a567e306b3b78fc79024c3610d3da52e0fd720343f282b0aee4e0cb0c3","observation_id":"2eec77e1-4b91-470e-85ac-3b668055466b","resolution":{"observed_at":"2026-08-07T14:16:16.890592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06104","last_updated":"2024-06-18T09:16:14Z","snapshot_observed_at":"2026-08-16T14:28:08.030037Z","submitted_at":"2024-01-11T18:35:26Z","title":"Transformers are Multi-State RNNs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06104","snapshot_observed_at":"2026-08-07T14:16:17.009571Z","title":"Transformers are multi-state rnns.arXiv preprint arXiv:2401.06104, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:17.009571Z"},"links":{"cited_paper":"/paper/2401.06104","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:97e033cce7444e2275931c8e19693348fecd780f455301c53b7a3f974aed755e","observation_id":"c33b358f-77c5-4223-bb69-6eaff1831127","resolution":{"observed_at":"2026-08-07T14:16:17.009571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-07T14:16:17.118171Z","title":"SDXL: Improving latent diffusion models for high-resolution image synthesis.arXiv preprint arXiv:2307.01952, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:17.118171Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:fa7c6a77eb0f6b6883f8f9dacd5e4a564b544469a995416c4c34a2a0f1512b04","observation_id":"3c17afa5-d337-45c2-9e6c-6c4729a30143","resolution":{"observed_at":"2026-08-07T14:16:17.118171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:17.201417Z","title":"Head-aware kv cache compression for efficient visual autoregressive modeling.arXiv preprint arXiv:2504.09261, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:17.201417Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:e0ffa1889903b47c64c56857fe4a67ae0206ad14a03a040f6392bd2101c98580","observation_id":"ba685361-ef66-4fa7-89e4-8b276a81e4f1","resolution":{"observed_at":"2026-08-07T14:16:17.201417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09027","last_updated":"2024-12-16T21:50:56Z","snapshot_observed_at":"2026-08-16T13:25:55.018104Z","submitted_at":"2024-08-16T21:48:53Z","title":"Efficient Autoregressive Audio Modeling via Next-Scale Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09027","snapshot_observed_at":"2026-08-07T14:16:17.266768Z","title":"Efficient autoregressive audio modeling via next-scale prediction.arXiv preprint arXiv:2408.09027, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:17.266768Z"},"links":{"cited_paper":"/paper/2408.09027","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:70437ccc512f969862058528922ab372ecab7cda1cdcd063863427cb55200bf5","observation_id":"e9c6dae5-05e4-4040-a6e6-e81f9537114c","resolution":{"observed_at":"2026-08-07T14:16:17.266768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06262","last_updated":"2024-02-17T10:08:14Z","snapshot_observed_at":"2026-08-18T02:45:23.747730Z","submitted_at":"2024-02-09T09:20:59Z","title":"On the Efficacy of Eviction Policy for Key-Value Constrained Generative Language Model Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06262","snapshot_observed_at":"2026-08-07T14:16:17.384573Z","title":"On the efficacy of eviction policy for key-value constrained generative language model inference.arXiv preprint arXiv:2402.06262, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:17.384573Z"},"links":{"cited_paper":"/paper/2402.06262","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:350122912d1e1cbfb62cb2505a4bf1b8fa90ffeea8279a92e50c382b31d8db5d","observation_id":"c21181a6-5cea-470f-a97a-05134b04e7ca","resolution":{"observed_at":"2026-08-07T14:16:17.384573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.00512","last_updated":"2022-06-07T09:17:35Z","snapshot_observed_at":"2026-08-12T01:14:44.484432Z","submitted_at":"2022-02-01T16:07:25Z","title":"Progressive Distillation for Fast Sampling of Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.00512","snapshot_observed_at":"2026-08-07T14:16:17.490839Z","title":"Progressive distillation for fast sampling of diffusion models.arXiv preprint arXiv:2202.00512, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:17.490839Z"},"links":{"cited_paper":"/paper/2202.00512","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:6f2de5dbbc4557888188e97f9cfb922ff1f94c34a7294fcf308ef09d12e17a79","observation_id":"4a14f778-46c6-4d1f-a4ec-dcbf3ab8e720","resolution":{"observed_at":"2026-08-07T14:16:17.490839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17042","last_updated":"2023-11-28T18:53:24Z","snapshot_observed_at":"2026-08-16T14:39:31.496511Z","submitted_at":"2023-11-28T18:53:24Z","title":"Adversarial Diffusion Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17042","snapshot_observed_at":"2026-08-07T14:16:17.578156Z","title":"Adversarial diffusion distillation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:17.578156Z"},"links":{"cited_paper":"/paper/2311.17042","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:4907ee1a07542129dddd17b103ca36e12057394b07a787701ae9e5efae69e879","observation_id":"aa9df552-5935-49c0-8aa1-7d1032654f6d","resolution":{"observed_at":"2026-08-07T14:16:17.578156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:17.679607Z","title":"Post-training quantization on diffusion models","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:17.679607Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:cd47d63de36db76b476740641ac36fa9872a373f503713e09bed056ab08d8d68","observation_id":"3d0a08cb-ef61-469a-b213-c19bf6a9ab4c","resolution":{"observed_at":"2026-08-07T14:16:17.679607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03517","last_updated":"2024-09-02T08:30:37Z","snapshot_observed_at":"2026-08-16T14:37:09.103938Z","submitted_at":"2023-12-06T14:24:26Z","title":"FRDiff : Feature Reuse for Universal Training-free Acceleration of Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03517","snapshot_observed_at":"2026-08-07T14:16:17.772212Z","title":"Frdiff: Feature reuse for exquisite zero-shot acceleration of diffusion models.arXiv preprint arXiv:2312.03517, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:17.772212Z"},"links":{"cited_paper":"/paper/2312.03517","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:b407075290d24eb1adf95020c929b377762f7f64ee25164a969984d91cbd5778","observation_id":"a8693224-84aa-45a6-b7c3-dfc107049171","resolution":{"observed_at":"2026-08-07T14:16:17.772212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-08-13T22:05:34.844117Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-07T14:16:18.009369Z","title":"Autore- gressive model beats diffusion: Llama for scalable image generation.arXiv preprint arXiv:2406.06525, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.009369Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:28acee3d174d06f3e6509830d23ebf01d9c79a7920969231af0db61bd6792ed7","observation_id":"353a2226-eed9-4e36-903e-a49527443e35","resolution":{"observed_at":"2026-08-07T14:16:18.009369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10812","last_updated":"2024-10-14T17:59:42Z","snapshot_observed_at":"2026-08-16T13:09:29.086289Z","submitted_at":"2024-10-14T17:59:42Z","title":"HART: Efficient Visual Generation with Hybrid Autoregressive Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10812","snapshot_observed_at":"2026-08-07T14:16:18.127539Z","title":"HART: Efficient visual generation with hybrid autoregressive transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.127539Z"},"links":{"cited_paper":"/paper/2410.10812","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:a2e7fb53eb8e04dc54fbead6bea0c80d3166c07677a0bd3d2c58c3198fbe032d","observation_id":"a8d75859-c32a-486a-af2c-e1c44e89e10f","resolution":{"observed_at":"2026-08-07T14:16:18.127539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:18.201368Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction.Advances in neural information processing systems, 37:84839–84865, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.201368Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:988ae7de527dffb7b81f407769776c970fb7b05084de49bdd54df93c77f07cea","observation_id":"4080b004-8286-4e92-9045-62ccd4f9bc2c","resolution":{"observed_at":"2026-08-07T14:16:18.201368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:18.298675Z","title":"Conditional image generation with pixelcnn decoders.Advances in neural information processing systems, 29, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.298675Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:28068b44574d9023ae6171086cba694b9fdad7cbb4efbb57700ce922c09dbf1a","observation_id":"456bd8c8-8727-471a-935e-d761f58b42f2","resolution":{"observed_at":"2026-08-07T14:16:18.298675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:18.412301Z","title":"Neural discrete representation learning.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.412301Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:7f32e6b16cf53825839caa82e21e7c7aa5ec46d334b404982882c34980892f5a","observation_id":"1cb61cd6-bea0-49cc-9630-78d1767074d0","resolution":{"observed_at":"2026-08-07T14:16:18.412301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13035","last_updated":"2025-03-13T03:16:43Z","snapshot_observed_at":"2026-08-18T15:28:26.893195Z","submitted_at":"2024-06-18T20:01:51Z","title":"D2O: Dynamic Discriminative Operations for Efficient Long-Context Inference of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13035","snapshot_observed_at":"2026-08-07T14:16:18.517957Z","title":"D2o: Dynamic discriminative operations for efficient generative inference of large language models.arXiv preprint arXiv:2406.13035, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.517957Z"},"links":{"cited_paper":"/paper/2406.13035","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:c05b8eac31657dc5bd5118c9801b6181065f0d2e8deef5df0d83b1985d6f83e8","observation_id":"735fab92-1f44-4700-825d-a90d83fc65a6","resolution":{"observed_at":"2026-08-07T14:16:18.517957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-16T21:48:39.601976Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-08-07T14:16:18.606283Z","title":"Look-m: Look-once optimization in kv cache for efficient multimodal long-context inference.arXiv preprint arXiv:2406.18139, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.606283Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:6e53bae88aa5f3331f14560cab5a3ebc583f758b122eafdaa6b0149a2b291203","observation_id":"1cabc8b2-404d-4115-8940-3fe58a98ed21","resolution":{"observed_at":"2026-08-07T14:16:18.606283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-07T14:16:18.699512Z","title":"Emu3: Next-token prediction is all you need.arXiv preprint arXiv:2409.18869, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.699512Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:4186b0fab2194e5512586ba740b156c1cb8b7f24a5175606609ee5797098d2d3","observation_id":"aa87dea9-225f-47b8-8879-38d93ae314cb","resolution":{"observed_at":"2026-08-07T14:16:18.699512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03209","last_updated":"2024-01-12T09:26:45Z","snapshot_observed_at":"2026-08-16T14:37:18.669386Z","submitted_at":"2023-12-06T00:51:38Z","title":"Cache Me if You Can: Accelerating Diffusion Models through Block Caching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03209","snapshot_observed_at":"2026-08-07T14:16:18.760250Z","title":"Cache me if you can: Accelerating diffusion models through block caching.arXiv preprint arXiv:2312.03209, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.760250Z"},"links":{"cited_paper":"/paper/2312.03209","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:c68008bce02ce79c5fd841c5f4cfef44a6d669569b6a49264d3235e0a5c6ae3c","observation_id":"975c5e03-be46-46c4-8191-fea0a7ff031d","resolution":{"observed_at":"2026-08-07T14:16:18.760250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13848","last_updated":"2024-10-17T17:58:37Z","snapshot_observed_at":"2026-08-03T03:16:45.693966Z","submitted_at":"2024-10-17T17:58:37Z","title":"Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13848","snapshot_observed_at":"2026-08-07T14:16:18.842698Z","title":"Janus: Decoupling visual encoding for unified multimodal understanding and generation.arXiv preprint arXiv:2410.13848, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.842698Z"},"links":{"cited_paper":"/paper/2410.13848","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:31fefc1c599d129b7ae0fad8c79e085a9d44e631034963c46fd79cd6bb7ff17c","observation_id":"e9eb3f00-e6d4-4429-849e-e68f1db1311f","resolution":{"observed_at":"2026-08-07T14:16:18.842698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04429","last_updated":"2025-03-04T16:31:57Z","snapshot_observed_at":"2026-08-01T23:38:04.510222Z","submitted_at":"2024-09-06T17:49:56Z","title":"VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04429","snapshot_observed_at":"2026-08-07T14:16:18.961783Z","title":"VILA-U: A unified foundation model integrating visual understanding and generation.arXiv preprint arXiv:2409.04429, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.961783Z"},"links":{"cited_paper":"/paper/2409.04429","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:b1c266a33b9162613f42a620d636f8f3dc6b7d36ff1a63fe9b209418c03ca465","observation_id":"545bebb5-615d-4ecf-b2f1-754fcf5878c5","resolution":{"observed_at":"2026-08-07T14:16:18.961783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:19.047855Z","title":"Efficient streaming language models with attention sinks.arXiv, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.047855Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:7690b258d1778c1dd618e425bbd4530d04aec554a5d6765509c2272236d5b8b8","observation_id":"bacfe7e9-9139-4137-abab-317b6f2257e6","resolution":{"observed_at":"2026-08-07T14:16:19.047855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-08-18T17:34:44.890427Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-07T14:16:19.134844Z","title":"Show-o: One single transformer to unify multimodal understanding and generation.arXiv preprint arXiv:2408.12528, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.134844Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:c4fe9295da10818767d74918a89190599fc3ff8529d3323bdeda78e193b8a16f","observation_id":"8655804e-2349-42e9-9902-0e4d05f68341","resolution":{"observed_at":"2026-08-07T14:16:19.134844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17178","last_updated":"2024-11-26T07:32:36Z","snapshot_observed_at":"2026-08-18T09:56:09.300704Z","submitted_at":"2024-11-26T07:32:36Z","title":"LiteVAR: Compressing Visual Autoregressive Modelling with Efficient Attention and Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17178","snapshot_observed_at":"2026-08-07T14:16:19.250138Z","title":"Litevar: Compressing visual autoregressive modelling with efficient attention and quantization.arXiv preprint arXiv:2411.17178, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.250138Z"},"links":{"cited_paper":"/paper/2411.17178","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:674ef0c9913e3fa2e79a3f9fe19564ddbc0c7e56c38c242a9e9b5487ffd5bb48","observation_id":"f56e95aa-f6be-4e5f-994b-a7f82c45c05c","resolution":{"observed_at":"2026-08-07T14:16:19.250138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12532","last_updated":"2024-06-05T09:01:24Z","snapshot_observed_at":"2026-08-16T13:51:05.375565Z","submitted_at":"2024-05-21T06:46:37Z","title":"PyramidInfer: Pyramid KV Cache Compression for High-throughput LLM Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12532","snapshot_observed_at":"2026-08-07T14:16:19.360068Z","title":"Pyramidinfer: Pyramid kv cache compression for high-throughput llm inference.arXiv preprint arXiv:2405.12532, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.360068Z"},"links":{"cited_paper":"/paper/2405.12532","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:410f98b97c406f511a1e26d2130d10ba58c5f16c72c357f1755a4f764272d511","observation_id":"827a1ae8-2935-4ac9-96d7-895870c2b1be","resolution":{"observed_at":"2026-08-07T14:16:19.360068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06091","last_updated":"2024-04-09T07:49:30Z","snapshot_observed_at":"2026-08-18T16:51:14.872505Z","submitted_at":"2024-04-09T07:49:30Z","title":"Hash3D: Training-free Acceleration for 3D Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06091","snapshot_observed_at":"2026-08-07T14:16:19.475008Z","title":"Hash3d: Training-free acceleration for 3d generation.arXiv preprint arXiv:2404.06091, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.475008Z"},"links":{"cited_paper":"/paper/2404.06091","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:fc327b6461c361266b338a1ee4301ba1dd25197f63d29fa34987dfd013494724","observation_id":"8d6893d3-7a1a-463f-9bef-f80db39d814d","resolution":{"observed_at":"2026-08-07T14:16:19.475008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:23.046060Z","title":"Diffusion probabilistic model made slim","venue":null,"work_id":"165df68b-b5f2-4cdd-b68f-d3cf6b3a641d","year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.548827Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:681e3a154f126ba24a1f8e8cf6585e54cd94a3a5a837add08ca45588e847963d","observation_id":"b7a8c97c-e8de-47ce-bb5a-d8e082b59bd0","resolution":{"observed_at":"2026-08-07T14:16:23.209684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04671","last_updated":"2024-10-07T00:55:42Z","snapshot_observed_at":"2026-08-16T13:12:05.548875Z","submitted_at":"2024-10-07T00:55:42Z","title":"CAR: Controllable Autoregressive Modeling for Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04671","snapshot_observed_at":"2026-08-07T14:16:19.608040Z","title":"Car: Controllable autoregressive modeling for visual generation.arXiv preprint arXiv:2410.04671, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.608040Z"},"links":{"cited_paper":"/paper/2410.04671","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:6cc20db306cdba035879c28e91fc24b7585764c439cb6c14eff6318117a0bec9","observation_id":"f523d14b-49a3-43af-9877-e8c9330bc139","resolution":{"observed_at":"2026-08-07T14:16:19.608040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18828","last_updated":"2024-10-04T04:41:06Z","snapshot_observed_at":"2026-08-18T09:02:50.870995Z","submitted_at":"2023-11-30T18:59:20Z","title":"One-step Diffusion with Distribution Matching Distillation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18828","snapshot_observed_at":"2026-08-07T14:16:19.701607Z","title":"One-step diffusion with distribution matching distillation.arXiv preprint arXiv:2311.18828, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.701607Z"},"links":{"cited_paper":"/paper/2311.18828","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:d4511dd4a9ba00c124712140f95f3f73129c63f6802ae1454cc88e89d256969b","observation_id":"0f4c3011-d88a-411d-8bb5-7ed536fb36b2","resolution":{"observed_at":"2026-08-07T14:16:19.701607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12065","last_updated":"2024-02-20T08:48:24Z","snapshot_observed_at":"2026-08-17T06:09:40.445654Z","submitted_at":"2024-02-19T11:33:21Z","title":"WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12065","snapshot_observed_at":"2026-08-07T14:16:19.784103Z","title":"Wkvquant: Quan- tizing weight and key/value cache for large language models gains more.arXiv preprint arXiv:2402.12065, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.784103Z"},"links":{"cited_paper":"/paper/2402.12065","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:45cb08711a7716ce9f8a511c2d9ddb576deb6ae70fe20351f30f16e662cfe3ae","observation_id":"0e775c07-916f-4896-ae0c-6090247f3f33","resolution":{"observed_at":"2026-08-07T14:16:19.784103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:22.767767Z","title":"Resshift: Efficient diffusion model for image super-resolution by residual shifting.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"7816471f-58c0-4296-8d68-35c8941846fd","year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:19.898686Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:d9ae078aed83dddf69485d5884da19b4320fae2586130b98a258dd44d6430f86","observation_id":"3557f87b-5aab-4826-a750-14232c37e679","resolution":{"observed_at":"2026-08-07T14:16:22.897167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11098","last_updated":"2025-03-05T13:28:29Z","snapshot_observed_at":"2026-08-18T22:41:57.989896Z","submitted_at":"2024-04-17T06:32:42Z","title":"LAPTOP-Diff: Layer Pruning and Normalized Distillation for Compressing Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.11098","snapshot_observed_at":"2026-08-07T14:16:20.004397Z","title":"Laptop-diff: Layer pruning and normalized distillation for compressing diffusion models.arXiv preprint arXiv:2404.11098, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.004397Z"},"links":{"cited_paper":"/paper/2404.11098","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:66a658e90f4041b51eab2d97a0daa12df23216c434734166f8fe598b56e5b982","observation_id":"affe042c-ddf2-4a81-9f3d-0a82e5985e68","resolution":{"observed_at":"2026-08-07T14:16:20.004397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06322","last_updated":"2024-09-10T08:27:19Z","snapshot_observed_at":"2026-08-16T13:19:50.621119Z","submitted_at":"2024-09-10T08:27:19Z","title":"G3PT: Unleash the power of Autoregressive Modeling in 3D Generation via Cross-scale Querying Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06322","snapshot_observed_at":"2026-08-07T14:16:20.116154Z","title":"G3pt: Unleash the power of autoregressive modeling in 3d generation via cross-scale querying transformer.arXiv preprint arXiv:2409.06322, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.116154Z"},"links":{"cited_paper":"/paper/2409.06322","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:4af9b4fd07362a3de955bc4f6ba71ee9a5428a014716246dd79f3d04968b3b4e","observation_id":"aaa1b858-7fb0-4d7a-8413-b7a35de4a838","resolution":{"observed_at":"2026-08-07T14:16:20.116154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01181","last_updated":"2024-08-02T11:03:22Z","snapshot_observed_at":"2026-08-18T10:11:17.938342Z","submitted_at":"2024-08-02T11:03:22Z","title":"VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01181","snapshot_observed_at":"2026-08-07T14:16:20.208413Z","title":"Var-clip: Text-to- image generator with visual auto-regressive modeling.arXiv preprint arXiv:2408.01181, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.208413Z"},"links":{"cited_paper":"/paper/2408.01181","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:9a960f3a2c42f07d9b6535a78db6d1c82e6044f9d51bb6b766e136280c2431d2","observation_id":"91b9fa70-7ee9-4c17-b71a-2ec91cd63095","resolution":{"observed_at":"2026-08-07T14:16:20.208413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:20.320593Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.320593Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:eea8377c0d8d477b73f31fb8d8706c69b30fcffc5325f630d44e48de7193b1d6","observation_id":"9e2adf34-da4a-445f-a409-4db203c50c08","resolution":{"observed_at":"2026-08-07T14:16:20.320593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02747","last_updated":"2025-02-26T10:49:33Z","snapshot_observed_at":"2026-08-16T14:03:56.951368Z","submitted_at":"2024-04-03T13:44:41Z","title":"Faster Diffusion via Temporal Attention Decomposition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02747","snapshot_observed_at":"2026-08-07T14:16:20.398774Z","title":"Cross-attention makes inference cumbersome in text-to-image diffusion models.arXiv preprint arXiv:2404.02747, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.398774Z"},"links":{"cited_paper":"/paper/2404.02747","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:cca7526ba9f4250aa7da0f15dfeaafaabe90bd1e1c17912fc0d7f61434427b25","observation_id":"b14eb1c8-94d5-4847-9600-356c9fdc9949","resolution":{"observed_at":"2026-08-07T14:16:20.398774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:22.497806Z","title":"Cam: Cache merging for memory-efficient llms inference","venue":null,"work_id":"feb07f03-6d45-4d52-ad68-4cc6cd968dd6","year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.509944Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:c1831b0f94d02aefd5e4fdaa699321d85d1cf4cbba6b3728549c944fbbacf87c","observation_id":"55a8508a-c4ac-4be5-804e-d2fb45026751","resolution":{"observed_at":"2026-08-07T14:16:22.625939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:20.627739Z","title":"H2o: Heavy-hitter oracle for efficient generative inference of large language models.Advances in Neural Information Processing Systems, 36:34661–34710, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.627739Z"},"links":{"citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:77ae61e4f68c9ed81661eecf3a9356bbe153f50bb4b2a1d3ee5377879fcd99c9","observation_id":"c37d9c57-6909-4482-b493-26005cd2d039","resolution":{"observed_at":"2026-08-07T14:16:20.627739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-07T14:16:20.706471Z","title":"Real-time video generation with pyramid attention broadcast.arXiv preprint arXiv:2408.12588, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.706471Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:c146576e926ef051e845200972818a2b6b90a6807709ff51479d0a360fca936e","observation_id":"30e5a746-e8e1-4266-af0e-8df43ff5936d","resolution":{"observed_at":"2026-08-07T14:16:20.706471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16567","last_updated":"2024-06-12T07:16:21Z","snapshot_observed_at":"2026-08-18T15:15:53.288792Z","submitted_at":"2023-11-28T07:14:41Z","title":"MobileDiffusion: Instant Text-to-Image Generation on Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16567","snapshot_observed_at":"2026-08-07T14:16:20.821528Z","title":"Mobilediffusion: Subsecond text-to-image generation on mobile devices.arXiv preprint arXiv:2311.16567, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.821528Z"},"links":{"cited_paper":"/paper/2311.16567","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:d654db3d51223b7e9ed6b0eb8915a1fb1d8537c3692135f4a049555d05426d03","observation_id":"76094485-c0db-45ea-b5ce-5a4b36647ba1","resolution":{"observed_at":"2026-08-07T14:16:20.821528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11039","last_updated":"2024-08-20T17:48:20Z","snapshot_observed_at":"2026-08-11T01:34:46.484513Z","submitted_at":"2024-08-20T17:48:20Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11039","snapshot_observed_at":"2026-08-07T14:16:20.927090Z","title":"Transfusion: Predict the next token and diffuse images with one multi-modal model.arXiv preprint arXiv:2408.11039, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.927090Z"},"links":{"cited_paper":"/paper/2408.11039","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:19824085ddc6bd2adf9ba048e09df1d270d4bcb5a1f32345307f37ed344cd7d8","observation_id":"f972b876-9b38-4a37-98c5-2063619a429b","resolution":{"observed_at":"2026-08-07T14:16:20.927090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T07:02:58.828486Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":75,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 3 inbound Pith citation observations for arXiv:2505.19602."}