{"as_of":"2026-08-09T18:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2c3db5460afe3dbb5752629d6273a1d84fa158008cf1547da1f42edd033c6a60","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":21,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:33:11.114818Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T20:50:11.364862Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-08-07T15:33:11.114818Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14687","last_updated":"2025-05-20T17:59:59Z","snapshot_observed_at":"2026-08-08T00:07:41.253312Z","submitted_at":"2025-05-20T17:59:59Z","title":"Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:33:11.114818Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2505.14687"},"observation_digest":"sha256:a9a6d625da678f4408978dc440696bbeef051e7ea51b305b3da54aa0b4fb4afe","observation_id":"2bbd127e-dbbb-433b-813f-e49370cc231c","resolution":{"observed_at":"2026-08-07T15:33:11.114818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-08-07T14:22:22.867030Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:22.867030Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:57e923fd5b710bdba2d017d4e8f99ba7bce43c6f892d5f0ff40306f92cb398f2","observation_id":"3463cecd-eb04-4987-aadd-86d1f4c40274","resolution":{"observed_at":"2026-08-07T14:22:22.867030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-08-07T14:01:02.870552Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20297","last_updated":"2025-05-26T17:59:57Z","snapshot_observed_at":"2026-08-07T13:53:13.668478Z","submitted_at":"2025-05-26T17:59:57Z","title":"DiSA: Diffusion Step Annealing in Autoregressive Image Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:02.870552Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2505.20297"},"observation_digest":"sha256:b0477275f0b96cf759397b648d3f84e0936d70fc10c4f69cd9c5bc935465fe33","observation_id":"12365a36-5510-421f-8337-8abec9d64957","resolution":{"observed_at":"2026-08-07T14:01:02.870552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-08-07T12:46:46.106673Z","title":"Yuille, and Liang-Chieh Chen","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23660","last_updated":"2025-05-29T17:09:25Z","snapshot_observed_at":"2026-08-07T12:38:06.627302Z","submitted_at":"2025-05-29T17:09:25Z","title":"D-AR: Diffusion via Autoregressive Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:46.106673Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2505.23660"},"observation_digest":"sha256:5840680cf865b65c7890b05c5dab06ba592fe636f84def8e27d04680c3395c7b","observation_id":"a78fdd55-6a02-458b-82e4-efb16a63fd60","resolution":{"observed_at":"2026-08-07T12:46:46.106673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-08-07T04:52:55.086831Z","title":"Yuille, and Liang-Chieh Chen","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09482","last_updated":"2025-08-20T06:57:17Z","snapshot_observed_at":"2026-08-09T00:33:23.805129Z","submitted_at":"2025-06-11T07:50:31Z","title":"Marrying Autoregressive Transformer and Diffusion with Multi-Reference Autoregression","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:55.086831Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2506.09482"},"observation_digest":"sha256:6dbf12c7cafceecc1f5556e2fe82caac5134176da6b20a9afd68b0bd99b83386","observation_id":"0b090992-b052-4003-8178-d60b7ff1248b","resolution":{"observed_at":"2026-08-07T04:52:55.086831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-08-06T23:01:49.751169Z","title":"Be- yond next-token: Next-x prediction for autoregressive visual generation.arXiv preprint arXiv:2502.20388, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20214","last_updated":"2025-07-08T07:46:39Z","snapshot_observed_at":"2026-08-09T16:18:48.711928Z","submitted_at":"2025-06-25T07:57:09Z","title":"UniCode$^2$: Cascaded Large-scale Codebooks for Unified Multimodal Understanding and Generation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T23:01:49.751169Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2506.20214"},"observation_digest":"sha256:c84f219abe1505dfc63d6bac75198571d6d4e2460c8950fe447adb833eea65bf","observation_id":"25f9e83f-3624-4516-9e8a-ef6009465aa1","resolution":{"observed_at":"2026-08-06T23:01:49.751169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-08-03T14:53:02.400983Z","title":"Beyond next-token: Next-x pre- diction for autoregressive visual generation.arXiv preprint arXiv:2502.20388, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.19311","last_updated":"2026-07-12T14:26:35Z","snapshot_observed_at":"2026-08-07T18:54:26.140556Z","submitted_at":"2025-12-22T12:00:12Z","title":"MixFlow Training: Alleviating Exposure Bias with Slowed Interpolation Mixture","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T14:53:02.400983Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2512.19311"},"observation_digest":"sha256:ed97deb605f840f763d321891944978507009e8b37b1882f7a51a6f595848def","observation_id":"e833e703-4dcf-4062-b34a-e733a7d27cbe","resolution":{"observed_at":"2026-08-03T14:53:02.400983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":"2502.20388","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-07-04T20:50:11.364862Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation","venue":null,"work_id":"0e9ba908-c13e-44d1-993a-2ce2994b1cc9","year":2025},"citing_paper":{"arxiv_id":"2601.14671","last_updated":"2026-04-13T06:15:42Z","snapshot_observed_at":"2026-07-06T22:42:26.083572Z","submitted_at":"2026-01-21T05:33:23Z","title":"Mirai: Autoregressive Visual Generation Needs Foresight","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T12:16:16.461488Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2601.14671"},"observation_digest":"sha256:284751cdcff32762f6686c47432e1bfc6bffed656e2134f7813de65316d61585","observation_id":"efdf39ba-e8d2-48c1-94ed-ffdc2820431d","resolution":{"observed_at":"2026-05-16T12:17:52.086428Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-08-03T04:53:11.995595Z","title":"FlowAR: Scale-wise Autoregressive Image Generation Meets Flow Matching","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.03811","last_updated":"2026-07-31T03:14:10Z","snapshot_observed_at":"2026-08-09T05:50:08.883674Z","submitted_at":"2026-02-03T18:15:27Z","title":"Progressive Checkerboards for Autoregressive Multiscale Image Generation","version":3},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-03T04:53:11.995595Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2602.03811"},"observation_digest":"sha256:5e76c791a8575a1bcb818fe5993fad23a2f72e898bdf51fa62453a8666940b29","observation_id":"cbb10c95-020c-4b78-a441-4d14c1c9ad64","resolution":{"observed_at":"2026-08-03T04:53:11.995595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":"2502.20388","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-07-04T20:50:11.364862Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation","venue":null,"work_id":"0e9ba908-c13e-44d1-993a-2ce2994b1cc9","year":2025},"citing_paper":{"arxiv_id":"2602.04883","last_updated":"2026-05-18T18:23:50Z","snapshot_observed_at":"2026-08-07T14:56:29.023603Z","submitted_at":"2026-02-04T18:59:49Z","title":"Protein Autoregressive Modeling via Multiscale Structure Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-21T13:21:53.668727Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2602.04883"},"observation_digest":"sha256:190da70b79567443286c6a016edeec7aa3b15f1fb4aa5f05693da57452ce5b75","observation_id":"1036dc5b-3860-4361-b000-2ba3fdcfebe8","resolution":{"observed_at":"2026-05-21T13:24:11.287183Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-07-13T22:10:29.821610Z","title":"arXiv preprint arXiv:2502.20388 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.19122","last_updated":"2026-07-01T11:37:46Z","snapshot_observed_at":"2026-08-06T04:48:31.545769Z","submitted_at":"2026-03-19T16:44:23Z","title":"Revisiting Autoregressive Models for Generative Image Classification","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-13T22:10:29.821610Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2603.19122"},"observation_digest":"sha256:56757cd104caae41ed87e86bb780514943565327ebc7f543bdd279bcb69d602a","observation_id":"775d39b1-147d-409e-8c4e-85a8fb49cbab","resolution":{"observed_at":"2026-07-13T22:10:29.821610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":"2502.20388","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-07-04T20:50:11.364862Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation","venue":null,"work_id":"0e9ba908-c13e-44d1-993a-2ce2994b1cc9","year":2025},"citing_paper":{"arxiv_id":"2605.18267","last_updated":"2026-07-24T06:29:36Z","snapshot_observed_at":"2026-08-02T13:49:17.490757Z","submitted_at":"2026-05-18T12:03:41Z","title":"SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-20T11:59:54.139888Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2605.18267"},"observation_digest":"sha256:3b251382dae23ffa6b035a7a3863a5e00394c36be9d3ca9db329c8ba92df20f0","observation_id":"1abfe4cb-7c43-44c0-afec-6d8c39ab548e","resolution":{"observed_at":"2026-05-20T12:03:15.337231Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":"2502.20388","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-07-04T20:50:11.364862Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation","venue":null,"work_id":"0e9ba908-c13e-44d1-993a-2ce2994b1cc9","year":2025},"citing_paper":{"arxiv_id":"2605.18267","last_updated":"2026-07-24T06:29:36Z","snapshot_observed_at":"2026-08-02T13:49:17.490757Z","submitted_at":"2026-05-18T12:03:41Z","title":"SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T18:39:40.667006Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2605.18267"},"observation_digest":"sha256:7b605ee50875327d1dcb54883e0d463d8d1fbbe047314207c0929f09091049c1","observation_id":"ed65a459-b043-4a10-91d0-0ec196c2b2dd","resolution":{"observed_at":"2026-06-30T18:45:00.709497Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-08-02T13:49:19.749327Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.18267","last_updated":"2026-07-24T06:29:36Z","snapshot_observed_at":"2026-08-02T13:49:17.490757Z","submitted_at":"2026-05-18T12:03:41Z","title":"SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T13:49:19.749327Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2605.18267"},"observation_digest":"sha256:b4503ccb67b348cc818eb5a1f23085ea27b059ae66bf4056b344b396db46a417","observation_id":"d26ccaf8-5e54-4f60-ba49-07d528a7101e","resolution":{"observed_at":"2026-08-02T13:49:19.749327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":"2502.20388","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-07-04T20:50:11.364862Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation","venue":null,"work_id":"0e9ba908-c13e-44d1-993a-2ce2994b1cc9","year":2025},"citing_paper":{"arxiv_id":"2605.30317","last_updated":"2026-05-28T17:55:06Z","snapshot_observed_at":"2026-08-03T10:02:44.497447Z","submitted_at":"2026-05-28T17:55:06Z","title":"VPG: Visual Prefix Guidance for Autoregressive Image and Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T08:00:16.005187Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2605.30317"},"observation_digest":"sha256:c58fee6052a0303dd6a246964f5a8a295d10aa0a5183678a15c1f157378dbc17","observation_id":"2ef82b06-ad04-43e7-b1e7-e8bf54ea51ba","resolution":{"observed_at":"2026-06-29T08:03:14.032693Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":"2502.20388","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-07-04T20:50:11.364862Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation","venue":null,"work_id":"0e9ba908-c13e-44d1-993a-2ce2994b1cc9","year":2025},"citing_paper":{"arxiv_id":"2606.11096","last_updated":"2026-06-09T16:53:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-09T16:53:30Z","title":"IDEAL: In-DEpth ALignment Makes A Discrete Representation AutoEncoder","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-27T13:10:14.308216Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2606.11096"},"observation_digest":"sha256:258ee61de1fe754e2fb345c6565958edf64a581356610590ae417cbf1fbd4bd9","observation_id":"27012b5f-b880-4d38-acb4-d2ab42fb7377","resolution":{"observed_at":"2026-07-03T05:37:40.221265Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":"2502.20388","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-07-04T20:50:11.364862Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation","venue":null,"work_id":"0e9ba908-c13e-44d1-993a-2ce2994b1cc9","year":2025},"citing_paper":{"arxiv_id":"2606.26016","last_updated":"2026-07-08T10:57:01Z","snapshot_observed_at":"2026-08-02T07:36:10.167129Z","submitted_at":"2026-06-24T16:37:10Z","title":"MIMFlow: Integrating Masked Image Modeling with Normalizing Flows for End-to-End Image Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-25T19:34:02.046104Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2606.26016"},"observation_digest":"sha256:52f2453bcfe1d31bf89b5ac539630ebdb415eaf1a7fb45888e9bc19825191893","observation_id":"747b3a78-7e9c-48f8-b796-18bbeedb6d90","resolution":{"observed_at":"2026-07-04T20:50:11.366772Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":"2502.20388","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-07-04T20:50:11.364862Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation","venue":null,"work_id":"0e9ba908-c13e-44d1-993a-2ce2994b1cc9","year":2025},"citing_paper":{"arxiv_id":"2606.26016","last_updated":"2026-07-08T10:57:01Z","snapshot_observed_at":"2026-08-02T07:36:10.167129Z","submitted_at":"2026-06-24T16:37:10Z","title":"MIMFlow: Integrating Masked Image Modeling with Normalizing Flows for End-to-End Image Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:24.992386Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2606.26016"},"observation_digest":"sha256:c8da88dc53662e392f1fbf52966ed4e9be5394f3dd6b46bad246bd0847028ec7","observation_id":"83483088-3774-4c5b-91ac-fabf18bfe326","resolution":{"observed_at":"2026-07-01T09:35:40.166094Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-07-12T12:07:02.175855Z","title":"arXiv preprint arXiv:2502.20388 (2025) 10","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26016","last_updated":"2026-07-08T10:57:01Z","snapshot_observed_at":"2026-08-02T07:36:10.167129Z","submitted_at":"2026-06-24T16:37:10Z","title":"MIMFlow: Integrating Masked Image Modeling with Normalizing Flows for End-to-End Image Generation","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-12T12:07:02.175855Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2606.26016"},"observation_digest":"sha256:ccefd73f412594dc06a9f4d9f5fcb23e6b2169fc21783ca480d55f6bb25e56eb","observation_id":"f8b7fc59-857b-48fd-8134-33708f610f9d","resolution":{"observed_at":"2026-07-12T12:07:02.175855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":"2502.20388","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-07-04T20:50:11.364862Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation","venue":null,"work_id":"0e9ba908-c13e-44d1-993a-2ce2994b1cc9","year":2025},"citing_paper":{"arxiv_id":"2606.28386","last_updated":"2026-06-22T17:06:05Z","snapshot_observed_at":"2026-08-02T11:08:25.094268Z","submitted_at":"2026-06-22T17:06:05Z","title":"Data Provenance for Image Auto-Regressive Generation","version":1},"reference_index":181,"source":"arxiv_source","source_observed_at":"2026-06-30T10:28:59.577056Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2606.28386"},"observation_digest":"sha256:3068e75468cec1271cfc0417319d9d835c0a7dbeefca48ff198667b451610474","observation_id":"f54be0e4-03ac-4e97-b232-b9b89eaafb2b","resolution":{"observed_at":"2026-06-30T10:34:36.590420Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation","version":2},"cited_work":{"arxiv_id":"2502.20388","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.20388","snapshot_observed_at":"2026-07-04T20:50:11.364862Z","title":"Beyond next-token: Next-x prediction for autoregressive visual generation","venue":null,"work_id":"0e9ba908-c13e-44d1-993a-2ce2994b1cc9","year":2025},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2502.20388","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:4d610fcb137fd03e081bd0aa5173298f53ca0f1c537858f3357e6ec5ac58c2ac","observation_id":"d4632558-bf4f-466b-9ba3-2c122f0fc9f8","resolution":{"observed_at":"2026-07-02T15:17:07.226058Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.20388/citation-record","integrity":"/paper/2502.20388/integrity","json":"/paper/2502.20388/citation-record.json","paper":"/paper/2502.20388"},"outbound":[],"paper":{"arxiv_id":"2502.20388","last_updated":"2025-03-20T18:15:30Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T06:15:55.650722Z","submitted_at":"2025-02-27T18:59:08Z","title":"Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 21 inbound Pith citation observations for arXiv:2502.20388."}