{"as_of":"2026-08-16T03:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:07a7c9e7ea59d5d04f56b58a07f7e2928ee710eb5ed9c0110febefd2eade8e80","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:52:44.525510Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T12:50:13.764159Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T12:50:37.089876Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"cited_work":{"arxiv_id":"2505.23331","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23331","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fine-tuning next-scale visual autoregressive models with group relative policy optimization","venue":null,"work_id":"286bd1f0-456d-40f1-9f35-ba0c559846d0","year":2025},"citing_paper":{"arxiv_id":"2604.02355","last_updated":"2026-03-12T12:49:26Z","snapshot_observed_at":"2026-07-06T22:51:44.663367Z","submitted_at":"2026-03-12T12:49:26Z","title":"From Broad Exploration to Stable Synthesis: Entropy-Guided Optimization for Autoregressive Image Generation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-15T12:50:13.764159Z"},"links":{"cited_paper":"/paper/2505.23331","citing_paper":"/paper/2604.02355"},"observation_digest":"sha256:f4e2297bdc577271f966c7a78d9ab5a3c5e070322e5abf8e6ad52d00deae65f8","observation_id":"7d5451d7-35be-4d72-8e06-480e1e4701e8","resolution":{"observed_at":"2026-05-15T12:50:37.096138Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.23331/citation-record","integrity":"/paper/2505.23331/integrity","json":"/paper/2505.23331/citation-record.json","paper":"/paper/2505.23331"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-09T16:20:23.732146Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-08-07T12:52:40.638024Z","title":"Training diffusion models with reinforcement learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:40.638024Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:7aa902a3b8717006027ee479406e7f254af9f1b054308ec35e36cc41037044aa","observation_id":"73815b03-b814-48bb-a670-c0c9faef498e","resolution":{"observed_at":"2026-08-07T12:52:40.638024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-07T12:52:40.747777Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:40.747777Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:10bde3c9708d4f331fad10ececd6bf7c68903953d77c5dcc1613a6f891227903","observation_id":"334b404d-992e-4452-8b8e-260ab5c5120c","resolution":{"observed_at":"2026-08-07T12:52:40.747777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:52:45.952089Z","title":"Large scale visual recognition","venue":null,"work_id":"7db006b8-ba67-4a1f-8d21-1c951e19d969","year":2012},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:40.913201Z"},"links":{"citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:ece2e11ac26817d0dabcc4f42576657bcff6711423033b148d0e29d2041423a7","observation_id":"52d7ffff-1436-4f80-bd33-e7b061866528","resolution":{"observed_at":"2026-08-07T12:52:46.101052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:52:45.775134Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":"2edbc0c7-42f0-4335-9e7b-f4e451db8939","year":2024},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:41.164927Z"},"links":{"citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:394c958957b1d7f3bb09579c3d83e4d68eb8c171148d82de5e2a9ee271d22f93","observation_id":"5991cb67-d15b-46e1-80bf-7168df972419","resolution":{"observed_at":"2026-08-07T12:52:45.859940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1406.2661","last_updated":"2014-06-10T18:58:17Z","snapshot_observed_at":"2026-07-06T03:46:00.791740Z","submitted_at":"2014-06-10T18:58:17Z","title":"Generative Adversarial Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.2661","snapshot_observed_at":"2026-08-07T12:52:41.243685Z","title":"J., Pouget-Abadie, J., Mirza, M., Xu, B., Warde-Farley, D., Ozair, S., Courville, A., and Bengio, Y","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:41.243685Z"},"links":{"cited_paper":"/paper/1406.2661","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:9d411c4ca5f16eec90520de7233891e71874ec9b10d5448760212429f77db31d","observation_id":"2ed005df-04d0-48d3-a3bf-ad74248e098f","resolution":{"observed_at":"2026-08-07T12:52:41.243685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04431","last_updated":"2025-06-17T15:32:20Z","snapshot_observed_at":"2026-08-15T00:31:45.808844Z","submitted_at":"2024-12-05T18:53:02Z","title":"Infinity: Scaling Bitwise AutoRegressive Modeling for High-Resolution Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04431","snapshot_observed_at":"2026-08-07T12:52:41.349047Z","title":"Infinity: Scaling bitwise autoregressive modeling for high-resolution image synthesis, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:41.349047Z"},"links":{"cited_paper":"/paper/2412.04431","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:ab1bd7b14b7469a61de823f4878e844b23eff12a77675630f3d1e4eba11c5d0c","observation_id":"ab1063cd-2ba3-4608-b879-3c1a9e9ef0c5","resolution":{"observed_at":"2026-08-07T12:52:41.349047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-07T12:52:41.478481Z","title":"and Salimans, T","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:41.478481Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:aeb225a21a804f96532656fdad8e08b512aa4feac3d4e17ff5678589ecccebc2","observation_id":"5477b8c5-cc75-40cb-a2a0-fb6f6172dcbd","resolution":{"observed_at":"2026-08-07T12:52:41.478481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-07T12:52:41.621301Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:41.621301Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:c51e86312aaf0e44608b2f730e6e84d2731f6b798c5b0da4a4e15fe58617dae8","observation_id":"bd5c164b-df26-4f3e-916c-8be800341f7a","resolution":{"observed_at":"2026-08-07T12:52:41.621301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12192","last_updated":"2023-02-23T17:34:53Z","snapshot_observed_at":"2026-07-06T14:55:12.100148Z","submitted_at":"2023-02-23T17:34:53Z","title":"Aligning Text-to-Image Models using Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12192","snapshot_observed_at":"2026-08-07T12:52:41.738949Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:41.738949Z"},"links":{"cited_paper":"/paper/2302.12192","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:d52c21f14f21030be449c77750f26d823184be3fa08610fc6873597e83643293","observation_id":"51859940-21cf-42c4-8067-b34c9cafe27f","resolution":{"observed_at":"2026-08-07T12:52:41.738949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:52:41.864074Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:41.864074Z"},"links":{"citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:67a35b8352d711189bd6bef9d6f401ab3e9c18650e84ee67eaa89c9c956e83fc","observation_id":"703e1f93-8a83-4f89-9b77-7105a1b9e159","resolution":{"observed_at":"2026-08-07T12:52:41.864074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:52:45.505230Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow","venue":null,"work_id":"73fb09fe-2c2a-4b59-9c8f-91680267ef0a","year":2023},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:41.936495Z"},"links":{"citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:986af0b969a83a7988a8264e6c2765a10c05cd1c339ff6011a2ac30b85046576","observation_id":"c5992993-0260-40c2-9dc9-4be5b02b0dc3","resolution":{"observed_at":"2026-08-07T12:52:45.627084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-07T12:52:42.078302Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:42.078302Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:53d26edf824581c0e16f41502f08666a8c057a4ae6c3fe837d88e5b3906db38d","observation_id":"e3998470-5cf0-4671-800e-3d41743b7aad","resolution":{"observed_at":"2026-08-07T12:52:42.078302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-07T12:52:42.261911Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:42.261911Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:a3de53f69f16818942c9937a7c1bec955726c08cabebc3cac146bb6629ccbb8f","observation_id":"046d19a2-5ff6-4aba-834b-9913e021f5f3","resolution":{"observed_at":"2026-08-07T12:52:42.261911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:52:42.415543Z","title":"W., Hallacy, C., Ramesh, A., Goh, G., Agarwal, S., Sastry, G., Askell, A., Mishkin, P., Clark, J., et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:42.415543Z"},"links":{"citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:906fdfbebf653e27d0ec4ff7e75d6375564008eaed06f793a52b5a9cf3b14278","observation_id":"a630f947-8778-49b6-b006-c4032dd31a2f","resolution":{"observed_at":"2026-08-07T12:52:42.415543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.12092","last_updated":"2021-02-26T23:26:05Z","snapshot_observed_at":"2026-07-06T10:44:09.403787Z","submitted_at":"2021-02-24T06:42:31Z","title":"Zero-Shot Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.12092","snapshot_observed_at":"2026-08-07T12:52:42.565243Z","title":"Zero-shot text-to-image generation, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:42.565243Z"},"links":{"cited_paper":"/paper/2102.12092","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:5edfe0a641acbbd9c75c7ab7d14bebcd9dd1f0a8f64ca5dc9d7f5882a146cf36","observation_id":"0b42df90-d4f4-4cfd-8661-84c51b32b6e1","resolution":{"observed_at":"2026-08-07T12:52:42.565243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10752","last_updated":"2022-04-13T11:38:44Z","snapshot_observed_at":"2026-07-06T12:20:47.369918Z","submitted_at":"2021-12-20T18:55:25Z","title":"High-Resolution Image Synthesis with Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10752","snapshot_observed_at":"2026-08-07T12:52:42.747054Z","title":"High-resolution image synthesis with latent diffusion models, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:42.747054Z"},"links":{"cited_paper":"/paper/2112.10752","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:e933e74469566ea0cf91a298c7aa6787baae9939a21f277083d89f3033b5cbc8","observation_id":"780b7e3e-a93a-4b50-aa7c-edc000dce459","resolution":{"observed_at":"2026-08-07T12:52:42.747054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:52:42.903491Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:42.903491Z"},"links":{"citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:597b7f667e1c0823390ba968f6e8c9a5789c3e1b00fcf4c38bb7171d508ae9d2","observation_id":"44166280-3365-4342-b26b-8b78cd705ea1","resolution":{"observed_at":"2026-08-07T12:52:42.903491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T12:52:43.081066Z","title":"Proximal policy optimization algorithms, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:43.081066Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:e86257668b9bc42d9a6237c807ea2892ab7a790cbde8b645bd9065ebc81021ae","observation_id":"b271deda-3b76-42c6-b890-2e06f44c2710","resolution":{"observed_at":"2026-08-07T12:52:43.081066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T12:52:43.292943Z","title":"K., Wu, Y., and Guo, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:43.292943Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:580a1de87423c7c5fd30b9ca7e8e92f10f64e3624a17f6e4c4f3dc608a4509b3","observation_id":"38dd85b0-368d-4f72-a15c-01c90780abd0","resolution":{"observed_at":"2026-08-07T12:52:43.292943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.03585","last_updated":"2015-11-18T21:50:51Z","snapshot_observed_at":"2026-07-06T04:11:47.439779Z","submitted_at":"2015-03-12T04:51:37Z","title":"Deep Unsupervised Learning using Nonequilibrium Thermodynamics","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.03585","snapshot_observed_at":"2026-08-07T12:52:43.377350Z","title":"N., Weiss, E","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:43.377350Z"},"links":{"cited_paper":"/paper/1503.03585","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:e52acb1a38496657887868e980ef1cf5147cd5d7251ebbe91eaa78b8dbbb00b7","observation_id":"579793ff-e0a3-43cc-b4c9-3f9d5d71bf7b","resolution":{"observed_at":"2026-08-07T12:52:43.377350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:52:45.259541Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction","venue":null,"work_id":"7da76aad-a00f-48f0-b605-dbc8f3021c35","year":2024},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:43.504353Z"},"links":{"citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:2f14c8bd211f1485a6dec7c145340ea3f7b407cf927d9ef6de1dcbe4ad73816c","observation_id":"9203ac51-8d84-457a-a6b8-823261cb1e37","resolution":{"observed_at":"2026-08-07T12:52:45.322555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.00937","last_updated":"2018-05-30T14:58:27Z","snapshot_observed_at":"2026-08-14T20:17:29.355571Z","submitted_at":"2017-11-02T21:14:44Z","title":"Neural Discrete Representation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.00937","snapshot_observed_at":"2026-08-07T12:52:43.667477Z","title":"Neural discrete representation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:43.667477Z"},"links":{"cited_paper":"/paper/1711.00937","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:3710dce5b1ded3e0f4fc5ec4f1377231444aa30bdf6af7c5662280a2bf9b87a2","observation_id":"f39b1de4-0e02-450d-9b88-391ac128758d","resolution":{"observed_at":"2026-08-07T12:52:43.667477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01819","last_updated":"2025-03-20T12:59:49Z","snapshot_observed_at":"2026-08-15T08:33:35.667211Z","submitted_at":"2024-12-02T18:57:41Z","title":"Switti: Designing Scale-Wise Transformers for Text-to-Image Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01819","snapshot_observed_at":"2026-08-07T12:52:43.800620Z","title":"Switti: Designing scale-wise transformers for text-to-image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:43.800620Z"},"links":{"cited_paper":"/paper/2412.01819","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:2a162d80c9109fe90581352a4a06bea980b9dd6eb6a4b1ba22d2a96b1cbf72f2","observation_id":"d0c26fd1-8aa3-41b9-a381-e86f887c6072","resolution":{"observed_at":"2026-08-07T12:52:43.800620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:52:45.015039Z","title":"How to train state-of-the-art models using torchvision’s latest primitives","venue":null,"work_id":"a2a242c7-ef4b-4ec2-b283-9f943ece50fd","year":2021},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:43.943917Z"},"links":{"citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:19aade81d4ad25f68c1ab8a5703ac2dd4be8c4f6babeab628f38477b5602f079","observation_id":"f2e27a8e-fd7b-4ad4-9e4b-39b97adddefe","resolution":{"observed_at":"2026-08-07T12:52:45.092645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11455","last_updated":"2025-04-15T17:59:46Z","snapshot_observed_at":"2026-08-08T11:00:06.035456Z","submitted_at":"2025-04-15T17:59:46Z","title":"SimpleAR: Pushing the Frontier of Autoregressive Visual Generation through Pretraining, SFT, and RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11455","snapshot_observed_at":"2026-08-07T12:52:44.091056Z","title":"Simplear: Pushing the frontier of autoregressive visual generation through pretraining, sft, and rl","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:44.091056Z"},"links":{"cited_paper":"/paper/2504.11455","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:afb636355e6aff64ceb4471ef19a7061b879c0fc4bab962346304d149c8e047f","observation_id":"8468dbaf-0c2b-4632-95a6-54c98420e1a6","resolution":{"observed_at":"2026-08-07T12:52:44.091056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07818","last_updated":"2025-08-28T17:19:45Z","snapshot_observed_at":"2026-08-15T21:26:30.952106Z","submitted_at":"2025-05-12T17:59:34Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07818","snapshot_observed_at":"2026-08-07T12:52:44.218213Z","title":"Dancegrpo: Unleashing grpo on visual generation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:44.218213Z"},"links":{"cited_paper":"/paper/2505.07818","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:c92fab42d366f78da58d87ea5d56f7faf7c5fcf638f816da25a1b397f9fb8c0d","observation_id":"3f74f70c-104d-4e19-a9e4-4b4bd4b81cac","resolution":{"observed_at":"2026-08-07T12:52:44.218213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13231","last_updated":"2024-03-23T05:23:00Z","snapshot_observed_at":"2026-08-13T05:19:51.443633Z","submitted_at":"2023-11-22T08:42:46Z","title":"Using Human Feedback to Fine-tune Diffusion Models without Any Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13231","snapshot_observed_at":"2026-08-07T12:52:44.361394Z","title":"Using human feedback to fine-tune diffusion models without any reward model, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:44.361394Z"},"links":{"cited_paper":"/paper/2311.13231","citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:fc03b703cec8f79e36cbc2a6961282a027cf242535efe0b1a9ebeff952a1985f","observation_id":"0791ead8-c531-4512-9ea2-917af645cbec","resolution":{"observed_at":"2026-08-07T12:52:44.361394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:52:44.525510Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:52:44.525510Z"},"links":{"citing_paper":"/paper/2505.23331"},"observation_digest":"sha256:e7c48d56c75edbee18c26414bb113f8f9582c12a80bc7c3ec3b2974f64085b42","observation_id":"cb5f053f-4694-4d01-aa53-332260fdf51d","resolution":{"observed_at":"2026-08-07T12:52:44.525510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.23331","last_updated":"2025-06-28T18:55:07Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T17:02:12.619207Z","submitted_at":"2025-05-29T10:45:38Z","title":"Fine-Tuning Next-Scale Visual Autoregressive Models with Group Relative Policy Optimization"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 1 inbound Pith citation observation for arXiv:2505.23331."}