{"as_of":"2026-08-09T09:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c578768c261c01f68b0cd04b3a7964002886d537a887d94721ec59dbe4e9013f","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T04:37:17.479761Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T22:36:08.191484Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T18:35:00.337951Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.03320","snapshot_observed_at":"2026-08-04T22:36:08.191484Z","title":"Skywork unipic: Unified autoregressive modeling for visual understanding and generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07295","last_updated":"2026-06-25T06:17:40Z","snapshot_observed_at":"2026-08-04T22:36:03.033298Z","submitted_at":"2025-09-08T23:59:32Z","title":"Reconstruction Alignment Improves Unified Multimodal Models","version":4},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-04T22:36:08.191484Z"},"links":{"cited_paper":"/paper/2508.03320","citing_paper":"/paper/2509.07295"},"observation_digest":"sha256:a09d19a2431ecf6d29ac750fb6c5263d9ad13684f5b7f51a5cdcff579b326110","observation_id":"7f283a41-9c8b-416a-965e-d63576a62cf8","resolution":{"observed_at":"2026-08-04T22:36:08.191484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"cited_work":{"arxiv_id":"2508.03320","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.03320","snapshot_observed_at":"2026-06-30T18:35:00.337951Z","title":"arXiv:2508.03320 (2025) 2","venue":null,"work_id":"7f1ecc8a-1a26-4630-80e1-31a91ad72f41","year":2025},"citing_paper":{"arxiv_id":"2605.12305","last_updated":"2026-05-12T15:54:49Z","snapshot_observed_at":"2026-07-06T23:24:03.984179Z","submitted_at":"2026-05-12T15:54:49Z","title":"Images in Sentences: Scaling Interleaved Instructions for Unified Visual Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-13T05:48:04.997796Z"},"links":{"cited_paper":"/paper/2508.03320","citing_paper":"/paper/2605.12305"},"observation_digest":"sha256:c1e0e9360918f2f80f325dd2b41e376a390e3cbd5cd34fe7fce6d4e98e7e612b","observation_id":"1a4ee54e-4b6d-44b7-b286-383a13866abd","resolution":{"observed_at":"2026-05-13T05:52:22.732596Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"cited_work":{"arxiv_id":"2508.03320","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.03320","snapshot_observed_at":"2026-06-30T18:35:00.337951Z","title":"arXiv:2508.03320 (2025) 2","venue":null,"work_id":"7f1ecc8a-1a26-4630-80e1-31a91ad72f41","year":2025},"citing_paper":{"arxiv_id":"2605.18714","last_updated":"2026-06-25T13:57:35Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:46:46Z","title":"Semantic Generative Tuning for Unified Multimodal Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-20T11:32:24.007847Z"},"links":{"cited_paper":"/paper/2508.03320","citing_paper":"/paper/2605.18714"},"observation_digest":"sha256:8018751ca1417f51ab65053f608ad43caf686a10e1dd0ca8720ba5f188034f52","observation_id":"bb7c23c2-9f76-481c-af3d-8be051a7936a","resolution":{"observed_at":"2026-05-20T11:33:14.193044Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"cited_work":{"arxiv_id":"2508.03320","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.03320","snapshot_observed_at":"2026-06-30T18:35:00.337951Z","title":"arXiv:2508.03320 (2025) 2","venue":null,"work_id":"7f1ecc8a-1a26-4630-80e1-31a91ad72f41","year":2025},"citing_paper":{"arxiv_id":"2605.18714","last_updated":"2026-06-25T13:57:35Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:46:46Z","title":"Semantic Generative Tuning for Unified Multimodal Models","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-30T18:31:10.578558Z"},"links":{"cited_paper":"/paper/2508.03320","citing_paper":"/paper/2605.18714"},"observation_digest":"sha256:891344d5b93da35ed9d97e1db60ffbd5fbf19af45034ca6f5fc801fa7d56bc93","observation_id":"76a3f3d9-c181-4765-9b82-cd61480e4c65","resolution":{"observed_at":"2026-06-30T18:35:00.339365Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.03320","snapshot_observed_at":"2026-07-14T06:20:23.251121Z","title":"arXiv preprint arXiv:2508.03320 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11199","last_updated":"2026-07-13T07:50:54Z","snapshot_observed_at":"2026-07-16T23:19:15.382857Z","submitted_at":"2026-07-13T07:50:54Z","title":"DynEval: Holistic Evaluations of T2I Generative Models in the Wild","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-07-14T06:20:23.251121Z"},"links":{"cited_paper":"/paper/2508.03320","citing_paper":"/paper/2607.11199"},"observation_digest":"sha256:ab80a5a18bb4a3dcd67341074eb0c6189351cf0b8378ee54e1cf84d8f7140a4b","observation_id":"cc4a3f82-49ea-47fb-b55a-ea0362cdefa8","resolution":{"observed_at":"2026-07-14T06:20:23.251121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.03320/citation-record","integrity":"/paper/2508.03320/integrity","json":"/paper/2508.03320/citation-record.json","paper":"/paper/2508.03320"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.624054Z","title":"Stable diffusion 3 medium: Multimodal diffusion transformer for photorealistic text-to-image generation","venue":null,"work_id":"2d61f721-3e3c-47f0-96f3-10979b2857ed","year":null},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:12.901562Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:5045145d734673ccfe20f469be714df503174821cda462ddaa3cbe34dad490f5","observation_id":"b515eb6d-4114-4fd1-bfdb-87df133c1b3b","resolution":{"observed_at":"2026-08-06T04:37:23.627086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.616699Z","title":"Deep- speed inference: Enabling efficient inference of transformer models at unprecedented scale,","venue":null,"work_id":"22feb624-12b1-4be7-9f65-8c5bea1a70a5","year":null},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:12.983546Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:d566ef2e8c1aba2841c7d7ce32cf41d8508ef395080453435d86b4fdcdcba499","observation_id":"01e15f5e-6172-4d88-891a-acdb111450a2","resolution":{"observed_at":"2026-08-06T04:37:23.619238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.609367Z","title":"Humanedit: A high-quality human-rewarded dataset for instruction-based image editing,","venue":null,"work_id":"7e3faedd-02e1-49c1-8962-881a6305ac75","year":null},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:13.048249Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:8d55580ec49660562c90d9d9a32e62250e5a7aef0fdc3fb655bc78493dcc99b4","observation_id":"95c4855d-c359-4a88-bac7-9fa6828dfbf0","resolution":{"observed_at":"2026-08-06T04:37:23.611809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.601570Z","title":"Qwen-vl: A versatile vision-language model for understanding, localization, text reading, and beyond, 2023","venue":null,"work_id":"12fdb7d1-40af-4c4c-8f53-7b95d854f7a9","year":2023},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:13.097005Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:d98cd6ccd4298016dac753e7d01d7023eaaf47eb17b9bd55bde41dbcfc5a13f5","observation_id":"6ae2157d-2c25-41c0-a229-bc638c6c16d9","resolution":{"observed_at":"2026-08-06T04:37:23.604363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.595760Z","title":null,"venue":null,"work_id":"268d286a-c0f0-490a-9111-21e51010fe8e","year":2023},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:13.126370Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:30cca806d1c0e4edecd22ebae793bfcacf1b07fd6e85abf14c958aea4e5f3cd9","observation_id":"3dbe9763-d573-4966-a22f-00fd03d180f4","resolution":{"observed_at":"2026-08-06T04:37:23.597772Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.589387Z","title":"Blip3-o: A family of fully open unified multimodal models-architecture, training and dataset, 2025","venue":null,"work_id":"a455b45d-7846-4225-99ca-7821b3370e23","year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:13.189222Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:16f534692f4d465d1f606722b1aff89c2b9291eb579c2dcc5c5109a36043c85d","observation_id":"fbdd849f-aedd-476d-bb32-946998d71609","resolution":{"observed_at":"2026-08-06T04:37:23.591896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.582120Z","title":"Pixart- � : Fast training of diffusion transformer for photorealistic text-to-image synthesis, 2023","venue":null,"work_id":"390bde8f-5fff-40da-9f55-8da33120715c","year":2023},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:13.259464Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:18bc52718e6ad3641f269db83ec8b98e5dd9b94e2fcec2e9ded7bf5e52abfdc5","observation_id":"ba5a460c-df6a-4335-8586-d3f98d36e231","resolution":{"observed_at":"2026-08-06T04:37:23.585150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.575703Z","title":"Janus-pro: Unified multimodal understanding and generation with data and model scaling, 2025","venue":null,"work_id":"70bf7479-70bf-4585-8c39-1944ab5ed43a","year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:13.353616Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:00b27aac40a3265571e0d824d4c726d007bd4b3f8f591d3d354708cb7eca58ba","observation_id":"6002f7f2-1aae-49f7-8e26-d9573ebd0ba5","resolution":{"observed_at":"2026-08-06T04:37:23.578062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.568481Z","title":"Emerging properties in unified multimodal pretraining, 2025","venue":null,"work_id":"1ffebab7-c87b-4ad6-acb7-d1c79d35cbeb","year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:13.410153Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:98ad2f0f7059454e264d40dd555b8a060d1a12bab77eb16c171fc16ebba711a6","observation_id":"f22a5152-ee28-4678-9cc5-d1bc09089fd0","resolution":{"observed_at":"2026-08-06T04:37:23.570897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.562237Z","title":"Taming transformers for high-resolution image synthesis, 2021","venue":null,"work_id":"368027b8-90e9-49d6-b175-871bfda55959","year":2021},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:13.462788Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:72778fdad3a275e57b552d98a84a20b9dcddc859c9cedc46f963b762751177a6","observation_id":"9aa3efeb-b9bf-412a-816e-7f7e53cea51d","resolution":{"observed_at":"2026-08-06T04:37:23.564492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13436","last_updated":"2025-03-17T17:58:30Z","snapshot_observed_at":"2026-08-07T16:57:02.267787Z","submitted_at":"2025-03-17T17:58:30Z","title":"Unified Autoregressive Visual Generation and Understanding with Continuous Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13436","snapshot_observed_at":"2026-08-06T04:37:13.531723Z","title":"Unified autoregressive visual generation and under- standing with continuous tokens","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:13.531723Z"},"links":{"cited_paper":"/paper/2503.13436","citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:0ed7817144d1843092bbd4ca24a0cd82ce73ae9e10b2d16eb778502afebfb9c9","observation_id":"4afd479f-c989-4a8c-92b3-2384f48e0880","resolution":{"observed_at":"2026-08-06T04:37:13.531723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.556095Z","title":"Geneval: An object-focused framework for evaluating text-to-image alignment, 2023","venue":null,"work_id":"26fe5309-3b08-4715-98f0-2fb68f499a05","year":2023},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:13.577449Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:4eba759401a6d55fe67caf71ca3fecf778f43687e2ca256428458dd99c86e82c","observation_id":"034209e4-77e0-4780-966e-562f021d4b49","resolution":{"observed_at":"2026-08-06T04:37:23.558265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:13.691792Z","title":"Goodfellow, Jean Pouget-Abadie, Mehdi Mirza, Bing Xu, David Warde-Farley, Sherjil Ozair, Aaron Courville, and Yoshua Bengio","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:13.691792Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:19be2353610b69a8c1ed427f90e97f291e64115350bdb1a47d3e84a323815e42","observation_id":"c89294ae-5a0d-427c-8dc3-15d696a68e9a","resolution":{"observed_at":"2026-08-06T04:37:13.691792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.546062Z","title":"Gemini 2.0 flash","venue":null,"work_id":"ea6c61e0-2c28-4acb-81a5-10e49a640b47","year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:13.782304Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:52e70c053c5b8638929435fef56cc4e3892c8ad1989d99ba0215797e7168e664","observation_id":"fcb91365-d167-459c-829c-ac59d18423a3","resolution":{"observed_at":"2026-08-06T04:37:23.548019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.538651Z","title":"Denoising diffusion probabilistic models, 2020","venue":null,"work_id":"6160b683-811c-4f23-b1e9-4629276ff74d","year":2020},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:13.866010Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:a9ac08e69d7debcf9d5ae94d944ce7d69129628f50e483a25a95ef7c3377c7da","observation_id":"8441cf70-ae9d-461a-8ba7-0e3509d902d3","resolution":{"observed_at":"2026-08-06T04:37:23.540726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.532003Z","title":"Ella: Equip diffusion models with llm for enhanced semantic alignment, 2024","venue":null,"work_id":"4421d5d0-1ea9-4de3-b4e3-c0663f7468fe","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:13.914935Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:f851ef9fe52d5753c7d9a3fb4255851b00596f97819f050ec3928ed5fad2013f","observation_id":"0d03ecbc-d62a-45cf-9b01-ea4e6e777c5b","resolution":{"observed_at":"2026-08-06T04:37:23.534520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.524835Z","title":"Anyedit: Edit any knowledge encoded in language models,","venue":null,"work_id":"9984b947-cd74-40f7-a763-2d37b6301b31","year":null},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:13.965897Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:1d951caa7a0d55695f3db6d75cd283378d438c94d0a3ef2ac537abf8bdbb697b","observation_id":"cc5be816-e636-47ad-8b7f-f2476e8ec0bc","resolution":{"observed_at":"2026-08-06T04:37:23.527742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.516733Z","title":"Nova: Generative language models for assembly code with hierarchical attention and contrastive learning, 2025","venue":null,"work_id":"0f10ecc0-1639-4e50-ab1c-aed7a963b6e9","year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:14.046573Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:51392545ebf055842c07d830b0f2e3dc12f355cb00ee2333157796861e04f4a0","observation_id":"e1f1312f-2ded-46c8-b985-b7e39dda56b7","resolution":{"observed_at":"2026-08-06T04:37:23.520298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.396273Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation, 2023","venue":null,"work_id":"cf368cad-0f35-4bdf-870c-860317ac514c","year":2023},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:14.122619Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:84fccde3c943bdaa6b357129a2227fd63b43180904da5552e14bf861b53bea85","observation_id":"be656d5b-b023-4f8b-b46d-72eacd9974c0","resolution":{"observed_at":"2026-08-06T04:37:23.455920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.256171Z","title":"Playground v2.5: Three insights towards enhancing aesthetic quality in text-to-image generation, 2024","venue":null,"work_id":"c57a8a35-d50f-4298-9372-aa8621aae68b","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:14.230767Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:5ad6e8c8c6689a9d6aa7a62e149403a93413d9c198ff62f7d7bc93a90002ee11","observation_id":"f05f9102-9ca3-4a44-912e-7aaafa3cbbfb","resolution":{"observed_at":"2026-08-06T04:37:23.332883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:23.114113Z","title":"Superedit: Rectifying and facilitating supervision for instruction-based image editing, 2025","venue":null,"work_id":"1301feac-e6ef-413c-a209-847c5934b4c1","year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:14.294298Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:1555b4dae8e24ac594fb1065b5af597a579453fd6771034553f884b28d3b62ad","observation_id":"6412808b-62d0-46e5-8838-54e3d4ad07fb","resolution":{"observed_at":"2026-08-06T04:37:23.197741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:22.974098Z","title":"Autoregressive image generation without vector quantization, 2024","venue":null,"work_id":"d2f97100-0a1c-44c0-a9d2-a7deaa99c731","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:14.361543Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:11dd3492feb8d2f4d00c19e609edd601cc84e4d448b549b0e992b3ba26578fe6","observation_id":"5a764196-ac51-47b3-94d7-fdd2b0af3f10","resolution":{"observed_at":"2026-08-06T04:37:23.018998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:22.804153Z","title":"Hunyuan-dit: A powerful multi-resolution diffusion transformer with fine-grained chinese understanding, 2024","venue":null,"work_id":"084460df-0f1a-4b7c-a992-1d9b73e1f688","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:14.399826Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:36b2dd65437e4a722a9eb0ef9bc39c3e3839c2d2cdfe1c3cac179259cf978fbc","observation_id":"8fc833f6-46b8-4d58-93ae-e3a0449bb6ae","resolution":{"observed_at":"2026-08-06T04:37:22.872852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:22.652428Z","title":"Uniworld-v1: High-resolution semantic encoders for unified visual understanding and generation, 2025","venue":null,"work_id":"ca4ed4be-7ae0-440e-b084-5fb164edff5a","year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:14.494416Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:a21545bb184301979a6b41d2e104b587b405f210ba7a887fd0f07814c5eb477a","observation_id":"c42d5694-412f-4f8c-93e1-00b62c6a382f","resolution":{"observed_at":"2026-08-06T04:37:22.741366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:22.540913Z","title":"Evaluating text-to-visual generation with image-to-text generation, 2024","venue":null,"work_id":"28ced559-383f-4a81-8058-26dc8e095b47","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:14.558002Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:8aab902f502587ec40392e7c819ac00ba1ecb31f2bfd1b83706b724ff644d3bb","observation_id":"71114b46-6df5-4a59-b061-2072414335a9","resolution":{"observed_at":"2026-08-06T04:37:22.599063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:22.376908Z","title":"Step1x-edit: A practical framework for general image editing, 2025","venue":null,"work_id":"51b8199a-2611-4dbc-9ffd-5a9480fdb092","year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:14.619391Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:d1503ebed3197c8edd4a065bb5da0435c5e76fda9badb72a9be26a56d1a7a738","observation_id":"2f92b74a-e1fc-4c4f-970d-40624cc911a4","resolution":{"observed_at":"2026-08-06T04:37:22.453512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:22.247224Z","title":"Glide: Towards photorealistic image generation and editing with text-guided diffusion models, 2022","venue":null,"work_id":"c9994198-1653-41c9-91e6-9f69f3952bf1","year":2022},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:14.689669Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:df86d2661cb61698c440c4a69f4be84da801cd3bbff87150bce21013cdce5afe","observation_id":"6cf927c5-14e5-4aff-b0bd-4fc487a670ec","resolution":{"observed_at":"2026-08-06T04:37:22.285042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:22.057707Z","title":"Improving image generation with better captions","venue":null,"work_id":"e8196ad7-0382-44bc-aa47-87c936ccb47d","year":null},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:14.742393Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:129f469939a179e0a6014e3c39e06a02c74bccfc245ac007d0e5291079e4c522","observation_id":"b7a4d8c3-b6aa-4ea6-9bf3-7873dc08271b","resolution":{"observed_at":"2026-08-06T04:37:22.154806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:21.871301Z","title":"Gpt-4o system card, 2024","venue":null,"work_id":"10f37aec-1eda-4eda-af3c-8e8bd708415f","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:14.823714Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:7fb46330d9051ab3c0362bab61bd856d2cbb3f1fc10b1494ae7e45948760f02d","observation_id":"6798cdeb-609b-4171-9ccd-dd6020edeae4","resolution":{"observed_at":"2026-08-06T04:37:21.985813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:21.690157Z","title":null,"venue":null,"work_id":"5d1facd6-869c-4ec9-b185-d348edc3206a","year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:14.887211Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:633c281908ef87c5d4afc051f1a840c431136369248e9b28f5a4e155d2a11a6b","observation_id":"ec07a3f1-7fe1-46b1-8ca8-97ae041b8e9e","resolution":{"observed_at":"2026-08-06T04:37:21.778466Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:21.519475Z","title":"Transfer between modalities with metaqueries, 2025","venue":null,"work_id":"73459eb7-1f7e-4eae-8ae3-65a6fe21bc50","year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:14.963632Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:1941eabe1db466dc0bc718c84e761e0d88e84cb8d02b7fe1a5b240581173097f","observation_id":"edb74c67-82d8-4521-af61-c5ae113e2cf6","resolution":{"observed_at":"2026-08-06T04:37:21.595188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:21.339507Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis, 2023","venue":null,"work_id":"9f1d0676-3171-4904-a707-370b1074d2a4","year":2023},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:15.061823Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:73f72e776c91b04841b2868a1b18c2fe292e99c5738ffa39c9df532a664fa89e","observation_id":"6300a093-0beb-4b10-9488-3c69e3cdea02","resolution":{"observed_at":"2026-08-06T04:37:21.403942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:21.236584Z","title":"Du, Zehuan Yuan, and Xinglong Wu","venue":null,"work_id":"a84544cd-7022-4d47-aad7-fbfe75677f44","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:15.093736Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:c7b9cd567e807ad425ddab68c59ea478d4ea7020260482f62571043d61ddf53d","observation_id":"6ed35f91-a0a4-4982-a945-5d0d03df0ee3","resolution":{"observed_at":"2026-08-06T04:37:21.335571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:21.103575Z","title":"Qwen2.5 technical report, 2025","venue":null,"work_id":"cf833e2a-a947-4c6c-83ba-42b47f34b03e","year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:15.223351Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:8d7f9d1925c9d41a156c32c758df4b832b2759f2f19d38dfcf152d76916595c3","observation_id":"5ab9de3e-4638-4f54-98d0-067fd693ce5d","resolution":{"observed_at":"2026-08-06T04:37:21.185100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:20.966896Z","title":"Learning transferable visual models from natural language supervision, 2021","venue":null,"work_id":"b33143cd-af16-41e6-a21d-61c56126cf0a","year":2021},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:15.287812Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:8e7d53cf23ecf32d4597e6a6f27dd0c4b3608b49e2965bac2dbc990e9347272c","observation_id":"8f0adabe-9c79-474d-9ee8-8819afd98362","resolution":{"observed_at":"2026-08-06T04:37:21.042863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:20.839682Z","title":"High-resolution image synthesis with latent diffusion models, 2022","venue":null,"work_id":"8bda3291-dc42-43ce-b21c-03e0eb2a00ef","year":2022},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:15.379501Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:00228be9199d8dede6751e218b6c3fb4fc2e371aa9aa4eece3ff8bbc591546c9","observation_id":"b3f68411-61a3-4584-932c-c4a1c2fa6e27","resolution":{"observed_at":"2026-08-06T04:37:20.913859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:20.697872Z","title":null,"venue":null,"work_id":"cf8c1caa-2f1f-4672-81da-2e04eec1ed34","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:15.430371Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:5b4620501673bda5e6766736767d124ef13e5afa140c593a7949e998ae77bc46","observation_id":"544989da-0740-4ce6-9c7c-a4d75a25d427","resolution":{"observed_at":"2026-08-06T04:37:20.761822Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:20.520635Z","title":"Kingma, Abhishek Kumar, Stefano Ermon, and Ben Poole","venue":null,"work_id":"8af8011f-6471-44d0-baf1-ae3ce0599265","year":2021},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:15.510627Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:2d55de0ad855887308b5a116d0a04e349abd469277a1ddada3c608a356014e90","observation_id":"8a7cee7d-b595-4cf8-a7b3-2ca6af60c488","resolution":{"observed_at":"2026-08-06T04:37:20.608021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-06T04:37:15.549976Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:15.549976Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:ebcf235aaad84767183b455b881102426f1333251fc77d9b5871687770e6cb23","observation_id":"46bba553-8468-4013-8d4f-58220b6eb0f6","resolution":{"observed_at":"2026-08-06T04:37:15.549976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:20.371709Z","title":"Generative multimodal models are in-context learners, 2024","venue":null,"work_id":"ff958813-0d24-44e8-91c5-a2510ca9bced","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:15.617341Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:42c6d61bce08b8ff5001b31493244e91f72695ed1bac4b68eff2971559e329c9","observation_id":"dd52bc6a-46ac-4f73-b860-52362e50333c","resolution":{"observed_at":"2026-08-06T04:37:20.433212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:15.678202Z","title":"Siglip 2: Multilingual vision- language encoders with improved semantic understanding, localization, and dense features,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:15.678202Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:92b4a9b19ee9885e6078e311c9794cc0217c28aba1b3caf5afe6dc3c1c78f8aa","observation_id":"789e1a77-2dac-4524-bab1-1db716e531e3","resolution":{"observed_at":"2026-08-06T04:37:15.678202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:20.229813Z","title":"Neural discrete representation learning, 2018","venue":null,"work_id":"e8bed4bd-4ef9-4bab-b22a-76b7d40a340c","year":2018},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:15.740703Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:b8dd7319ebd5cd2dc0536b08b61f8444518a2c5805e0ef4fdf0d44a0c763d14c","observation_id":"ec280dbb-ef4f-438d-829c-c010c6866057","resolution":{"observed_at":"2026-08-06T04:37:20.277744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:20.060005Z","title":"Illume: Illuminating your llms to see, draw, and self-enhance, 2024","venue":null,"work_id":"c723192f-ba75-4692-a790-650cf0c08b61","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:15.823422Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:ac77eb094a0dc8e8c5f70b6754e0141be57602a809e57fc9813bef0c3cc9f254","observation_id":"5a988791-c7c1-4de8-b368-196e4746e428","resolution":{"observed_at":"2026-08-06T04:37:20.123409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:19.913528Z","title":"Ovis-u1 technical report, 2025","venue":null,"work_id":"5aa29219-cb43-4940-bea8-b24ccb99ee0e","year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:15.880569Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:1afb37c7db3e67d4311a60a39afc24e7ebc0a638816e05b5b737f9c77c99dd9b","observation_id":"96b58ce0-7310-431e-a985-3953a84e4be9","resolution":{"observed_at":"2026-08-06T04:37:19.956681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:19.782556Z","title":"Emu3: Next-token prediction is all you need, 2024","venue":null,"work_id":"7becd92a-1088-43e1-9307-0b668ee1aeb0","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:15.937622Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:03de665830bc6c4c4983896731e43ed50047b84e0b7b05464d7c4c5aa7962b2e","observation_id":"42ca0117-57b6-4151-ba24-06583934515a","resolution":{"observed_at":"2026-08-06T04:37:19.852119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:19.629631Z","title":"Janus: Decoupling visual encoding for unified multimodal understanding and generation, 2024","venue":null,"work_id":"76f7ac3a-ca21-4f5b-babd-07680db73b2f","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:16.026041Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:f2959663ce993d3a01fe1eee1f043edfba17e553da8cbfbe1701c5e95dd428bf","observation_id":"154322e2-a8a7-4799-9933-2f203cf05397","resolution":{"observed_at":"2026-08-06T04:37:19.706383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:19.529338Z","title":"Omnigen2: Exploration to advanced multimodal generation, 2025","venue":null,"work_id":"285c9be9-07d5-4acf-81da-9321d54e6897","year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:16.086323Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:184823815d73caa6a5bab9f8efbadeec9f1c99552a80c8408a18335fee86c115","observation_id":"827d3003-718c-493e-ba5b-fdc998e0dbd0","resolution":{"observed_at":"2026-08-06T04:37:19.589792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23661","last_updated":"2025-06-02T13:04:26Z","snapshot_observed_at":"2026-08-09T00:35:08.230205Z","submitted_at":"2025-05-29T17:09:44Z","title":"OpenUni: A Simple Baseline for Unified Multimodal Understanding and Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23661","snapshot_observed_at":"2026-08-06T04:37:16.161813Z","title":"Openuni: A simple baseline for unified multimodal understanding and generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:16.161813Z"},"links":{"cited_paper":"/paper/2505.23661","citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:1a72ae63e4ce74113429e75bfec29c534de23b684127032a7ef295a25755364a","observation_id":"2440898c-8e79-4572-8e74-09e812db5517","resolution":{"observed_at":"2026-08-06T04:37:16.161813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:19.394550Z","title":"Harmonizing visual representations for unified multimodal understanding and generation, 2025","venue":null,"work_id":"690d9707-07ed-49c1-a18a-c3f8ffaf50cc","year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:16.231109Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:d323face69dd2caef9188aacf48f6c100bf6e44e089db4185517130ecdb833ed","observation_id":"1c34bd2b-8879-42ce-b559-bf2add1b4836","resolution":{"observed_at":"2026-08-06T04:37:19.448029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:19.247160Z","title":"Human preference score v2: A solid benchmark for evaluating human preferences of text-to-image synthesis, 2023","venue":null,"work_id":"2c1d9a44-d86e-475f-bdd3-35b38b03fc82","year":2023},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:16.306194Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:23ec987663f5493627fa09a956b07dbca92f6b11c4e3dffec687b8de0c29c5b1","observation_id":"0b5e6aa0-90b0-4296-94ec-64b6aab783c0","resolution":{"observed_at":"2026-08-06T04:37:19.310639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:19.096858Z","title":"Vila-u: a unified foundation model integrating visual understanding and generation, 2025","venue":null,"work_id":"932357f4-b802-4fe7-9b02-5804a1e29d11","year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:16.391233Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:cc3b1a2345a05d1988d5f39a5a4193316c5a30b57b206b1ff209fbbcdc2ac9d6","observation_id":"d6301a93-b16f-4ba3-b8e1-10bd3215eaec","resolution":{"observed_at":"2026-08-06T04:37:19.175901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:18.991287Z","title":"Omnigen: Unified image generation, 2024","venue":null,"work_id":"0be525bc-7ed6-492a-9b99-2ad1ae7dfdd5","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:16.494447Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:a87834a13bb470aea3f7b2d28757ed1035858b1d725cab287c41f916571dcc3f","observation_id":"046282a6-2ca7-4d73-a323-b4099931dc71","resolution":{"observed_at":"2026-08-06T04:37:19.044625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:18.894743Z","title":"Show-o: One single transformer to unify multimodal understanding and generation, 2024","venue":null,"work_id":"370f24b7-a05f-4bbf-a8f7-597de4ff0e98","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:16.594819Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:564c032cdbdcf340b4719ab77dcbdb29a5bec7b4a16eba0a955b48d34167dfe1","observation_id":"5ad7af79-4f04-4ea3-b2d5-d6eb34a7abc7","resolution":{"observed_at":"2026-08-06T04:37:18.935800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:16.701927Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:16.701927Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:1a8e6baa44157724c23dc96a1a8f46a1a762f962290039b8a24d36abd491e82b","observation_id":"124a73ff-99fa-40c1-adf5-8f06137714b3","resolution":{"observed_at":"2026-08-06T04:37:16.701927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:18.760367Z","title":"1.58-bit flux, 2024","venue":null,"work_id":"71ce1a4b-1a8e-4e6b-9872-1ace391a056b","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:16.764209Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:8b57c84c87921a6e812e583884c3a3822679d21ebd4df06e4c0bd36e354476f8","observation_id":"ae7e7112-a6a6-4a43-b523-2e24afb06761","resolution":{"observed_at":"2026-08-06T04:37:18.817586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:18.640427Z","title":"Imgedit: A unified image editing dataset and benchmark, 2025","venue":null,"work_id":"18f59da3-3994-4d0f-b5ed-d69e4b862d0e","year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:16.843001Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:c540a895c56082b340cd0d3351b7c116b1c5b37f8ce225486aa146b0bdd92135","observation_id":"67739b13-640a-4c06-90eb-51c7678e4c97","resolution":{"observed_at":"2026-08-06T04:37:18.702970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:18.517267Z","title":"Sigmoid loss for language image pre-training, 2023","venue":null,"work_id":"57e60dd8-41f0-423d-9d7d-75ae8cb2479e","year":2023},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:16.970273Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:e456a507a1b49cfdc853e0ad614cadee8ee38ab5885dfe91ee8a67a8cad10e50","observation_id":"7e166349-45cb-48a7-8e2d-5a050f248710","resolution":{"observed_at":"2026-08-06T04:37:18.566607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:18.363000Z","title":"Magicbrush: A manually annotated dataset for instruction-guided image editing, 2024","venue":null,"work_id":"6eb11921-e6c1-4037-a308-5e840ef6e0f8","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:17.099744Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:9e6153ed4621957238818405e58a080e0e3b4b053216d915f8cb89363605065e","observation_id":"017486b4-66ff-4c6b-b9d7-5b2344b4d228","resolution":{"observed_at":"2026-08-06T04:37:18.437460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:18.252087Z","title":"In-context edit: Enabling instructional image editing with in-context generation in large scale diffusion transformer, 2025","venue":null,"work_id":"ecd0f4d7-d467-44e9-823c-154ff8b2ed70","year":2025},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:17.236797Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:a119fe07e5c44cc94207eab5cc7452c4fc705d69e14459e75b3aaa9faf3d92ff","observation_id":"bf17f735-081b-471e-8c8b-e0838cd5f229","resolution":{"observed_at":"2026-08-06T04:37:18.311784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:18.052247Z","title":"Ultraedit: Instruction-based fine-grained image editing at scale, 2024","venue":null,"work_id":"8a4c8454-d116-4d92-a520-5b38eab69a68","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:17.364639Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:52ce445542e93f456de545e8b534f83d1f5bf2118d0503df375a7a89b5063678","observation_id":"84d2ef48-a026-4bc6-97b2-18a099f1445e","resolution":{"observed_at":"2026-08-06T04:37:18.158911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:17.853393Z","title":"Transfusion: Predict the next token and diffuse images with one multi-modal model, 2024","venue":null,"work_id":"cbb6db7c-8115-471a-ae15-69ae36373e9b","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:17.424329Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:2735e944e1115739af9d858dbac7ad75092cbd898d942271b748f84aa8ea1812","observation_id":"5e7e1418-2ba1-4ac8-af1b-f2e8234548e1","resolution":{"observed_at":"2026-08-06T04:37:17.955095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:37:17.636423Z","title":"Lumina-next: Making lumina-t2x stronger and faster with next-dit, 2024","venue":null,"work_id":"9ba64c9b-6880-426b-96cb-dc44128c6e6d","year":2024},"citing_paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T04:37:17.479761Z"},"links":{"citing_paper":"/paper/2508.03320"},"observation_digest":"sha256:f4032000eac44e1b4f88c58d0ecd31162e8b5015d1655059cd04df18d6ef7435","observation_id":"ee94624c-488c-4bd6-b19a-17539b931a1c","resolution":{"observed_at":"2026-08-06T04:37:17.750439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.03320","last_updated":"2025-08-05T10:59:01Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T00:35:31.197661Z","submitted_at":"2025-08-05T10:59:01Z","title":"Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":53},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 5 inbound Pith citation observations for arXiv:2508.03320."}