{"as_of":"2026-08-11T11:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ee1c58a7d1878bb2e4ea860173164eae807fabeee5a5a6ec3b7b4a4aca32d62f","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:30:27.240877Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:54:24.937137Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:39:51.542556Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"cited_work":{"arxiv_id":"2506.07963","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07963","snapshot_observed_at":"2026-07-04T13:39:51.542556Z","title":"Reinforcing multimodal understanding and generation with dual self-rewards","venue":null,"work_id":"270a7335-8aca-4660-a34a-625b9b71dff3","year":2025},"citing_paper":{"arxiv_id":"2509.08827","last_updated":"2025-10-09T17:08:52Z","snapshot_observed_at":"2026-08-06T15:38:05.011922Z","submitted_at":"2025-09-10T17:59:43Z","title":"A Survey of Reinforcement Learning for Large Reasoning Models","version":3},"reference_index":197,"source":"arxiv_source","source_observed_at":"2026-05-18T00:02:24.352947Z"},"links":{"cited_paper":"/paper/2506.07963","citing_paper":"/paper/2509.08827"},"observation_digest":"sha256:c0884674c3ea49b13b498e008e57224e207724aa5d67da1ff08864e4ef1466b5","observation_id":"2fe94ad2-fdfa-4a8c-9c70-8019974e7869","resolution":{"observed_at":"2026-05-18T00:05:31.604172Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07963","snapshot_observed_at":"2026-08-04T09:54:24.937137Z","title":"Reinforcing mul- timodal understanding and generation with dual self-rewards.arXiv preprint arXiv:2506.07963,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.12784","last_updated":"2026-06-28T11:09:54Z","snapshot_observed_at":"2026-08-04T09:54:23.338683Z","submitted_at":"2025-10-14T17:56:11Z","title":"SRUM: Fine-Grained Self-Rewarding for Unified Multimodal Models","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T09:54:24.937137Z"},"links":{"cited_paper":"/paper/2506.07963","citing_paper":"/paper/2510.12784"},"observation_digest":"sha256:ce9d8b09632a48d9cffa2862bf16c0c28de45d95acb7bf2285e0c9baa4a8c823","observation_id":"7b72bc66-ff7d-4a96-9026-21567ceda278","resolution":{"observed_at":"2026-08-04T09:54:24.937137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"cited_work":{"arxiv_id":"2506.07963","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07963","snapshot_observed_at":"2026-07-04T13:39:51.542556Z","title":"Reinforcing multimodal understanding and generation with dual self-rewards","venue":null,"work_id":"270a7335-8aca-4660-a34a-625b9b71dff3","year":2025},"citing_paper":{"arxiv_id":"2606.27376","last_updated":"2026-06-25T17:59:57Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:59:57Z","title":"Ask, Solve, Generate: Self-Evolving Unified Multimodal Understanding and Generation via Self-Consistency Rewards","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T04:58:15.891214Z"},"links":{"cited_paper":"/paper/2506.07963","citing_paper":"/paper/2606.27376"},"observation_digest":"sha256:3cc429759fccda30081c15810e274d16fb82d96fa0e6b627657bff1738214841","observation_id":"f617798e-60c8-40fd-88a7-fcdb4c02904d","resolution":{"observed_at":"2026-07-04T13:39:51.544735Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07963/citation-record","integrity":"/paper/2506.07963/integrity","json":"/paper/2506.07963/citation-record.json","paper":"/paper/2506.07963"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.192900Z","title":null,"venue":null,"work_id":"a75b9e3b-3de0-4313-aab6-8da5a2b9ef70","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.928846Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:32ae6417b894b37179ee0d255c5bebc673c2dcd4a3e2addc8198e497929877f9","observation_id":"34e31048-d3a1-4dbf-9d6a-5892834d9ee3","resolution":{"observed_at":"2026-08-07T05:30:28.197768Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-07T05:30:26.934199Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.934199Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:7537621d0c39ba7f1fe2b01a851001b0f46d5b4c364c3f24e3235837b2001a61","observation_id":"030bf8b5-b31c-4f67-a578-be7f28a15ce5","resolution":{"observed_at":"2026-08-07T05:30:26.934199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T05:30:26.939490Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.939490Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:27138c498e3250656d6319510ef017e628d6407708e95ae7a4579a1b66d3ff30","observation_id":"476e7ccf-7c3a-451d-a10d-6cbd6e7fccfb","resolution":{"observed_at":"2026-08-07T05:30:26.939490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:26.944775Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.944775Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:542e2af2b7c6d5c3cb565aaf7642374e5c78fc28e38a84efe073e2ffe8e532dd","observation_id":"bb092b5f-e680-4bca-ad89-a86b000b4bd7","resolution":{"observed_at":"2026-08-07T05:30:26.944775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.167907Z","title":null,"venue":null,"work_id":"7abfef44-bae4-4bce-ae3b-125e858b963f","year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.949807Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:6182336c8749790de412674da12d4d1544538448c495e17d8077fcb1856e4f5a","observation_id":"39545832-955e-442e-8d82-e5ce221c45f4","resolution":{"observed_at":"2026-08-07T05:30:28.173054Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.153846Z","title":null,"venue":null,"work_id":"5f0ba7b4-0013-49a0-8364-8b5d18e6074b","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.954721Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:655a5525747632e706df54e57d0997ee434e43c7d7187a749df186b034da9e38","observation_id":"f5695d3b-42fe-4661-9800-339c91ac2dba","resolution":{"observed_at":"2026-08-07T05:30:28.158281Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17811","last_updated":"2025-01-29T18:00:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-29T18:00:19Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17811","snapshot_observed_at":"2026-08-07T05:30:26.960872Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.960872Z"},"links":{"cited_paper":"/paper/2501.17811","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:9f4f99a7f3bc97ebb54f3f2b6030634b67b4766da47034900ff191a8b19c0e8c","observation_id":"f66c0f2e-a84a-4991-b9ed-9f51a6d12c29","resolution":{"observed_at":"2026-08-07T05:30:26.960872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.139272Z","title":null,"venue":null,"work_id":"19c82da5-7500-41f6-b069-f1a5d5fe2c51","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.965722Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:718a2cac3c61d3b1988f6a76cb363c8c83de107f47d5b1a4bc064d9c52b9eaec","observation_id":"b9fda4c4-1c7e-457c-9ebd-83b4312d8a5a","resolution":{"observed_at":"2026-08-07T05:30:28.144043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.124209Z","title":null,"venue":null,"work_id":"8a0710ba-dcac-468d-aac3-176e40b42900","year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.971313Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:355b2dbca8f26ead5cea834d27aa49387bf6c2165c16fa57c2f9b8ac356f7044","observation_id":"6f8447af-42b3-4a09-9334-d6f56246f97a","resolution":{"observed_at":"2026-08-07T05:30:28.129436Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.108219Z","title":null,"venue":null,"work_id":"ebce2169-7c58-4308-a440-3e869e681ec1","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.975940Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:e52cad96674e36a3249123380e9c494bf19c1286accbce430b0c7b1578c4a90b","observation_id":"5e2e6c19-fee8-4a54-aaa2-8aa0b24ca236","resolution":{"observed_at":"2026-08-07T05:30:28.113226Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.092243Z","title":null,"venue":null,"work_id":"b1006391-ae3a-435a-9963-ad56918fcc82","year":2021},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.980833Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:d8a2d6360879fb1cb3e62f0036a84e6c86d628e0d149af43a04196fb130e0035","observation_id":"66ffc0c5-a7e5-4aea-9ed5-6e0e1b0cb54a","resolution":{"observed_at":"2026-08-07T05:30:28.096940Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.05032","last_updated":"2023-02-28T23:46:24Z","snapshot_observed_at":"2026-08-10T14:28:11.482404Z","submitted_at":"2022-12-09T18:30:24Z","title":"Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.05032","snapshot_observed_at":"2026-08-07T05:30:26.985271Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.985271Z"},"links":{"cited_paper":"/paper/2212.05032","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:ab6e2244cedce045a490908c27ad6e255449ec06c1f0042dbb09a29317df1803","observation_id":"c05877b1-550a-4e8b-b27c-de10ba4401f1","resolution":{"observed_at":"2026-08-07T05:30:26.985271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14396","last_updated":"2025-03-02T07:53:44Z","snapshot_observed_at":"2026-07-06T18:03:51.687441Z","submitted_at":"2024-04-22T17:56:09Z","title":"SEED-X: Multimodal Models with Unified Multi-granularity Comprehension and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14396","snapshot_observed_at":"2026-08-07T05:30:26.990200Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.990200Z"},"links":{"cited_paper":"/paper/2404.14396","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:86da0e9c65f4cb6fba1173e5c596cf2bce5bdb1cf8a34dac1332e276ca64efc6","observation_id":"049a9ad0-4ba2-479a-a5f7-faee30561381","resolution":{"observed_at":"2026-08-07T05:30:26.990200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.077194Z","title":null,"venue":null,"work_id":"7982d417-8de2-43cc-9b62-4023322e2dab","year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:26.994948Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:d4d0b0fd5213dbe7bf069a0536966f75d78cf8298efb4ebbea415c5f1dbbc40f","observation_id":"9549833c-2741-48fd-bcd2-f517171612cf","resolution":{"observed_at":"2026-08-07T05:30:28.081911Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.062321Z","title":null,"venue":null,"work_id":"cdccb995-b707-43e0-906e-13b90e9347c3","year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.000145Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:dfd2c581fbdbd18ce3ed54c78fa9e65bce3be8290ace85d885fe94ab4955d3ce","observation_id":"152d9bfd-1b77-45e7-81d2-df9a777c97be","resolution":{"observed_at":"2026-08-07T05:30:28.067245Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.047721Z","title":null,"venue":null,"work_id":"9b7d2e35-5f16-4585-ae04-00d875a33eb9","year":null},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.005060Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:85c51b981906cf00f86a61a91899c83c39cf28932fca03b123e5e73d89b2fb4f","observation_id":"b8526ddb-73f2-469d-adfb-ae8cb4489e75","resolution":{"observed_at":"2026-08-07T05:30:28.052371Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00703","last_updated":"2025-07-01T11:46:57Z","snapshot_observed_at":"2026-08-07T20:35:00.460457Z","submitted_at":"2025-05-01T17:59:46Z","title":"T2I-R1: Reinforcing Image Generation with Collaborative Semantic-level and Token-level CoT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00703","snapshot_observed_at":"2026-08-07T05:30:27.014921Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.014921Z"},"links":{"cited_paper":"/paper/2505.00703","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:4ba81ee1d70bebc740fb79e18f3465ef44e13f3d67451e4e8b43437cda14886d","observation_id":"178dfa81-561c-42dd-8a3c-99f3cbd1dca0","resolution":{"observed_at":"2026-08-07T05:30:27.014921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:28.032803Z","title":null,"venue":null,"work_id":"de61b8ed-6a83-4b52-931e-28edc3ce181f","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.019805Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:af21ee39d2da7a12c632ab80807d1268b7077d770cdd1c162a8c9ce1656a0138","observation_id":"e11f9d04-2253-495d-a522-fc5df98a9761","resolution":{"observed_at":"2026-08-07T05:30:28.037690Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.024116Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.024116Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:9e3df861c3b86e5588312273fbe9ddd906302e8b5815ee386c719f42c2032d0b","observation_id":"1916b5cd-270c-4049-9fe7-74bbef8778db","resolution":{"observed_at":"2026-08-07T05:30:27.024116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.028909Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.028909Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:42c6585710bb8592141f14e00337b41c3ddb89b16c4b6dd409f089ff3497f93d","observation_id":"0e05fe86-6b9a-404b-bac2-c61e4d0707ee","resolution":{"observed_at":"2026-08-07T05:30:27.028909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-07T05:30:27.033266Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.033266Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:88fad3540256c0b097a9ee5bdda028c44bf9ec1aa0922a7eb6910d239bb81939","observation_id":"01e38c16-6906-4a5d-964b-345271d45717","resolution":{"observed_at":"2026-08-07T05:30:27.033266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.998589Z","title":null,"venue":null,"work_id":"45041528-8335-4a53-a3b0-ff9695da100a","year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.037679Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:7b675a2dda877b9e2660cb660db781f3098267db7acb095a307a21fc6e229872","observation_id":"effd4c6d-cb0a-460d-abea-bc7c97d5b6e5","resolution":{"observed_at":"2026-08-07T05:30:28.003881Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00289","last_updated":"2025-04-01T19:09:34Z","snapshot_observed_at":"2026-08-10T22:52:06.844699Z","submitted_at":"2024-12-31T05:49:00Z","title":"Dual Diffusion for Unified Image Generation and Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00289","snapshot_observed_at":"2026-08-07T05:30:27.042171Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.042171Z"},"links":{"cited_paper":"/paper/2501.00289","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:2b9ec50b2fa236c53a5bbdbaf6caec559b091e975f1c914d9ba06cde267ddba6","observation_id":"b74913d7-a687-49da-bcfd-170f68407a83","resolution":{"observed_at":"2026-08-07T05:30:27.042171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.047061Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.047061Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:cc4d0776d489471c3ac699fbd84c3fb113a8f49eaa70ba9e65271021a56cccc8","observation_id":"e153f12d-2664-414a-812b-58be4ac2903f","resolution":{"observed_at":"2026-08-07T05:30:27.047061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.051526Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.051526Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:c6aae725f2afcb7524c0df60192b7a57f98101ed70312b406fedbd7ff3625817","observation_id":"62d1c41c-1cf1-4d21-a775-9b18b17991ff","resolution":{"observed_at":"2026-08-07T05:30:27.051526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.056021Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.056021Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:3f3056469160e0d92ff2beb06e1cd9d305de753f7a342c1641e101ca98384f76","observation_id":"c98c7cb2-aeaa-4896-8cef-475a5211411e","resolution":{"observed_at":"2026-08-07T05:30:27.056021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.956020Z","title":null,"venue":null,"work_id":"3d67ef20-d725-4adc-b5ec-1ea613db54a2","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.060265Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:c1f35b5410f1238be5b12b369a26928c6f27b4e0d92481a08c0aede236f7e4ac","observation_id":"5126711a-d8f7-42b9-a1ab-4f7d04482d9b","resolution":{"observed_at":"2026-08-07T05:30:27.960574Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.941242Z","title":null,"venue":null,"work_id":"03ca63b4-1585-424e-b6ff-6d21a6359539","year":2022},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.065128Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:b6c4a78e92632165ac31cfe2e14d44fa6b2ee6a38eb8a5f4b9098d3261e58ab7","observation_id":"6cc3d5e4-6c41-4baa-b85a-b035356585b0","resolution":{"observed_at":"2026-08-07T05:30:27.945919Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.926571Z","title":null,"venue":null,"work_id":"3f5072a1-d8d4-41ba-82f2-723878282617","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.069704Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:159ce13ade98ab6f4b5f86003c61835192230175b6aa00bc7d0c2e2caf3affbf","observation_id":"83a12574-4bac-483a-94b9-b89428aeec13","resolution":{"observed_at":"2026-08-07T05:30:27.931317Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-11T01:38:59.827005Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-07T05:30:27.074181Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.074181Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:5f75d2c7a721cdded35c208d9f8e214c475747cbde3868a7a38ec9c1115a1cf4","observation_id":"27be12df-04bf-49ef-a6dd-9370d2b9bd23","resolution":{"observed_at":"2026-08-07T05:30:27.074181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.911808Z","title":null,"venue":null,"work_id":"d60187d1-d24c-458b-9896-86a709152a57","year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.078965Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:a7ab09bfae5491643fd691d814842556e9ac8fa58f44280fc6315362a2a49c0a","observation_id":"b416e6a3-2ec0-43c8-b9e5-f6ae9822a562","resolution":{"observed_at":"2026-08-07T05:30:27.916308Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.083321Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.083321Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:5ba55d7400f13ae50f51c5e119b0d2c64977963740c68c5e119bb44ac7221ab1","observation_id":"72e653b7-f105-4d20-ba0d-a85145ae492d","resolution":{"observed_at":"2026-08-07T05:30:27.083321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.888809Z","title":null,"venue":null,"work_id":"10000659-f40e-400c-a04f-6a12aad7c35b","year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.088748Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:632db0a79cee0b96f898ee7c86a59b46dcbf808718204f45d4c59f89db909778","observation_id":"07f768bd-9e98-4005-90c1-90ed1f1de104","resolution":{"observed_at":"2026-08-07T05:30:27.893081Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.874269Z","title":null,"venue":null,"work_id":"b0c90da0-7d96-4476-9311-a499adfa113a","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.093709Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:3bc2985f7bae02bea080d2c862db445964f700e396116bbf15d27e8fa8f1476d","observation_id":"3dff539c-e43e-4b39-a19c-e752418731de","resolution":{"observed_at":"2026-08-07T05:30:27.878873Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-07T05:30:27.098652Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.098652Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:57a4f3dfb1416c69e366b0dd4a97396f0def57f3fb9615f3aa80d63481f4224e","observation_id":"1fd6c9af-f1c7-4e89-b4c3-9437bf9f51e2","resolution":{"observed_at":"2026-08-07T05:30:27.098652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05818","last_updated":"2025-03-24T23:22:02Z","snapshot_observed_at":"2026-08-09T13:50:16.627693Z","submitted_at":"2024-12-08T05:28:08Z","title":"SILMM: Self-Improving Large Multimodal Models for Compositional Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":"2412.05818","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.05818","snapshot_observed_at":"2026-08-07T05:30:27.496049Z","title":"SILMM: Self-Improving Large Multimodal Models for Compositional Text-to-Image Generation","venue":"cs.CV","work_id":"d802f4af-7487-41f2-b805-9e3a96190a2c","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.103280Z"},"links":{"cited_paper":"/paper/2412.05818","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:9cdc9bb0326029d288aeda1114e894277ed720686c342b8bdf5e4455eb63adc3","observation_id":"a6bdf839-3534-404d-a26d-b0076853d7a6","resolution":{"observed_at":"2026-08-07T05:30:27.503745Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.860156Z","title":null,"venue":null,"work_id":"fd6e1542-c77f-47c2-8005-47879ad7fa77","year":2021},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.107881Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:87663bb9cc7bd3f73b28237bc8092dab5372313c6d8d87ebd7e117f8173d445e","observation_id":"b677b4c3-48ab-4d87-847f-422ddf6996c3","resolution":{"observed_at":"2026-08-07T05:30:27.864651Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.112713Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.112713Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:3d9e4eecb19acd5d73164dbc3fb55667aec735789723cf32fbbd76104a28cdb1","observation_id":"48cd6510-b10f-4df2-b7f5-8c3075e3e33c","resolution":{"observed_at":"2026-08-07T05:30:27.112713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.117606Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.117606Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:3ef5827b62a27c31d0c59c3cb1aed896562f6c9037037eb9ef883bba74889763","observation_id":"e28f5d81-0f6a-46fb-bf91-c583282c3836","resolution":{"observed_at":"2026-08-07T05:30:27.117606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.826862Z","title":null,"venue":null,"work_id":"9c724756-fb11-4692-8d30-502ea6b2bbe3","year":2022},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.126900Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:64fa7867d0b6c83f242e9770b20c1964ce3bab639b2db9a19fa6593a2e14aab7","observation_id":"5fe7815c-4c28-4f19-9bb1-148063d24c0e","resolution":{"observed_at":"2026-08-07T05:30:27.831519Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T05:30:27.131912Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.131912Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:6584dd0383a8373efcacb487943e45975f0e9f0f287d9d9b5dd714d9bf4f31ab","observation_id":"3628d465-384c-40c4-b3fb-ec01a9a60451","resolution":{"observed_at":"2026-08-07T05:30:27.131912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.812199Z","title":null,"venue":null,"work_id":"86f1cfff-43a0-4a00-a430-e290f2bc0e9a","year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.137164Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:2b91d1b9c08bcfe6d371b809b59963c314ac0ba698164a9bf14e01a6d1ea07e4","observation_id":"d83006e3-c772-498c-a0c0-28521e5da2bc","resolution":{"observed_at":"2026-08-07T05:30:27.816871Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.797038Z","title":null,"venue":null,"work_id":"e220109d-972c-4713-8cb9-3ff99cf1833a","year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.142267Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:fb634c4f9f76c97cdc981f26676ab83abcd57b21ea0a3f2be0cbf538003a9c1a","observation_id":"4d50a96b-3af2-4a9c-834d-43bea0ecca57","resolution":{"observed_at":"2026-08-07T05:30:27.801911Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-07T05:30:27.146722Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.146722Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:2ddcd08efb4c45c0afa371dc304690d9dae4dc25085a1d8e56f4036d68e4799e","observation_id":"8903f20c-529f-4f42-a8b1-ed7715ef63b0","resolution":{"observed_at":"2026-08-07T05:30:27.146722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.151759Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.151759Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:4969659c7a18abf87f5406ef1a603c2aec993ba14b66df3f372afba974b92fb5","observation_id":"d61d2a31-dcf0-4c6a-b518-06fcf2588a83","resolution":{"observed_at":"2026-08-07T05:30:27.151759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.771771Z","title":null,"venue":null,"work_id":"ee67b481-de52-40d8-9e8c-a87dbb6659e1","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.156139Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:463aca063ce78a9af118ee36560741b50f55e35c8d16e3ae6c3032cf7118116e","observation_id":"0e3b3c1a-db97-4757-affb-f25f766bf9bc","resolution":{"observed_at":"2026-08-07T05:30:27.776772Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.756478Z","title":null,"venue":null,"work_id":"ea998b9d-c494-4eaa-a054-269217a4794a","year":2017},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.160476Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:acc1e1c167672db3d9a829be81d77428201b0e96c9d5e0eb37f597d1ba16dd43","observation_id":"89edf2a4-b34e-4127-8ac3-2f4475933e0d","resolution":{"observed_at":"2026-08-07T05:30:27.761861Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06673","last_updated":"2024-12-09T17:11:50Z","snapshot_observed_at":"2026-07-06T20:04:01.034597Z","submitted_at":"2024-12-09T17:11:50Z","title":"ILLUME: Illuminating Your LLMs to See, Draw, and Self-Enhance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06673","snapshot_observed_at":"2026-08-07T05:30:27.164874Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.164874Z"},"links":{"cited_paper":"/paper/2412.06673","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:6e57593de4a73cce76fe5cd426a3e2368e53ba0ec2556b3c95575f5ef0156111","observation_id":"55b058cf-fc10-4d8d-8c92-7e0ebf2249d5","resolution":{"observed_at":"2026-08-07T05:30:27.164874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11455","last_updated":"2025-04-15T17:59:46Z","snapshot_observed_at":"2026-08-08T11:00:06.035456Z","submitted_at":"2025-04-15T17:59:46Z","title":"SimpleAR: Pushing the Frontier of Autoregressive Visual Generation through Pretraining, SFT, and RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11455","snapshot_observed_at":"2026-08-07T05:30:27.169774Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.169774Z"},"links":{"cited_paper":"/paper/2504.11455","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:a5579eea9a57ee98829ac7e4ef349a11dd5be41e5ec49742c1e4e26a7cf8d83b","observation_id":"1df0a6a2-8f98-49df-a235-21116094180c","resolution":{"observed_at":"2026-08-07T05:30:27.169774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-07T05:30:27.174501Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.174501Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:8ca65d610bfc18330c5d5c6bf220daf76d7ea4c3775d96c51e778cf417df69d2","observation_id":"3250fd9a-198b-4e96-ab3b-6c82dbca1af2","resolution":{"observed_at":"2026-08-07T05:30:27.174501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13848","last_updated":"2024-10-17T17:58:37Z","snapshot_observed_at":"2026-08-03T03:16:45.693966Z","submitted_at":"2024-10-17T17:58:37Z","title":"Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13848","snapshot_observed_at":"2026-08-07T05:30:27.178910Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.178910Z"},"links":{"cited_paper":"/paper/2410.13848","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:f2481e16cab0be7a09c202727f52e74d694ad41382c79113a44f1bd778ebfdf6","observation_id":"8a602248-88e9-4179-af84-35c9e7f88507","resolution":{"observed_at":"2026-08-07T05:30:27.178910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.739235Z","title":null,"venue":null,"work_id":"763b5b50-a12b-4815-a679-463d34b178c3","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.183828Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:c963fac5f5ed82f94f7e2baa47c91fcdb111e0afdea9e42e1dd2b2e0121500fa","observation_id":"ca31300d-1de9-4318-b41e-fbd39d46a64b","resolution":{"observed_at":"2026-08-07T05:30:27.744102Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04429","last_updated":"2025-03-04T16:31:57Z","snapshot_observed_at":"2026-08-01T23:38:04.510222Z","submitted_at":"2024-09-06T17:49:56Z","title":"VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04429","snapshot_observed_at":"2026-08-07T05:30:27.188204Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.188204Z"},"links":{"cited_paper":"/paper/2409.04429","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:80f76ccafbb0fd1006e9747400d4499d6aef8e7736f71ef9c8bf4ceac9b64b27","observation_id":"94835a3c-4fb9-4b76-aa5d-61e8fcc7bc79","resolution":{"observed_at":"2026-08-07T05:30:27.188204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-07T05:30:27.192673Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.192673Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:ad90ef000e2b19809f6208aa4c10603ec33901f0e23cecbc71ca881dd8c9a278","observation_id":"3b852fb8-cf91-4dbd-8c73-f0113944ef29","resolution":{"observed_at":"2026-08-07T05:30:27.192673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-07T05:30:27.197315Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.197315Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:4618c64bb125917b9d70af8ac7d15d6cf65af9a3e866e75d32f7dcb843908b42","observation_id":"f81772fb-3b25-4026-8d2a-e621ad33bdac","resolution":{"observed_at":"2026-08-07T05:30:27.197315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19335","last_updated":"2024-05-29T17:59:58Z","snapshot_observed_at":"2026-08-10T15:58:13.136808Z","submitted_at":"2024-05-29T17:59:58Z","title":"X-VILA: Cross-Modality Alignment for Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19335","snapshot_observed_at":"2026-08-07T05:30:27.201831Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.201831Z"},"links":{"cited_paper":"/paper/2405.19335","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:3c3c19c903e83ffb3ea2186f0b557ebfed7ded12f0cef419ffa1dc2fe9bc477b","observation_id":"3ba61ad1-768a-456e-a447-82f18c302af3","resolution":{"observed_at":"2026-08-07T05:30:27.201831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.724989Z","title":null,"venue":null,"work_id":"ace352f5-c31b-41d8-b679-d2cfafa2632e","year":null},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.207074Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:f4b9123cbb078674544fac0dc877e78316919f407006413105a9a3dd5a629c89","observation_id":"4124d818-2734-43a4-84d0-a5b0249efae7","resolution":{"observed_at":"2026-08-07T05:30:27.729510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.710237Z","title":null,"venue":null,"work_id":"be93459a-0cc5-4ea9-826b-9db3c6c57b1d","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.215968Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:26f10fe63a32096eb00273599ab6998050dabbe9ebef4cbfc7502bcdbc560f31","observation_id":"63e370f3-1875-452c-a273-bd578bf6d1e1","resolution":{"observed_at":"2026-08-07T05:30:27.715018Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.694793Z","title":"Ma, Simon Stepputtis, Deva Ra- manan, Russ Salakhutdinov, Louis-Philippe Morency, Katia P","venue":null,"work_id":"1e9519c5-b208-47c3-a987-1a3b114900d7","year":2025},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.220358Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:0382ac858d17936c5763f0ae18bfa85ab3cdacba9fa180440aea9268985315bc","observation_id":"2bf5185c-f9e2-4da1-8942-3f2e49ad5ced","resolution":{"observed_at":"2026-08-07T05:30:27.699828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12216","last_updated":"2025-06-03T17:02:25Z","snapshot_observed_at":"2026-08-07T16:01:44.170215Z","submitted_at":"2025-04-16T16:08:45Z","title":"d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12216","snapshot_observed_at":"2026-08-07T05:30:27.225291Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.225291Z"},"links":{"cited_paper":"/paper/2504.12216","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:2f194be6cf7be07a5e8fe9572573cd7737cece2a6c8cda23e707351452080871","observation_id":"0b9288bf-20e8-44f4-9836-6d28f7abcf2e","resolution":{"observed_at":"2026-08-07T05:30:27.225291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16839","last_updated":"2024-02-06T16:43:31Z","snapshot_observed_at":"2026-08-08T04:17:23.797697Z","submitted_at":"2023-11-28T14:54:37Z","title":"Beyond Hallucinations: Enhancing LVLMs through Hallucination-Aware Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16839","snapshot_observed_at":"2026-08-07T05:30:27.230749Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.230749Z"},"links":{"cited_paper":"/paper/2311.16839","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:a6040c43d5b379976c8cd270c9f794b7c7fc7dc3c88b86a65084cc724eb3312c","observation_id":"ff90e7cc-102a-4ecf-8603-1ea2061cff47","resolution":{"observed_at":"2026-08-07T05:30:27.230749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11039","last_updated":"2024-08-20T17:48:20Z","snapshot_observed_at":"2026-08-11T01:34:46.484513Z","submitted_at":"2024-08-20T17:48:20Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11039","snapshot_observed_at":"2026-08-07T05:30:27.235770Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.235770Z"},"links":{"cited_paper":"/paper/2408.11039","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:1572488d26e1206e1b9ff588fec599f06e4ddc49717c207e611d7369e9351e4a","observation_id":"4b54aed6-a1ab-4e57-8c64-3aa90cfc3690","resolution":{"observed_at":"2026-08-07T05:30:27.235770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:30:27.680174Z","title":"M\" and an","venue":null,"work_id":"0387d3d5-b277-48f6-82df-bc90c0b7bd6a","year":2024},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.240877Z"},"links":{"citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:9a318944fd1fa4f2c0b2c92de56ef4f0e350897374dd4f9de4f514eda3fa76f6","observation_id":"cf990229-2d9f-4505-b12e-178a493f4849","resolution":{"observed_at":"2026-08-07T05:30:27.684850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-07T05:30:27.122335Z","title":"arXiv preprint arXiv:2204.06125 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.122335Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:4c2f820b8b5b95573baa1fd5bc52c1c5d426ae78db143f2f6934c03b516fc5a2","observation_id":"8d0e7ef2-0718-41e0-8959-14284f5f9385","resolution":{"observed_at":"2026-08-07T05:30:27.122335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15838","last_updated":"2024-12-30T07:27:58Z","snapshot_observed_at":"2026-08-11T11:01:03.492003Z","submitted_at":"2024-12-20T12:27:16Z","title":"Align Anything: Training All-Modality Models to Follow Instructions with Language Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15838","snapshot_observed_at":"2026-08-07T05:30:27.009844Z","title":"arXiv:2412.15838 [cs.AI] https://arxiv.org/abs/2412.15838","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.009844Z"},"links":{"cited_paper":"/paper/2412.15838","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:adce32f86c90a04f2cdcc271d7e935a45528fa352def6d96afaf8dbb91aaf21e","observation_id":"41965ca6-c991-4de9-88d5-55ec184c603d","resolution":{"observed_at":"2026-08-07T05:30:27.009844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-07T05:30:27.211480Z","title":"arXiv:2503.14476 [cs.LG] https://arxiv.org/abs/2503.14476","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:27.211480Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2506.07963"},"observation_digest":"sha256:9ea46c4ec3ac542710fe646dd0bba389efac37d1d41f94b108c634e6bf7e1a77","observation_id":"1605fb19-019b-4012-bcce-2f1da7f47d0e","resolution":{"observed_at":"2026-08-07T05:30:27.211480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.07963","last_updated":"2025-09-08T14:31:08Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T20:38:55.415021Z","submitted_at":"2025-06-09T17:38:45Z","title":"SUDER: Self-Improving Unified Large Multimodal Models for Understanding and Generation with Dual Self-Rewards"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":63,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 3 inbound Pith citation observations for arXiv:2506.07963."}