{"as_of":"2026-08-16T07:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:93d02d305fad21d9c6c02fa8354ee0a4727155962eed6013936d4341dd2dfb8b","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T20:41:19.315411Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:43:11.343707Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-16T04:43:11.808853Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2411.09449","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.09449","snapshot_observed_at":"2026-08-16T04:43:11.808853Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","venue":"cs.CV","work_id":"ff690783-5a38-4682-beab-b7348075430d","year":2024},"citing_paper":{"arxiv_id":"2505.00759","last_updated":"2025-05-12T20:46:35Z","snapshot_observed_at":"2026-08-16T04:33:52.609015Z","submitted_at":"2025-05-01T17:47:55Z","title":"Multi-Modal Language Models as Text-to-Image Model Evaluators","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-16T04:43:11.343707Z"},"links":{"cited_paper":"/paper/2411.09449","citing_paper":"/paper/2505.00759"},"observation_digest":"sha256:2fa77bae24d49b2290035b35adf22542751becdc18c82c47c8f1b2a87a7c8266","observation_id":"73bb21aa-2f9b-430f-8405-0211bfec37a6","resolution":{"observed_at":"2026-08-16T04:43:11.817299Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.09449/citation-record","integrity":"/paper/2411.09449/integrity","json":"/paper/2411.09449/citation-record.json","paper":"/paper/2411.09449"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:41:19.134391Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.134391Z"},"links":{"citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:2e169997f4720f06b8f2adbbac3c4fa143578431953af2312f8ff66e03b61cb1","observation_id":"c4c9c0e7-e293-41c2-baf4-cafa202c9484","resolution":{"observed_at":"2026-08-12T20:41:19.134391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:41:19.139511Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.139511Z"},"links":{"citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:fcf9d8f0147d340f9f03790a624492746d16c8130d698555551dfa3d7974a9f6","observation_id":"94037c2d-34e5-4de3-beac-6b13f2f17b41","resolution":{"observed_at":"2026-08-12T20:41:19.139511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-12T20:41:19.144337Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.144337Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:ac571b64b378bae5945e6444b6ad19183006c7fb7a5987713dfb9340b7b8d3b7","observation_id":"ed5d2ad3-fcac-4d06-be1e-d10d007bf57c","resolution":{"observed_at":"2026-08-12T20:41:19.144337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16797","last_updated":"2023-09-28T19:01:07Z","snapshot_observed_at":"2026-08-14T11:37:32.461743Z","submitted_at":"2023-09-28T19:01:07Z","title":"Promptbreeder: Self-Referential Self-Improvement Via Prompt Evolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16797","snapshot_observed_at":"2026-08-12T20:41:19.148990Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.148990Z"},"links":{"cited_paper":"/paper/2309.16797","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:37de1fb1c3c3b42ed1ee0a64c9e6c19fa80faaca7505948a00500c0149191200","observation_id":"e8293111-bf34-4eec-97ac-94f23be1c0b9","resolution":{"observed_at":"2026-08-12T20:41:19.148990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-12T20:41:19.153568Z","title":"H.; Chechik, G.; and Cohen-Or, D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.153568Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:3a020b6eaf24bd1822527f9469ce2c830435a52e44fac54768abac9dfa285aad","observation_id":"93046a19-b317-4e81-b4a2-4d580c3aed53","resolution":{"observed_at":"2026-08-12T20:41:19.153568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.08500","last_updated":"2018-01-12T14:05:44Z","snapshot_observed_at":"2026-08-14T20:51:33.836666Z","submitted_at":"2017-06-26T17:45:23Z","title":"GANs Trained by a Two Time-Scale Update Rule Converge to a Local Nash Equilibrium","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.08500","snapshot_observed_at":"2026-08-12T20:41:19.158049Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.158049Z"},"links":{"cited_paper":"/paper/1706.08500","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:19d15cde8be3a21f60e11fc0439f20c8f863b7653443a1d78f8fd4a4a6a0831b","observation_id":"1f9c0539-392f-4a87-b868-db907c2b906b","resolution":{"observed_at":"2026-08-12T20:41:19.158049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06350","last_updated":"2025-03-08T14:57:45Z","snapshot_observed_at":"2026-08-13T10:57:18.918263Z","submitted_at":"2023-07-12T17:59:42Z","title":"T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06350","snapshot_observed_at":"2026-08-12T20:41:19.162672Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.162672Z"},"links":{"cited_paper":"/paper/2307.06350","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:bec29c1c063a400253834a353083cbb6facb294ae57a507cd526332eb5004303","observation_id":"616afc72-c3de-412e-b451-2e3c143df788","resolution":{"observed_at":"2026-08-12T20:41:19.162672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:41:19.809948Z","title":null,"venue":null,"work_id":"9cb25488-134e-400e-8542-e9a491aed9fe","year":2024},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.166678Z"},"links":{"citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:f3b419cc369dc501c37dafbcdb450ca40288e3da3c7ccb3a76da21dfa912f5d1","observation_id":"21861527-bafd-410a-b204-2cc9780c3be6","resolution":{"observed_at":"2026-08-12T20:41:19.813708Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13439","last_updated":"2023-03-23T17:01:59Z","snapshot_observed_at":"2026-08-13T12:18:15.824424Z","submitted_at":"2023-03-23T17:01:59Z","title":"Text2Video-Zero: Text-to-Image Diffusion Models are Zero-Shot Video Generators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13439","snapshot_observed_at":"2026-08-12T20:41:19.174345Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.174345Z"},"links":{"cited_paper":"/paper/2303.13439","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:eb7b7915679af44bbd16e335c471a02b91ddc55e83b698aec8903e7415e10f7f","observation_id":"07e74307-3b8f-48d8-bd6e-01b33d8f5f20","resolution":{"observed_at":"2026-08-12T20:41:19.174345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11916","last_updated":"2023-01-29T05:14:17Z","snapshot_observed_at":"2026-08-13T05:54:24.242465Z","submitted_at":"2022-05-24T09:22:26Z","title":"Large Language Models are Zero-Shot Reasoners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11916","snapshot_observed_at":"2026-08-12T20:41:19.179151Z","title":"S.; Reid, M.; Matsuo, Y.; and Iwasawa, Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.179151Z"},"links":{"cited_paper":"/paper/2205.11916","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:30e16b2a01e79995d6934be1a40906c73d84762bc2558729a10f3195f2533c40","observation_id":"f7f41c92-3cb3-4574-85e1-386ac50b5d43","resolution":{"observed_at":"2026-08-12T20:41:19.179151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01596","last_updated":"2024-03-10T21:41:51Z","snapshot_observed_at":"2026-08-14T06:28:47.487208Z","submitted_at":"2023-10-02T19:41:42Z","title":"ImagenHub: Standardizing the evaluation of conditional image generation models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01596","snapshot_observed_at":"2026-08-12T20:41:19.183110Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.183110Z"},"links":{"cited_paper":"/paper/2310.01596","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:191ec01922329c905e8d4f5a643f5862a6e07dcaaa70e03ae50c77ab695cc342","observation_id":"fc7cca6a-6ad3-4f99-b363-3618485cd0b4","resolution":{"observed_at":"2026-08-12T20:41:19.183110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-08-12T12:01:54.105712Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-12T20:41:19.187147Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.187147Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:0481ffd92c7aa8dab922590b5846f513d8492545d80f0de03adbaf3ea569df4b","observation_id":"65877162-76e5-46c1-b719-2c4fe8e560d6","resolution":{"observed_at":"2026-08-12T20:41:19.187147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12086","last_updated":"2022-02-15T05:43:32Z","snapshot_observed_at":"2026-08-09T08:39:37.884261Z","submitted_at":"2022-01-28T12:49:48Z","title":"BLIP: Bootstrapping Language-Image Pre-training for Unified Vision-Language Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12086","snapshot_observed_at":"2026-08-12T20:41:19.191871Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.191871Z"},"links":{"cited_paper":"/paper/2201.12086","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:94d1a4698510d1878032b95b9485fc1d72462e74e17315e74cffe3206d7a71a4","observation_id":"9770d1f3-3e38-4f90-88bf-3591b6badb29","resolution":{"observed_at":"2026-08-12T20:41:19.191871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17177","last_updated":"2024-04-17T18:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T03:30:58Z","title":"Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17177","snapshot_observed_at":"2026-08-12T20:41:19.197131Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.197131Z"},"links":{"cited_paper":"/paper/2402.17177","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:c5e57fedf545ce9dab35840e90648b4270dc62418acf33292c9022eed2943738","observation_id":"f71e0ff6-2e7f-4073-bb40-dfe381a49112","resolution":{"observed_at":"2026-08-12T20:41:19.197131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:41:19.798473Z","title":"P.; Nicholson, A","venue":null,"work_id":"e8009b03-3cf1-4971-8520-bfb14a35db4e","year":2021},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.201170Z"},"links":{"citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:a32ee20b7d19af3fc861f01052cedf4bf7a15d95239893469a9f0d8444efe77e","observation_id":"90ec79a4-1548-42a8-a6df-091661f8fbe3","resolution":{"observed_at":"2026-08-12T20:41:19.802435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T20:41:19.204729Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.204729Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:3f9aa4c72f80d18cd9d823fabb4293a5612d4cb078f3eb1d68ac6e195c616f38","observation_id":"fe31e094-20d7-4070-b152-dee1b687a508","resolution":{"observed_at":"2026-08-12T20:41:19.204729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-12T20:41:19.209154Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.209154Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:f435bfc4bffb2a8bc8c6b16e257638ffaca26049d7144842ccd71169e9fcec38","observation_id":"5285bdb2-a2f9-4d66-aa7d-dc4fd6503f04","resolution":{"observed_at":"2026-08-12T20:41:19.209154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-12T20:41:19.212903Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.212903Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:13c6320e6de7207e4f839f10961c712083c8a9aedde507d2595d430efe39a041","observation_id":"211b83cf-2841-413d-b55c-418610ff0092","resolution":{"observed_at":"2026-08-12T20:41:19.212903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-12T20:41:19.216815Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.216815Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:722931d57212d8f45560bf648ccf1a1b86160f03c07c4a085e828667fafd1d20","observation_id":"0a60e03d-71fa-423d-acb5-47750365dec6","resolution":{"observed_at":"2026-08-12T20:41:19.216815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-12T20:41:19.220687Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; Krueger, G.; and Sutskever, I","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.220687Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:6743ce5af4ed029edc05ef0f6c9aa1e4cf65912c723328c023c70397f76f21af","observation_id":"70e8da8c-b719-448a-aff2-87b1b817265e","resolution":{"observed_at":"2026-08-12T20:41:19.220687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-12T20:41:19.224639Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.224639Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:27bc13b57b55027e439d66742652802d281b76addffcedbff16cbd199738280c","observation_id":"1aa00423-c90a-44cc-a4fc-da70fb6785b8","resolution":{"observed_at":"2026-08-12T20:41:19.224639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10752","last_updated":"2022-04-13T11:38:44Z","snapshot_observed_at":"2026-07-06T12:20:47.369918Z","submitted_at":"2021-12-20T18:55:25Z","title":"High-Resolution Image Synthesis with Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10752","snapshot_observed_at":"2026-08-12T20:41:19.228861Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.228861Z"},"links":{"cited_paper":"/paper/2112.10752","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:ec9c19cf1b59dfbb89abe9c5b17611d953a47493c9b55f85fda98f9b319a4a44","observation_id":"04ba4d19-b4f3-4dd4-83f9-9d8bbbdef6d3","resolution":{"observed_at":"2026-08-12T20:41:19.228861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:41:19.232781Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.232781Z"},"links":{"citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:7a09f01cda8ccd130d7fc3a7a4f6ba2d6f422c75a6f3e2d775227adcdcc64329","observation_id":"b1a93819-e5db-4c54-98a5-e7eaea2fd835","resolution":{"observed_at":"2026-08-12T20:41:19.232781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.12242","last_updated":"2023-03-15T17:52:27Z","snapshot_observed_at":"2026-08-13T14:38:54.124751Z","submitted_at":"2022-08-25T17:45:49Z","title":"DreamBooth: Fine Tuning Text-to-Image Diffusion Models for Subject-Driven Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.12242","snapshot_observed_at":"2026-08-12T20:41:19.236439Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.236439Z"},"links":{"cited_paper":"/paper/2208.12242","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:c0d36e39bc52edd74548cfc530f9d6d828261b8ef20e8d0b8c26e80e57571ea7","observation_id":"471bb97e-58ff-43fb-b974-1c6256447220","resolution":{"observed_at":"2026-08-12T20:41:19.236439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06949","last_updated":"2024-10-16T23:55:27Z","snapshot_observed_at":"2026-08-13T10:55:57.064533Z","submitted_at":"2023-07-13T17:59:47Z","title":"HyperDreamBooth: HyperNetworks for Fast Personalization of Text-to-Image Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06949","snapshot_observed_at":"2026-08-12T20:41:19.240611Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.240611Z"},"links":{"cited_paper":"/paper/2307.06949","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:42d753e05e978e5104b31e554949496c7b921a7d57fb487c630e36daa6a62497","observation_id":"09687994-558a-4ab6-9a0f-6ad57bb7f9ef","resolution":{"observed_at":"2026-08-12T20:41:19.240611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11487","last_updated":"2022-05-23T17:42:53Z","snapshot_observed_at":"2026-08-12T12:48:35.419134Z","submitted_at":"2022-05-23T17:42:53Z","title":"Photorealistic Text-to-Image Diffusion Models with Deep Language Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11487","snapshot_observed_at":"2026-08-12T20:41:19.244659Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.244659Z"},"links":{"cited_paper":"/paper/2205.11487","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:a49d9f831cc5abd8fa43c551309dacad273bf43dc9fdfb9d2d3edff3edecfe49","observation_id":"51931010-45a7-4aef-957b-36d9127dafa8","resolution":{"observed_at":"2026-08-12T20:41:19.244659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.03498","last_updated":"2016-06-10T22:53:35Z","snapshot_observed_at":"2026-08-14T21:53:14.441750Z","submitted_at":"2016-06-10T22:53:35Z","title":"Improved Techniques for Training GANs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.03498","snapshot_observed_at":"2026-08-12T20:41:19.248895Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.248895Z"},"links":{"cited_paper":"/paper/1606.03498","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:8d65bb3c9f176b9f7ac7cefb25c2eefe5c357d37822f77d8d65a5fe86ef8c5a8","observation_id":"0b7fe409-8e14-4e3a-9620-4ffafab3c6a5","resolution":{"observed_at":"2026-08-12T20:41:19.248895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04761","last_updated":"2023-02-09T16:49:57Z","snapshot_observed_at":"2026-07-06T14:50:07.491434Z","submitted_at":"2023-02-09T16:49:57Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04761","snapshot_observed_at":"2026-08-12T20:41:19.253194Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.253194Z"},"links":{"cited_paper":"/paper/2302.04761","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:277eddf2b9b75dd5affb2941872aee69b14117956bde6ab2a84be749558546c7","observation_id":"79eebabb-e67f-40b4-8ab4-e37f07ef8371","resolution":{"observed_at":"2026-08-12T20:41:19.253194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17580","last_updated":"2023-12-03T18:17:21Z","snapshot_observed_at":"2026-08-12T12:50:51.005571Z","submitted_at":"2023-03-30T17:48:28Z","title":"HuggingGPT: Solving AI Tasks with ChatGPT and its Friends in Hugging Face","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17580","snapshot_observed_at":"2026-08-12T20:41:19.257262Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.257262Z"},"links":{"cited_paper":"/paper/2303.17580","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:2ad0a50f3421204b021751f87648064422b7becc9493afc865dbc7522228c6a1","observation_id":"c014e2f6-c039-4247-8237-833f6af53b30","resolution":{"observed_at":"2026-08-12T20:41:19.257262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-12T20:41:19.262298Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.262298Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:73ac1ffe9ff51f054834b99ed85aa85f399881c2aa043d5277bc57ac8a37bed2","observation_id":"682f50e6-b5eb-4e71-a537-a97753b472f3","resolution":{"observed_at":"2026-08-12T20:41:19.262298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12908","last_updated":"2023-11-21T15:24:05Z","snapshot_observed_at":"2026-08-13T05:20:21.767335Z","submitted_at":"2023-11-21T15:24:05Z","title":"Diffusion Model Alignment Using Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12908","snapshot_observed_at":"2026-08-12T20:41:19.266339Z","title":"R.; and Naik, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.266339Z"},"links":{"cited_paper":"/paper/2311.12908","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:9ac51f5cc83e2f8672c9a6e7d8bd98bba53acb5239231b2160ded46b2d970509","observation_id":"80e654d5-f6e1-46c4-b034-5d2ef97c307b","resolution":{"observed_at":"2026-08-12T20:41:19.266339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07863","last_updated":"2023-08-15T16:30:49Z","snapshot_observed_at":"2026-08-13T10:34:12.235917Z","submitted_at":"2023-08-15T16:30:49Z","title":"StyleDiffusion: Controllable Disentangled Style Transfer via Diffusion Models","version":1},"cited_work":{"arxiv_id":"2308.07863","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.07863","snapshot_observed_at":"2026-08-12T20:41:19.513421Z","title":"StyleDiffusion: Controllable Disentangled Style Transfer via Diffusion Models","venue":"cs.CV","work_id":"d8701f57-4d00-435b-843f-6bafd07d7be4","year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.271053Z"},"links":{"cited_paper":"/paper/2308.07863","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:a967a1055a4c68f4132f685116822b38e35e6795196f2021a3693f0e85ee99d6","observation_id":"cfe27f9c-2c64-4c52-950a-cef99073b722","resolution":{"observed_at":"2026-08-12T20:41:19.519705Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14896","last_updated":"2023-07-06T11:53:19Z","snapshot_observed_at":"2026-08-13T13:55:48.903163Z","submitted_at":"2022-10-26T17:54:20Z","title":"DiffusionDB: A Large-scale Prompt Gallery Dataset for Text-to-Image Generative Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14896","snapshot_observed_at":"2026-08-12T20:41:19.275983Z","title":"J.; Montoya, E.; Munechika, D.; Yang, H.; Hoover, B.; and Chau, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.275983Z"},"links":{"cited_paper":"/paper/2210.14896","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:7e047ac72d9846eefeedae6d814ac720f85c052e0943f9258d96472cf02c2d41","observation_id":"d5cb9888-5680-42fc-b2ce-aba082946ff2","resolution":{"observed_at":"2026-08-12T20:41:19.275983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-08-13T07:04:41.220509Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-12T20:41:19.281057Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.281057Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:caa94f28fe813d30fc171df2871ef333345b91e78608709eb8085f647a11825e","observation_id":"30eeac13-b70d-4d32-a547-b5ed131c07e3","resolution":{"observed_at":"2026-08-12T20:41:19.281057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04671","last_updated":"2023-03-08T15:50:02Z","snapshot_observed_at":"2026-08-15T10:03:23.497428Z","submitted_at":"2023-03-08T15:50:02Z","title":"Visual ChatGPT: Talking, Drawing and Editing with Visual Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04671","snapshot_observed_at":"2026-08-12T20:41:19.285932Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.285932Z"},"links":{"cited_paper":"/paper/2303.04671","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:59fb0d70c37f64f588cec96aa05a22b28e812ebae3b78aa227f603e66de1e2c4","observation_id":"9876382c-a8c0-4363-9d2e-9b85f19b21af","resolution":{"observed_at":"2026-08-12T20:41:19.285932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11708","last_updated":"2024-05-05T04:50:54Z","snapshot_observed_at":"2026-08-13T10:47:54.326171Z","submitted_at":"2024-01-22T06:16:29Z","title":"Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Multimodal LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11708","snapshot_observed_at":"2026-08-12T20:41:19.290640Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.290640Z"},"links":{"cited_paper":"/paper/2401.11708","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:e2c95d99f159bed9eb7a2caa4a33dd44be783ecc03eb6fbe3eace10ca24bf822","observation_id":"d01e336e-499e-4ebe-9ab8-1faeee6f2db4","resolution":{"observed_at":"2026-08-12T20:41:19.290640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:41:19.294654Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.294654Z"},"links":{"citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:24aba5496a4cc88e8eb9c3697db604685e3ac75da463a70439f19283156cfe9d","observation_id":"60f123c2-a84f-4f6f-8ed5-f5535af93906","resolution":{"observed_at":"2026-08-12T20:41:19.294654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17421","last_updated":"2023-10-11T05:07:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:34:51Z","title":"The Dawn of LMMs: Preliminary Explorations with GPT-4V(ision)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17421","snapshot_observed_at":"2026-08-12T20:41:19.298465Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.298465Z"},"links":{"cited_paper":"/paper/2309.17421","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:c063c52d19aca49deb5cde0da7fd1d1dfac85876ff6cf7512013d8cb127d6533","observation_id":"1c99a116-7907-4279-ba57-de038f0e3585","resolution":{"observed_at":"2026-08-12T20:41:19.298465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08541","last_updated":"2024-08-14T17:43:25Z","snapshot_observed_at":"2026-08-14T15:42:20.205617Z","submitted_at":"2023-10-12T17:34:20Z","title":"Idea2Img: Iterative Self-Refinement with GPT-4V(ision) for Automatic Image Design and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08541","snapshot_observed_at":"2026-08-12T20:41:19.302523Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.302523Z"},"links":{"cited_paper":"/paper/2310.08541","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:efdf20f7fefa75def24976376158514519ce6257f392abfd753a91e4cb930e70","observation_id":"9f62f01a-deae-407b-a7a7-ae44ce54e319","resolution":{"observed_at":"2026-08-12T20:41:19.302523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10789","last_updated":"2022-06-22T01:11:29Z","snapshot_observed_at":"2026-08-14T02:29:38.306439Z","submitted_at":"2022-06-22T01:11:29Z","title":"Scaling Autoregressive Models for Content-Rich Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.10789","snapshot_observed_at":"2026-08-12T20:41:19.307112Z","title":"Y.; Luong, T.; Baid, G.; Wang, Z.; Vasudevan, V.; Ku, A.; Yang, Y.; Ayan, B","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.307112Z"},"links":{"cited_paper":"/paper/2206.10789","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:ed434134ed0567c0d93733297c888243912dd9b9ffde71ca11149ee326b88b94","observation_id":"aedc2a37-d4a1-4de1-963c-2a64662bd8fb","resolution":{"observed_at":"2026-08-12T20:41:19.307112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13203","last_updated":"2023-03-20T14:32:01Z","snapshot_observed_at":"2026-08-15T23:45:46.464136Z","submitted_at":"2022-11-23T18:44:25Z","title":"Inversion-Based Style Transfer with Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13203","snapshot_observed_at":"2026-08-12T20:41:19.311532Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.311532Z"},"links":{"cited_paper":"/paper/2211.13203","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:bc196a19e1f1c29e6f34fbf5fa4ac9a8b7f2e411b7130b85d6b09b0a7f58d380","observation_id":"2206b7ca-7081-4d66-a07f-bf07d0856936","resolution":{"observed_at":"2026-08-12T20:41:19.311532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03493","last_updated":"2022-10-07T12:28:21Z","snapshot_observed_at":"2026-07-06T14:01:50.333970Z","submitted_at":"2022-10-07T12:28:21Z","title":"Automatic Chain of Thought Prompting in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03493","snapshot_observed_at":"2026-08-12T20:41:19.315411Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-12T20:41:19.315411Z"},"links":{"cited_paper":"/paper/2210.03493","citing_paper":"/paper/2411.09449"},"observation_digest":"sha256:472a2814947449961d0e765e2772dabd3957f4d46715fe507d5188cc74b8f150","observation_id":"0044b981-4a0d-48bd-8717-870ce648a51e","resolution":{"observed_at":"2026-08-12T20:41:19.315411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.09449","last_updated":"2024-11-14T13:52:43Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T10:04:04.093945Z","submitted_at":"2024-11-14T13:52:43Z","title":"Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":40,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2411.09449."}