{"as_of":"2026-08-14T15:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:236c47adf277c3f371ac5c2184f20ca51539ccbc5adf92a79313bd0f3f85b367","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:40:37.973647Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.09988/citation-record","integrity":"/paper/2506.09988/integrity","json":"/paper/2506.09988/citation-record.json","paper":"/paper/2506.09988"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:40:36.138334Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.138334Z"},"links":{"citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:40aed9c935563cfe3c8fbeecd00bc36e8bd03ac757cd65a40c540fcaf1e2d59f","observation_id":"3e1d97b2-b715-41ce-b46e-e1d3816ba8ef","resolution":{"observed_at":"2026-08-07T04:40:36.138334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:40:36.188523Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.188523Z"},"links":{"citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:25480fb088e6d4bbee47e8f16a2587b09b1b38dfbb8f97d589db9b08b682d50b","observation_id":"7ee59052-602d-4fd3-ba39-3328bf584222","resolution":{"observed_at":"2026-08-07T04:40:36.188523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:40:36.236414Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.236414Z"},"links":{"citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:e63be0483cdf63e05437d89dd6256a7f2e0719f28048e234084a607999629bbe","observation_id":"b859706a-0fe1-4ee7-9cd4-83f48d4fb185","resolution":{"observed_at":"2026-08-07T04:40:36.236414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T04:40:36.291478Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.291478Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:dd0b95f588ad50a5bb02b59a73d3b2a1c0d12aca5f9072b3674c5a10feed44a4","observation_id":"8605bac7-b7d5-425b-a549-07ee6216f9ee","resolution":{"observed_at":"2026-08-07T04:40:36.291478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02426","last_updated":"2023-10-03T20:46:10Z","snapshot_observed_at":"2026-08-13T21:33:56.070102Z","submitted_at":"2023-10-03T20:46:10Z","title":"EditVal: Benchmarking Diffusion Based Text-Guided Image Editing Methods","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02426","snapshot_observed_at":"2026-08-07T04:40:36.344868Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.344868Z"},"links":{"cited_paper":"/paper/2310.02426","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:55b21b5979163b74097d9eab8fb79134f0597c31360fa38e86577f5bcb23cd02","observation_id":"18134387-2862-434a-bc5f-db5aa6cce4ff","resolution":{"observed_at":"2026-08-07T04:40:36.344868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-13T13:40:09.134144Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-07T04:40:36.403646Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.403646Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:ba03c116a37829409e11e79e3467be98b54b026de8e7f210d70c6c8bfb1438e7","observation_id":"61af728a-1a10-497a-ac43-c29e965d6ebf","resolution":{"observed_at":"2026-08-07T04:40:36.403646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11427","last_updated":"2022-10-20T17:16:37Z","snapshot_observed_at":"2026-08-13T22:13:36.544823Z","submitted_at":"2022-10-20T17:16:37Z","title":"DiffEdit: Diffusion-based semantic image editing with mask guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11427","snapshot_observed_at":"2026-08-07T04:40:36.467826Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.467826Z"},"links":{"cited_paper":"/paper/2210.11427","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:9a44726100f65b3272b31edd82f9bf7cfa77bc88296e32229cffc0b7451cecec","observation_id":"1d714b29-9e29-4713-aa31-b344666d58a2","resolution":{"observed_at":"2026-08-07T04:40:36.467826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11108","last_updated":"2023-10-16T04:04:12Z","snapshot_observed_at":"2026-08-13T12:20:46.080958Z","submitted_at":"2023-03-20T13:45:58Z","title":"CHATEDIT: Towards Multi-turn Interactive Facial Image Editing via Dialogue","version":3},"cited_work":{"arxiv_id":"2303.11108","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.11108","snapshot_observed_at":"2026-08-07T04:40:38.453517Z","title":"CHATEDIT: Towards Multi-turn Interactive Facial Image Editing via Dialogue","venue":"cs.CV","work_id":"625476ee-f50b-444b-a7e9-3587572a9bde","year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.536293Z"},"links":{"cited_paper":"/paper/2303.11108","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:1dfbd9168b9a3d1f99a630c481dc472635d278e6e11fe6ac4c3fe4541498a093","observation_id":"0c158b58-4969-4e0d-8e33-96d794525968","resolution":{"observed_at":"2026-08-07T04:40:38.559809Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:40:36.595306Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.595306Z"},"links":{"citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:ed746192d618f234c9d8019f6cdb8b01cb1019a0e66ad4a182058cdb50db1952","observation_id":"db434464-43b8-4729-b958-d15bc22b3c0a","resolution":{"observed_at":"2026-08-07T04:40:36.595306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T04:40:36.651893Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.651893Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:5e4a713a08c1ac57f2fa6d34c2d6d5a9e307edeae32a063d57f116b473ea7abb","observation_id":"b509110a-9e1b-466d-93f7-26b72ed25f0c","resolution":{"observed_at":"2026-08-07T04:40:36.651893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T04:40:36.709289Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.709289Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:d941359cbf52e8369e79118b6ae4d40132213ff877a4f2e61e47a58ce4b4d26b","observation_id":"a3fe6ec4-4652-4e5c-9249-1546e6afa0c2","resolution":{"observed_at":"2026-08-07T04:40:36.709289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19334","last_updated":"2024-06-09T11:34:12Z","snapshot_observed_at":"2026-08-14T09:42:03.456751Z","submitted_at":"2024-05-29T17:59:20Z","title":"LLMs Meet Multimodal Generation and Editing: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19334","snapshot_observed_at":"2026-08-07T04:40:36.763160Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.763160Z"},"links":{"cited_paper":"/paper/2405.19334","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:c878a29d105a45d0ec9f8565ff3e4f3c2faa0ff61e3e1efa866fdd33da903235","observation_id":"ed497e15-0553-4336-9518-bc04bf44e1e7","resolution":{"observed_at":"2026-08-07T04:40:36.763160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:40:36.848081Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.848081Z"},"links":{"citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:9a0f2cd4c7253f437eee0f107c816dabc054296062f5603b02319e9ba8faa15a","observation_id":"12e1d00b-b839-4fa2-8e39-b9ba179c9d70","resolution":{"observed_at":"2026-08-07T04:40:36.848081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09276","last_updated":"2023-03-20T15:58:50Z","snapshot_observed_at":"2026-08-13T14:03:30.146739Z","submitted_at":"2022-10-17T17:27:32Z","title":"Imagic: Text-Based Real Image Editing with Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09276","snapshot_observed_at":"2026-08-07T04:40:36.916051Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.916051Z"},"links":{"cited_paper":"/paper/2210.09276","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:caa3a80c73fb6f4f8a57c3365249ebd6200004a7fd18fe26d7b957cc8b0260d8","observation_id":"18dbf3cc-2448-4ba1-aa82-5ad5ff4972cb","resolution":{"observed_at":"2026-08-07T04:40:36.916051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03744","last_updated":"2024-05-15T19:22:44Z","snapshot_observed_at":"2026-08-13T06:40:28.574929Z","submitted_at":"2023-10-05T17:59:56Z","title":"Improved Baselines with Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03744","snapshot_observed_at":"2026-08-07T04:40:36.984061Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.984061Z"},"links":{"cited_paper":"/paper/2310.03744","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:c9fb4a857931d3fa5d8875d3239d18b5ed201f7bcab5b7aec0f33a3c112bbe38","observation_id":"6ce3690c-5f3c-41bd-be9b-49485eee1a10","resolution":{"observed_at":"2026-08-07T04:40:36.984061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-07T04:40:37.049491Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.049491Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:9c5f14dc704464e94513ec993bd7c74c81024de7f0e45b947b7c8b76b863d279","observation_id":"49d65a61-4785-48ec-99e5-413ef9f311ee","resolution":{"observed_at":"2026-08-07T04:40:37.049491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T04:40:37.103379Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.103379Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:e7c92c67dc0c0a8eca86c44b188caffefcaa37fa2d1cbbf3122c5e3723e238e0","observation_id":"02a726b7-26d4-4d5c-a3e9-9a4f192ed3b2","resolution":{"observed_at":"2026-08-07T04:40:37.103379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-07T04:40:37.179139Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.179139Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:5cf9b28a9dd4517050ec3af9e9366431f34d30ee86120be25097a58021679528","observation_id":"94f3a194-f9b3-42a6-80f1-6f5b6fb672e3","resolution":{"observed_at":"2026-08-07T04:40:37.179139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10089","last_updated":"2023-11-16T18:55:58Z","snapshot_observed_at":"2026-08-13T05:23:38.510032Z","submitted_at":"2023-11-16T18:55:58Z","title":"Emu Edit: Precise Image Editing via Recognition and Generation Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10089","snapshot_observed_at":"2026-08-07T04:40:37.247150Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.247150Z"},"links":{"cited_paper":"/paper/2311.10089","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:3ad0efd1df92228507c4ae644874a6788039ebfc613f011fcc01147399f84b37","observation_id":"92eabd86-680a-4131-a34f-7eeb66e23142","resolution":{"observed_at":"2026-08-07T04:40:37.247150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06909","last_updated":"2023-04-12T22:42:08Z","snapshot_observed_at":"2026-08-13T13:22:30.787372Z","submitted_at":"2022-12-13T21:25:11Z","title":"Imagen Editor and EditBench: Advancing and Evaluating Text-Guided Image Inpainting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06909","snapshot_observed_at":"2026-08-07T04:40:37.308816Z","title":"Fleet, Radu Soricut, Jason Baldridge, Mohammad Norouzi, Peter Anderson, and William Chan","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.308816Z"},"links":{"cited_paper":"/paper/2212.06909","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:49dd19a3520f1d369b31ce208a0dc85fd016a5d15269a7886b78f2b0d69bf01e","observation_id":"2c511d84-b11d-49e7-8b24-1ea421f7825a","resolution":{"observed_at":"2026-08-07T04:40:37.308816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04671","last_updated":"2023-03-08T15:50:02Z","snapshot_observed_at":"2026-08-13T20:29:03.722242Z","submitted_at":"2023-03-08T15:50:02Z","title":"Visual ChatGPT: Talking, Drawing and Editing with Visual Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04671","snapshot_observed_at":"2026-08-07T04:40:37.395334Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.395334Z"},"links":{"cited_paper":"/paper/2303.04671","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:cb458681052bd4eddb436dd296a17c4df29a094156768e865a90217fd085ead5","observation_id":"ac025846-1e27-466b-9ecf-9450d9575b00","resolution":{"observed_at":"2026-08-07T04:40:37.395334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16090","last_updated":"2023-11-27T18:56:37Z","snapshot_observed_at":"2026-08-13T05:16:06.200307Z","submitted_at":"2023-11-27T18:56:37Z","title":"Self-correcting LLM-controlled Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16090","snapshot_observed_at":"2026-08-07T04:40:37.479013Z","title":"Gonzalez, Boyi Li, and Trevor Darrell","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.479013Z"},"links":{"cited_paper":"/paper/2311.16090","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:984178229be8f4e1e07d36ea959b12a6615802fa0e58c34efc7165a943875fb4","observation_id":"3d37046c-bd9e-4ee1-8e95-c36fa7696a76","resolution":{"observed_at":"2026-08-07T04:40:37.479013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10012","last_updated":"2024-05-15T18:20:28Z","snapshot_observed_at":"2026-08-13T11:15:05.699888Z","submitted_at":"2023-06-16T17:58:58Z","title":"MagicBrush: A Manually Annotated Dataset for Instruction-Guided Image Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.10012","snapshot_observed_at":"2026-08-07T04:40:37.578576Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.578576Z"},"links":{"cited_paper":"/paper/2306.10012","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:c56ae7a23a1f84de064cf7e114bcd84b771ec4cea92dac6ac69114f43c42e66d","observation_id":"8d5fdc72-a2a8-490f-b404-e83618a986cf","resolution":{"observed_at":"2026-08-07T04:40:37.578576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09618","last_updated":"2024-03-26T22:59:52Z","snapshot_observed_at":"2026-08-13T12:23:05.919425Z","submitted_at":"2023-03-16T19:47:41Z","title":"HIVE: Harnessing Human Feedback for Instructional Visual Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09618","snapshot_observed_at":"2026-08-07T04:40:37.653444Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.653444Z"},"links":{"cited_paper":"/paper/2303.09618","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:609ea2acc97e09e63bbb9c9a0e3aec5ae5a69689113ff1c4abc71a38faa26135","observation_id":"aba2c807-275f-48eb-bf96-55131e044f21","resolution":{"observed_at":"2026-08-07T04:40:37.653444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04489","last_updated":"2025-03-30T23:04:15Z","snapshot_observed_at":"2026-08-13T13:25:08.053604Z","submitted_at":"2022-12-08T18:57:13Z","title":"SINE: SINgle Image Editing with Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04489","snapshot_observed_at":"2026-08-07T04:40:37.770784Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.770784Z"},"links":{"cited_paper":"/paper/2212.04489","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:ad567f594c62d9deaf612c77a8597dab16a26b2c7c63cff975a8f431f919bba8","observation_id":"35fa1e13-2d5d-4c4c-babb-ae89ee9a4942","resolution":{"observed_at":"2026-08-07T04:40:37.770784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05282","last_updated":"2024-12-19T04:42:41Z","snapshot_observed_at":"2026-08-13T22:56:43.546810Z","submitted_at":"2024-07-07T06:50:22Z","title":"UltraEdit: Instruction-based Fine-Grained Image Editing at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05282","snapshot_observed_at":"2026-08-07T04:40:37.858619Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.858619Z"},"links":{"cited_paper":"/paper/2407.05282","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:8434275be59ea0f6cc2252e511775c2ef54087dd9070f1844d7674d4ad5b7d6e","observation_id":"31feec64-0e31-4abc-a55f-6b00ca7b7300","resolution":{"observed_at":"2026-08-07T04:40:37.858619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:40:38.802695Z","title":"a henb \\","venue":null,"work_id":"b1ac3d17-4046-40a6-9743-e40884c5d534","year":2022},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.945790Z"},"links":{"citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:4eaa00c507f011692cce96449d076110f1237a3380ae1d8019b9fad96a1c4752","observation_id":"61301723-de03-42fd-8292-dd9e63b18e53","resolution":{"observed_at":"2026-08-07T04:40:38.879853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-10T18:37:57.419939Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-07T04:40:37.973647Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:37.973647Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:7db0d2a2ebd9dd11b19cde8ba8ee049ce4d501334f6bcb82318c4d63d7a15053","observation_id":"34043248-d0ab-47ce-a149-911caeab7419","resolution":{"observed_at":"2026-08-07T04:40:37.973647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T00:44:59.826864Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2506.09988."}