{"as_of":"2026-08-07T11:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a060e6a1fdf876c9d048a2ef58db375096e7b1fe2116c3afe6d17bb6c2d801d5","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":38,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:14:06.322338Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T21:16:34.372456Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2504.13109","last_updated":"2026-05-20T05:16:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-17T17:24:23Z","title":"UniEdit-Flow: Unleashing Inversion and Editing in the Era of Flow Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-22T18:52:47.520861Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2504.13109"},"observation_digest":"sha256:cf35018619d0ca8e9e2d0825310487e4867af57e94607bfbbb719ee777d07100","observation_id":"6792aee8-42a9-47b2-8195-88183caa629a","resolution":{"observed_at":"2026-05-22T18:55:03.298071Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-07-06T21:14:24.007428Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-11T14:36:41.467429Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2504.17761"},"observation_digest":"sha256:36cdb50fcbb320fbbb64938e80bb7729f1d8793bb69e04448e8019247ae34ffc","observation_id":"fd7a42cf-8689-4e29-b348-34cd832526ed","resolution":{"observed_at":"2026-05-11T14:36:42.003382Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T16:23:41.854132Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2505.14683"},"observation_digest":"sha256:99303bc82af9a395be0e5e7db2ab95443c1f8d4f283d18904f4c49caa292870e","observation_id":"07860753-a24e-4c8d-aeb7-56162ac2e657","resolution":{"observed_at":"2026-05-10T16:23:41.948268Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2505.20275","last_updated":"2025-05-26T17:53:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-26T17:53:33Z","title":"ImgEdit: A Unified Image Editing Dataset and Benchmark","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-12T18:17:45.123690Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2505.20275"},"observation_digest":"sha256:1d27822248c73079d743e9074edc5ff241af3fd5d5f8d6d170efdfe8212fdc9d","observation_id":"f8f215cb-5cd8-4c9a-8698-570796347eb7","resolution":{"observed_at":"2026-05-12T18:17:45.246185Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-08-07T11:14:06.322338Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03107","last_updated":"2025-06-11T06:11:36Z","snapshot_observed_at":"2026-08-07T11:06:10.351423Z","submitted_at":"2025-06-03T17:39:47Z","title":"ByteMorph: Benchmarking Instruction-Guided Image Editing with Non-Rigid Motions","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:06.322338Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2506.03107"},"observation_digest":"sha256:dfad0c55c1bd23a4e15ea8b8cab39fbd526347c1e55a279d7649da33f4ea5aca","observation_id":"4dafa773-825e-4840-91a8-909c27f0c5a6","resolution":{"observed_at":"2026-08-07T11:14:06.322338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-08-07T11:07:56.631296Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03448","last_updated":"2025-06-03T23:20:24Z","snapshot_observed_at":"2026-08-07T11:00:30.403553Z","submitted_at":"2025-06-03T23:20:24Z","title":"RefEdit: A Benchmark and Method for Improving Instruction-based Image Editing Model on Referring Expressions","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:56.631296Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2506.03448"},"observation_digest":"sha256:88b14ce9e372f06034983c1ae189523333728c1ec63fb2c85feefa97701741e5","observation_id":"9ccb1095-b454-443b-b70c-f2537401aa01","resolution":{"observed_at":"2026-08-07T11:07:56.631296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-08-07T10:29:05.343050Z","title":"Hq-edit: Ahigh-quality dataset for instruc-tion based image editing.arXiv preprint arXiv:2404.09990, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05083","last_updated":"2025-06-06T13:18:12Z","snapshot_observed_at":"2026-08-07T10:22:48.386232Z","submitted_at":"2025-06-05T14:30:39Z","title":"SeedEdit 3.0: Fast and High-Quality Generative Image Editing","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:29:05.343050Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2506.05083"},"observation_digest":"sha256:4ad4d2022c322f6fc17c2d4762157ea1ab3819d44b254519fd9b183fac696308","observation_id":"deea1f4d-cf3a-4e2b-807e-d1e9850fee5d","resolution":{"observed_at":"2026-08-07T10:29:05.343050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-08-07T00:43:14.211685Z","title":"Johnson, J., Alahi, A., and Fei-Fei, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.13827","last_updated":"2025-06-15T17:12:57Z","snapshot_observed_at":"2026-08-07T00:35:02.831730Z","submitted_at":"2025-06-15T17:12:57Z","title":"Balancing Preservation and Modification: A Region and Semantic Aware Metric for Instruction-Based Image Editing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:43:14.211685Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2506.13827"},"observation_digest":"sha256:029a19e47b66bafb844ed76051bbdb8ded151509d2c8445cb824bdd90c3c4764","observation_id":"dd8744ab-9d68-4543-896c-8eb7188d1639","resolution":{"observed_at":"2026-08-07T00:43:14.211685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-08-06T23:28:05.426710Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18095","last_updated":"2025-06-22T16:51:09Z","snapshot_observed_at":"2026-08-06T23:20:59.622434Z","submitted_at":"2025-06-22T16:51:09Z","title":"ShareGPT-4o-Image: Aligning Multimodal Models with GPT-4o-Level Image Generation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T23:28:05.426710Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2506.18095"},"observation_digest":"sha256:e76beb03945953b89266be661e70618aef41a603cd6aa3e6dae492cd2e000c59","observation_id":"06002829-b5c3-45a0-afbb-b23882b30f20","resolution":{"observed_at":"2026-08-06T23:28:05.426710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-08-06T23:01:45.260035Z","title":"arXiv preprint arXiv:2404.09990 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20155","last_updated":"2025-06-25T06:20:36Z","snapshot_observed_at":"2026-08-06T22:52:57.537214Z","submitted_at":"2025-06-25T06:20:36Z","title":"Towards Efficient Exemplar Based Image Editing with Multimodal VLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:01:45.260035Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2506.20155"},"observation_digest":"sha256:759144ab103dbece2fc43d3475b6d4335f875211ff0492a95a35d8f7c65f52a0","observation_id":"b0baf622-1999-46c8-b38d-23b2e2f7f2fa","resolution":{"observed_at":"2026-08-06T23:01:45.260035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2507.01908","last_updated":"2026-05-13T06:28:00Z","snapshot_observed_at":"2026-08-02T08:01:40.249812Z","submitted_at":"2025-07-02T17:22:21Z","title":"Reasoning to Edit: Hypothetical Instruction-Based Image Editing with Visual Reasoning","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-19T05:47:19.552825Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2507.01908"},"observation_digest":"sha256:d6aa66de416dcda86647ce12a24020a24a11c2b6790d72688c9f6e0129c2d70e","observation_id":"a540af13-a109-4123-b21f-f8b4bbe8a9d3","resolution":{"observed_at":"2026-05-19T05:52:08.041076Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-08-06T15:19:57.653558Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16193","last_updated":"2025-09-07T09:10:06Z","snapshot_observed_at":"2026-08-07T01:00:51.428857Z","submitted_at":"2025-07-22T03:11:07Z","title":"LMM4Edit: Benchmarking and Evaluating Multimodal Image Editing with LMMs","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:57.653558Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2507.16193"},"observation_digest":"sha256:476129e0af90195183bc972d84075adee67dad7735a2167ef48c018b726c5f04","observation_id":"9f63f34b-5ef7-4a4a-8416-189cc1751e2b","resolution":{"observed_at":"2026-08-06T15:19:57.653558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-08-06T12:08:01.714508Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22100","last_updated":"2025-07-29T17:59:16Z","snapshot_observed_at":"2026-08-06T12:08:00.125977Z","submitted_at":"2025-07-29T17:59:16Z","title":"Trade-offs in Image Generation: How Do Different Dimensions Interact?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T12:08:01.714508Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2507.22100"},"observation_digest":"sha256:c035a23104254de3e56208104543c56484a2ecbe0224811d930350f5e5fd9098","observation_id":"7de7e1eb-6a45-4512-8880-18a16c88969d","resolution":{"observed_at":"2026-08-06T12:08:01.714508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2509.01986","last_updated":"2026-04-08T07:45:08Z","snapshot_observed_at":"2026-07-06T22:22:03.439592Z","submitted_at":"2025-09-02T06:06:52Z","title":"Draw-In-Mind: Rebalancing Designer-Painter Roles in Unified Multimodal Models Benefits Image Editing","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T20:04:00.773443Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2509.01986"},"observation_digest":"sha256:f5f033e45ceca860295f5e708a301ff0edb54e1433d80963918b6d375442da16","observation_id":"8893fea7-0703-4a25-bdfc-f3a37686ba47","resolution":{"observed_at":"2026-05-18T20:06:50.063732Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2509.20360","last_updated":"2026-04-18T01:38:10Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T17:59:30Z","title":"EditVerse: Unifying Image and Video Editing and Generation with In-Context Learning","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T13:46:05.547669Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2509.20360"},"observation_digest":"sha256:ccab0753d6f3e24edf5c6e3a7b268c0a68da94135ce210160e854a91cd304f8f","observation_id":"5825eb45-2f43-4b0d-91a1-0fe74b40d7dc","resolution":{"observed_at":"2026-05-18T13:46:25.821301Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-08-04T09:54:25.111416Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing.arXiv preprint arXiv:2404.09990,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.12784","last_updated":"2026-06-28T11:09:54Z","snapshot_observed_at":"2026-08-04T09:54:23.338683Z","submitted_at":"2025-10-14T17:56:11Z","title":"SRUM: Fine-Grained Self-Rewarding for Unified Multimodal Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T09:54:25.111416Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2510.12784"},"observation_digest":"sha256:f4ecede8fa3ff21613443e2e0ef21d38b8a394bdc63882d05bba1ed33b38f86b","observation_id":"f6930a8a-66d4-4f86-9732-625c7dd4a24e","resolution":{"observed_at":"2026-08-04T09:54:25.111416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2512.13609","last_updated":"2026-05-14T17:13:30Z","snapshot_observed_at":"2026-08-02T18:51:26.411748Z","submitted_at":"2025-12-15T18:03:42Z","title":"Do-Undo Bench: Reversibility for Action Understanding in Image Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T22:10:29.304091Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2512.13609"},"observation_digest":"sha256:e3c0557be2013047d69603ac508d778c21292b4d01fd03f2b5f5a56ec9d65e89","observation_id":"b62ecfe7-a142-468f-b154-a700afc28b74","resolution":{"observed_at":"2026-05-16T22:11:18.495924Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2604.04887","last_updated":"2026-04-06T17:36:05Z","snapshot_observed_at":"2026-07-06T22:53:46.999911Z","submitted_at":"2026-04-06T17:36:05Z","title":"HorizonWeaver: Generalizable Multi-Level Semantic Editing for Driving Scenes","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T19:39:31.357223Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2604.04887"},"observation_digest":"sha256:c7eab4bc7ed15c5c59632b9071c04598711da72a277968b3eaa64e98e936b13b","observation_id":"1770ad66-d810-4b2b-9f63-f6d8af77e693","resolution":{"observed_at":"2026-05-10T22:40:50.129795Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2604.08213","last_updated":"2026-05-25T14:14:57Z","snapshot_observed_at":"2026-07-13T00:01:55.678830Z","submitted_at":"2026-04-09T13:11:33Z","title":"EditCaption: Human-Refined SFT and HAE-DPO for Image Editing Instruction Synthesis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T17:24:10.101140Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2604.08213"},"observation_digest":"sha256:d57f38576fffce086bebf76e26d75a239fa2e96900086d8c4df1a7e228fecf0b","observation_id":"f757a2b2-b59d-45f7-8426-338dbe6dc56c","resolution":{"observed_at":"2026-05-11T06:51:52.616336Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2604.10454","last_updated":"2026-04-12T04:32:30Z","snapshot_observed_at":"2026-08-06T09:27:45.077300Z","submitted_at":"2026-04-12T04:32:30Z","title":"AIM-Bench: Benchmarking and Improving Affective Image Manipulation via Fine-Grained Hierarchical Control","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T15:35:49.575589Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2604.10454"},"observation_digest":"sha256:ae9a4e2c5e630497d8285432a297f92f6fdedbe7c680710eae45717f29d6b710","observation_id":"85c49e51-37bc-4b8f-940d-a0caf8a08593","resolution":{"observed_at":"2026-05-11T10:11:04.180347Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2604.10954","last_updated":"2026-04-13T03:50:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-13T03:50:56Z","title":"FineEdit: Fine-Grained Image Edit with Bounding Box Guidance","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T16:15:23.578176Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2604.10954"},"observation_digest":"sha256:dc52d35d75e795f990f55001ddf7343159941728f1011927af8396665f65fa5e","observation_id":"7ef77086-e973-42e3-8f73-7c02291d028c","resolution":{"observed_at":"2026-05-11T09:05:59.995514Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2604.12904","last_updated":"2026-04-14T15:52:22Z","snapshot_observed_at":"2026-07-06T23:01:00.830207Z","submitted_at":"2026-04-14T15:52:22Z","title":"A Sanity Check on Composed Image Retrieval","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T15:24:27.497284Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2604.12904"},"observation_digest":"sha256:55b987327ade4531e5ec78f03ed769b0f7c9414e7668633f9ec3a86200ad8f4f","observation_id":"5cf58436-67d0-4d94-b1e3-3c8487fea431","resolution":{"observed_at":"2026-05-11T10:36:05.578441Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2604.23763","last_updated":"2026-04-30T04:05:16Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T15:28:02Z","title":"Edit Where You Mean: Region-Aware Adapter Injection for Mask-Free Local Image Editing","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-08T06:47:22.451132Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2604.23763"},"observation_digest":"sha256:c0f0c00b69e4c33ed2e7b1276ddd3a563f442d2966e9ae71a865068801c51271","observation_id":"26656735-5c28-480b-b82b-1b9c3cc12934","resolution":{"observed_at":"2026-05-11T21:06:13.742801Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2605.04503","last_updated":"2026-05-06T05:12:41Z","snapshot_observed_at":"2026-08-02T14:20:11.154625Z","submitted_at":"2026-05-06T05:12:41Z","title":"DiffCap-Bench: A Comprehensive, Challenging, Robust Benchmark for Image Difference Captioning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T17:56:47.621050Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2605.04503"},"observation_digest":"sha256:1ad8fcf444b4cd0c32b140ec92161b87ab3296a372bc42aceed4d4fda8cd41f4","observation_id":"4a05086d-b6ef-4a21-a23c-6ec02891612f","resolution":{"observed_at":"2026-05-09T06:55:44.332241Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2605.07457","last_updated":"2026-05-08T09:05:08Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:05:08Z","title":"EditRefiner: A Human-Aligned Agentic Framework for Image Editing Refinement","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-11T02:19:16.677800Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2605.07457"},"observation_digest":"sha256:05aaebe0367a1d49d33de8d322c2d463e439f3b4916bdb1c6b40650218d846ff","observation_id":"d5ee3d57-1b84-454c-abf6-29bfdf6c3c4b","resolution":{"observed_at":"2026-05-11T03:45:57.143745Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2605.11818","last_updated":"2026-05-12T09:09:01Z","snapshot_observed_at":"2026-08-02T21:46:06.216835Z","submitted_at":"2026-05-12T09:09:01Z","title":"RevealLayer: Disentangling Hidden and Visible Layers via Occlusion-Aware Image Decomposition","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-13T07:46:50.540528Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2605.11818"},"observation_digest":"sha256:d0320e779d705944b33425b3dc139778b108b843f8141576ebe83f850d9d1431","observation_id":"da7de08d-0e2b-4a87-95aa-7c84b53a9bd0","resolution":{"observed_at":"2026-05-13T07:47:32.725178Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2605.23518","last_updated":"2026-05-22T11:33:43Z","snapshot_observed_at":"2026-08-02T17:55:38.256248Z","submitted_at":"2026-05-22T11:33:43Z","title":"VINS-120K: Ultra High-Resolution Image Editing with A Large-Scale Dataset","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-25T04:21:05.811662Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2605.23518"},"observation_digest":"sha256:d4d8a1782c62793a86995e2ad8bb35c788ce09aaff5a3793441fd8875f9059db","observation_id":"436611eb-b6a0-4ca0-b99e-75355ce4090d","resolution":{"observed_at":"2026-05-25T04:25:19.654181Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2605.24762","last_updated":"2026-05-23T22:49:04Z","snapshot_observed_at":"2026-08-05T21:08:24.878554Z","submitted_at":"2026-05-23T22:49:04Z","title":"4KLSDB: A Large-Scale Dataset for 4K Image Restoration and Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T13:04:35.729632Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2605.24762"},"observation_digest":"sha256:ce43c13f9f4c4b44fa7a8262991cbef639b7f32d1a7526fdbb265c48ba3f2e04","observation_id":"36e30a5a-3c3a-4653-be3b-280ba0fa642f","resolution":{"observed_at":"2026-06-30T13:04:39.846480Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2605.25343","last_updated":"2026-05-25T01:57:43Z","snapshot_observed_at":"2026-07-06T23:35:16.647496Z","submitted_at":"2026-05-25T01:57:43Z","title":"Toward Native Multimodal Modeling: A Roadmap","version":1},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-06-29T22:58:38.610609Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2605.25343"},"observation_digest":"sha256:1508e8e07d0eaf08303c6852a3c146f5c6e611ee08c141296314ca5cf9005696","observation_id":"b59b269e-e5a5-41ef-90f8-03d485665b69","resolution":{"observed_at":"2026-06-29T23:04:01.819343Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2606.00931","last_updated":"2026-05-30T23:37:55Z","snapshot_observed_at":"2026-08-01T00:57:33.201756Z","submitted_at":"2026-05-30T23:37:55Z","title":"CV-Arena: An Open Benchmark for Instructional Computer Vision Problem Solving with Human-AI Collaborative Preferences","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T18:36:46.381564Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2606.00931"},"observation_digest":"sha256:4e5625f0984f21c1fefdeff59ad05808ec18565478dc8b15a860d050a770f595","observation_id":"c4df03ba-0e52-4237-ac40-9bdd834b42b4","resolution":{"observed_at":"2026-06-28T20:32:37.585601Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2606.01985","last_updated":"2026-06-01T09:46:10Z","snapshot_observed_at":"2026-08-05T13:43:57.622962Z","submitted_at":"2026-06-01T09:46:10Z","title":"MT-EditFlow: Reinforcement Learning for Multi-Turn Image Editing with Flow Matching","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T15:07:29.897089Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2606.01985"},"observation_digest":"sha256:63aa9d9a875ff8e9ac71bdd8d0667f1c7c2e1235a07d11ce4e69f02c8aae8eb6","observation_id":"1b4b6d20-dac2-4839-9f1b-33272d7f929e","resolution":{"observed_at":"2026-07-01T22:46:18.584904Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2606.11188","last_updated":"2026-06-09T17:59:28Z","snapshot_observed_at":"2026-07-06T23:50:16.299969Z","submitted_at":"2026-06-09T17:59:28Z","title":"ARM: An AutoRegressive Large Multimodal Model with Unified Discrete Representations","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T13:29:11.526106Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2606.11188"},"observation_digest":"sha256:7c4d519337ec79c6cb9941eb439d1c8be412697fcba4080804e10d34c31d0e0b","observation_id":"534dfaa2-c564-4453-bbed-dafe385de0fa","resolution":{"observed_at":"2026-07-03T05:07:38.532718Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2606.23221","last_updated":"2026-06-22T12:09:29Z","snapshot_observed_at":"2026-07-06T23:57:57.606047Z","submitted_at":"2026-06-22T12:09:29Z","title":"RS-Gen: A Multi-Stage Agentic Framework for Reasoning and Search-Augmented Image Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T08:59:40.467458Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2606.23221"},"observation_digest":"sha256:5a359f68644252db98a3b16171c941f384ebd2a8975f19d94fcfa7e039a96555","observation_id":"3da4303e-8f36-45ed-be79-3869461299d6","resolution":{"observed_at":"2026-07-04T10:19:47.387023Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2606.25445","last_updated":"2026-06-24T06:15:24Z","snapshot_observed_at":"2026-07-06T23:59:52.373272Z","submitted_at":"2026-06-24T06:15:24Z","title":"C3-Bench: A Context-Aware Change Captioning Benchmark","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-25T21:02:52.529391Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2606.25445"},"observation_digest":"sha256:e548cbe145b4dff7bbad5c86cb87cd06d2e3539cdf782b4eb44bd0526e083e5e","observation_id":"c43dfba4-4f94-4c88-b74e-b40e9fc7fc6b","resolution":{"observed_at":"2026-07-04T19:50:10.129798Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2606.26872","last_updated":"2026-06-26T15:03:59Z","snapshot_observed_at":"2026-08-02T19:28:00.118985Z","submitted_at":"2026-06-25T10:58:25Z","title":"SpatialFlow-GRPO: Where Spatial Credit Drives Image Editing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T05:37:23.569942Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2606.26872"},"observation_digest":"sha256:ddf3dfa450a0fbb4fac7996849419fa419f67bcab56662af63ca56b51fc8aac9","observation_id":"52529aec-afd3-47e1-8834-fcef64575f5c","resolution":{"observed_at":"2026-07-04T12:59:52.747454Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2606.26872","last_updated":"2026-06-26T15:03:59Z","snapshot_observed_at":"2026-08-02T19:28:00.118985Z","submitted_at":"2026-06-25T10:58:25Z","title":"SpatialFlow-GRPO: Where Spatial Credit Drives Image Editing","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T05:03:56.872939Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2606.26872"},"observation_digest":"sha256:5e663c945669c01f84050fee00d03aeaaf89e2a7e9379293a3de3f48a508cb68","observation_id":"34f32cd6-799f-4f1a-91a9-6759193f622c","resolution":{"observed_at":"2026-06-29T18:33:51.299442Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":"2404.09990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-09T21:16:34.372456Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":"cs.CV","work_id":"9d8a82a0-b08a-44fe-9165-95aded3e32be","year":2024},"citing_paper":{"arxiv_id":"2607.07051","last_updated":"2026-07-08T06:26:28Z","snapshot_observed_at":"2026-08-06T22:54:39.476609Z","submitted_at":"2026-07-08T06:26:28Z","title":"Making Implicit Preservation Intent Explicit in Conversational Image Editing","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-09T21:07:55.368221Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2607.07051"},"observation_digest":"sha256:3f6ecc72f89c0f06bb2e813d9babdfe9e9e6a886db2e2e8bb412427cdc4bd3cb","observation_id":"4797416e-52e9-45fc-925c-72e14e7ef025","resolution":{"observed_at":"2026-07-09T21:16:34.373605Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-07-30T18:11:58.077397Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing.arXiv preprint arXiv:2404.09990, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23588","last_updated":"2026-07-26T10:36:24Z","snapshot_observed_at":"2026-08-06T17:14:20.405951Z","submitted_at":"2026-07-26T10:36:24Z","title":"JarvisHub: An Open Harness for Canvas-Native Multimodal Creative Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-30T18:11:58.077397Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2607.23588"},"observation_digest":"sha256:06d8b965d1c8e5edcd20f7bf861145df40c1a82e68b3d82619cfaa4c768d4b11","observation_id":"db7a25dc-37d6-4961-94f6-a85ebf4cbc0e","resolution":{"observed_at":"2026-07-30T18:11:58.077397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2404.09990/citation-record","integrity":"/paper/2404.09990/integrity","json":"/paper/2404.09990/citation-record.json","paper":"/paper/2404.09990"},"outbound":[],"paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T18:00:30.424554Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 38 inbound Pith citation observations for arXiv:2404.09990."}