{"as_of":"2026-08-17T09:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:565432d448e5d3797d32e94a402e282c9e265006883fdce7545e49a486e073f6","coverage":[{"denominator":73,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":73,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:02:23.393218Z","state":"measured"},{"denominator":86,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":86,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T00:54:58.345281Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:09:50.723506Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"cited_work":{"arxiv_id":"2505.16707","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16707","snapshot_observed_at":"2026-07-04T13:09:50.723506Z","title":"Kris-bench: Benchmarking next-level intelligent image editing models.arXivpreprint","venue":null,"work_id":"9a5edff2-b324-49b1-a634-2ebc8e9c0cdb","year":2025},"citing_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-08-17T01:11:44.872398Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-10T16:23:41.854132Z"},"links":{"cited_paper":"/paper/2505.16707","citing_paper":"/paper/2505.14683"},"observation_digest":"sha256:cf94f57d477068a19873bb48180f3eca90210eccc9da4c1196e70eaee184d52d","observation_id":"118e99ae-003e-421e-a9e3-aa97f602eb0b","resolution":{"observed_at":"2026-05-10T16:23:42.052499Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16707","snapshot_observed_at":"2026-08-04T18:03:50.143909Z","title":"Kris-bench: Benchmarking next-level intelli- gent image editing models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10259","last_updated":"2025-09-12T14:02:52Z","snapshot_observed_at":"2026-08-16T01:33:49.400692Z","submitted_at":"2025-09-12T14:02:52Z","title":"Mask Consistency Regularization in Object Removal","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T18:03:50.143909Z"},"links":{"cited_paper":"/paper/2505.16707","citing_paper":"/paper/2509.10259"},"observation_digest":"sha256:7e836c1e3ef15a1ee5984ebb15bcb858b1919cdc7def25c438b3061a3eb3c2a1","observation_id":"126bcf1a-0cce-449a-8f72-e10ef27ac6e5","resolution":{"observed_at":"2026-08-04T18:03:50.143909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"cited_work":{"arxiv_id":"2505.16707","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16707","snapshot_observed_at":"2026-07-04T13:09:50.723506Z","title":"Kris-bench: Benchmarking next-level intelligent image editing models.arXivpreprint","venue":null,"work_id":"9a5edff2-b324-49b1-a634-2ebc8e9c0cdb","year":2025},"citing_paper":{"arxiv_id":"2602.23622","last_updated":"2026-05-19T03:38:52Z","snapshot_observed_at":"2026-08-15T15:16:14.894154Z","submitted_at":"2026-02-27T02:59:34Z","title":"DLEBench: Evaluating Small-scale Object Editing Ability for Instruction-based Image Editing Model","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-21T12:04:08.487678Z"},"links":{"cited_paper":"/paper/2505.16707","citing_paper":"/paper/2602.23622"},"observation_digest":"sha256:2f571674007ef04e838e07f817d76ef48703c71c5e8cbe6f0fca8580cacde974","observation_id":"e35f7ad1-2253-49b3-9b30-4a1d9e47221a","resolution":{"observed_at":"2026-05-21T12:05:04.989501Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16707","snapshot_observed_at":"2026-07-14T22:40:05.611340Z","title":"arXiv preprint arXiv:2505.16707 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.11734","last_updated":"2026-06-29T07:23:54Z","snapshot_observed_at":"2026-08-14T18:04:56.696770Z","submitted_at":"2026-03-12T09:38:46Z","title":"VTEdit-Bench: A Comprehensive Benchmark for Multi-Reference Image Editing Models in Virtual Try-On","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-14T22:40:05.611340Z"},"links":{"cited_paper":"/paper/2505.16707","citing_paper":"/paper/2603.11734"},"observation_digest":"sha256:37717f464296bd9d0a47f19a80051d9c375e1c688ce509e7b40c7e93edca93d7","observation_id":"56b8bdfa-bd40-405d-af63-65deed637f19","resolution":{"observed_at":"2026-07-14T22:40:05.611340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"cited_work":{"arxiv_id":"2505.16707","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16707","snapshot_observed_at":"2026-07-04T13:09:50.723506Z","title":"Kris-bench: Benchmarking next-level intelligent image editing models.arXivpreprint","venue":null,"work_id":"9a5edff2-b324-49b1-a634-2ebc8e9c0cdb","year":2025},"citing_paper":{"arxiv_id":"2604.03156","last_updated":"2026-06-17T05:47:04Z","snapshot_observed_at":"2026-08-15T19:27:08.180345Z","submitted_at":"2026-04-03T16:27:02Z","title":"CAMEO: A Conditional and Quality-Aware Multi-Agent Image Editing Orchestrator","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-13T20:58:59.346867Z"},"links":{"cited_paper":"/paper/2505.16707","citing_paper":"/paper/2604.03156"},"observation_digest":"sha256:7a019ad6d40628992be3127a0e9f2c7879e3668fdc9e31c2e736f8cdb6da5538","observation_id":"f6ee6019-b680-4b3b-bb83-e07952fc5230","resolution":{"observed_at":"2026-05-13T21:03:20.276987Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"cited_work":{"arxiv_id":"2505.16707","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16707","snapshot_observed_at":"2026-07-04T13:09:50.723506Z","title":"Kris-bench: Benchmarking next-level intelligent image editing models.arXivpreprint","venue":null,"work_id":"9a5edff2-b324-49b1-a634-2ebc8e9c0cdb","year":2025},"citing_paper":{"arxiv_id":"2604.25477","last_updated":"2026-04-28T10:30:01Z","snapshot_observed_at":"2026-08-11T13:12:13.526089Z","submitted_at":"2026-04-28T10:30:01Z","title":"DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-07T16:44:23.162726Z"},"links":{"cited_paper":"/paper/2505.16707","citing_paper":"/paper/2604.25477"},"observation_digest":"sha256:9a92c95d1fe003e24251113abc2ff021e57d71b08d3fee05cd42e5e2df72c2d7","observation_id":"985954a5-013f-4361-bb59-b5aa280e606d","resolution":{"observed_at":"2026-05-11T23:36:14.561125Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"cited_work":{"arxiv_id":"2505.16707","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16707","snapshot_observed_at":"2026-07-04T13:09:50.723506Z","title":"Kris-bench: Benchmarking next-level intelligent image editing models.arXivpreprint","venue":null,"work_id":"9a5edff2-b324-49b1-a634-2ebc8e9c0cdb","year":2025},"citing_paper":{"arxiv_id":"2605.07457","last_updated":"2026-05-08T09:05:08Z","snapshot_observed_at":"2026-08-13T04:39:19.143739Z","submitted_at":"2026-05-08T09:05:08Z","title":"EditRefiner: A Human-Aligned Agentic Framework for Image Editing Refinement","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-11T02:19:16.677800Z"},"links":{"cited_paper":"/paper/2505.16707","citing_paper":"/paper/2605.07457"},"observation_digest":"sha256:57cd60075a19c47bcfa0538c284d31ca4397557d2697ee6a83e22eb6fa9eb94b","observation_id":"66e84a1a-27d9-48c6-953f-f692cc461836","resolution":{"observed_at":"2026-05-11T03:45:56.946683Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16707","snapshot_observed_at":"2026-07-12T20:04:25.886330Z","title":"Kris-bench: Benchmarking next-level intelligent image editing models.arXiv preprint arXiv:2505.16707, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05172","last_updated":"2026-04-16T08:05:42Z","snapshot_observed_at":"2026-08-14T03:18:56.685775Z","submitted_at":"2026-04-16T08:05:42Z","title":"Is This Edit Correct? A Multi-Dimensional Benchmark for Reasoning-Aware Image Editing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-12T20:04:25.886330Z"},"links":{"cited_paper":"/paper/2505.16707","citing_paper":"/paper/2606.05172"},"observation_digest":"sha256:ef01a46bad773b838f779770ccaf3fd35ba0e750da130c1d954f132881d117c9","observation_id":"cb5d0db1-29bb-46f9-b75a-1f19839b3b74","resolution":{"observed_at":"2026-07-12T20:04:25.886330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"cited_work":{"arxiv_id":"2505.16707","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16707","snapshot_observed_at":"2026-07-04T13:09:50.723506Z","title":"Kris-bench: Benchmarking next-level intelligent image editing models.arXivpreprint","venue":null,"work_id":"9a5edff2-b324-49b1-a634-2ebc8e9c0cdb","year":2025},"citing_paper":{"arxiv_id":"2606.26551","last_updated":"2026-06-26T07:00:33Z","snapshot_observed_at":"2026-08-01T08:48:43.434747Z","submitted_at":"2026-06-25T02:57:34Z","title":"PhyEditBench: A Real-World Multi-Stage Benchmark for Physics-Aware Image Editing","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-26T05:28:20.527237Z"},"links":{"cited_paper":"/paper/2505.16707","citing_paper":"/paper/2606.26551"},"observation_digest":"sha256:6f0214d4a5ac0a364607efc8c4254920f1d060bf9273a101a58f19f1c04ec083","observation_id":"9de74540-5a2a-4abd-bc3f-8c45266eb76c","resolution":{"observed_at":"2026-07-04T13:09:50.725404Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"cited_work":{"arxiv_id":"2505.16707","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16707","snapshot_observed_at":"2026-07-04T13:09:50.723506Z","title":"Kris-bench: Benchmarking next-level intelligent image editing models.arXivpreprint","venue":null,"work_id":"9a5edff2-b324-49b1-a634-2ebc8e9c0cdb","year":2025},"citing_paper":{"arxiv_id":"2606.26551","last_updated":"2026-06-26T07:00:33Z","snapshot_observed_at":"2026-08-01T08:48:43.434747Z","submitted_at":"2026-06-25T02:57:34Z","title":"PhyEditBench: A Real-World Multi-Stage Benchmark for Physics-Aware Image Editing","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-29T05:16:26.506412Z"},"links":{"cited_paper":"/paper/2505.16707","citing_paper":"/paper/2606.26551"},"observation_digest":"sha256:e4133e1914470f83fecbbc77ffe213efdd4b5534065b4502c8686e431ca06ac5","observation_id":"c86bb490-4143-4f94-8e62-b2b7e0b5811e","resolution":{"observed_at":"2026-06-29T17:33:45.718887Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"cited_work":{"arxiv_id":"2505.16707","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16707","snapshot_observed_at":"2026-07-04T13:09:50.723506Z","title":"Kris-bench: Benchmarking next-level intelligent image editing models.arXivpreprint","venue":null,"work_id":"9a5edff2-b324-49b1-a634-2ebc8e9c0cdb","year":2025},"citing_paper":{"arxiv_id":"2606.26738","last_updated":"2026-07-15T11:15:44Z","snapshot_observed_at":"2026-08-12T22:11:57.422164Z","submitted_at":"2026-06-25T08:20:34Z","title":"Do Image Editing Models Understand Lighting?","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-26T05:29:42.024146Z"},"links":{"cited_paper":"/paper/2505.16707","citing_paper":"/paper/2606.26738"},"observation_digest":"sha256:28687d49484753a8dcf3de28dc32722dcb8a48d49b951fb505763f176360e47f","observation_id":"89381468-525c-43ab-99b9-6d12dcd3cdaa","resolution":{"observed_at":"2026-07-04T13:09:50.488539Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16707","snapshot_observed_at":"2026-08-02T10:10:09.315637Z","title":"Kris-bench: Benchmarking next-level intelligent image editing models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26738","last_updated":"2026-07-15T11:15:44Z","snapshot_observed_at":"2026-08-12T22:11:57.422164Z","submitted_at":"2026-06-25T08:20:34Z","title":"Do Image Editing Models Understand Lighting?","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T10:10:09.315637Z"},"links":{"cited_paper":"/paper/2505.16707","citing_paper":"/paper/2606.26738"},"observation_digest":"sha256:c5540bdb6001a3ff8ed32f5f7740476c2f9800fb0cca5ffd7f2ee32c76516a9e","observation_id":"afa2357c-c003-493a-9352-cd2600d6c2c1","resolution":{"observed_at":"2026-08-02T10:10:09.315637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16707","snapshot_observed_at":"2026-08-05T00:54:58.345281Z","title":"arXiv preprint arXiv:2505.16707 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00490","last_updated":"2026-08-01T07:26:20Z","snapshot_observed_at":"2026-08-14T10:58:22.798536Z","submitted_at":"2026-08-01T07:26:20Z","title":"Image-Space Rule Discovery","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T00:54:58.345281Z"},"links":{"cited_paper":"/paper/2505.16707","citing_paper":"/paper/2608.00490"},"observation_digest":"sha256:df7f051e6f324fd685416c06ecffd93a8f850c5ca4a54e225f51444e4a5f842d","observation_id":"21d7eb41-3c11-4276-8f38-4e7a59db3aaf","resolution":{"observed_at":"2026-08-05T00:54:58.345281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.16707/citation-record","integrity":"/paper/2505.16707/integrity","json":"/paper/2505.16707/citation-record.json","paper":"/paper/2505.16707"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.14666","last_updated":"2025-04-20T16:14:28Z","snapshot_observed_at":"2026-08-16T11:41:23.765694Z","submitted_at":"2025-04-20T16:14:28Z","title":"Generative Multimodal Pretraining with Discrete Diffusion Timestep Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14666","snapshot_observed_at":"2026-08-07T15:02:15.374933Z","title":"Generative multimodal pretraining with discrete diffusion timestep tokens","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:15.374933Z"},"links":{"cited_paper":"/paper/2504.14666","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:fc373dcf91a5f6f98b34997706cfbce4d00c1be3e8dbadaeb58d702457d7d8d7","observation_id":"309487b3-e06c-48ea-abca-18d367c5cd16","resolution":{"observed_at":"2026-08-07T15:02:15.374933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-07T15:02:15.459381Z","title":"Emu3: Next-token prediction is all you need","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:15.459381Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:89a15c48152440def4813a6c7c66867bad33e7944f940782be4a269ba7665bc9","observation_id":"b3565ffd-92b3-48dc-909e-d0953b23e199","resolution":{"observed_at":"2026-08-07T15:02:15.459381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.35416","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:24.368978Z","title":"Diffusion model-based image editing: A survey","venue":null,"work_id":"18def098-ca6d-4759-869f-354e8c15bae4","year":2025},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:15.530552Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:910b79f11bbebff024739550d169add1ba47293bf995d75d1a3f5a50247abaa6","observation_id":"e56696c7-96ad-4237-a16c-1613ab04eeb0","resolution":{"observed_at":"2026-08-07T15:02:24.468415Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:31.753841Z","title":"Magicbrush: A manually annotated dataset for instruction-guided image editing","venue":null,"work_id":"2e1456f5-ead2-4c9e-af5c-a949575b2e6f","year":2023},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:15.639122Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:99053035fb6a39bf8df1229763ba846dc95551a430987e5eea739fca469992d5","observation_id":"6237f98f-52da-4c53-8eb8-72dde0704d4e","resolution":{"observed_at":"2026-08-07T15:02:31.867542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:31.614737Z","title":"Instructpix2pix: Learning to follow image editing instructions","venue":null,"work_id":"b7c46569-e783-4aef-b93e-5d933f7694af","year":2023},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:15.751588Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:7e486484c6c22270ef73827524bd9c37976b65dfe9410d6549b36e845cd3b43b","observation_id":"34b26f79-3b6f-4dc4-a775-28435af2b91e","resolution":{"observed_at":"2026-08-07T15:02:31.659816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:31.363108Z","title":"Hyperstyle: Stylegan inversion with hypernetworks for real image editing","venue":null,"work_id":"6becbd96-7490-46ca-a210-f098f387edcf","year":2022},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:16.096955Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:f6b0eb0a0c721f2a98b256f8367098e677ef3820073058444b3165947369e61f","observation_id":"d5cdce0e-4bfd-48c1-9821-73734448e2b5","resolution":{"observed_at":"2026-08-07T15:02:31.473151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:31.244507Z","title":"Spaceedit: Learning a unified editing space for open-domain image color editing","venue":null,"work_id":"e6601c43-be0b-490f-bb9e-747c12bfacb6","year":2022},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:16.504412Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:7f89964131b3ccf73ab86292370c644a2b60bfc86b8706595206f97c34e7dd1d","observation_id":"fad12e28-8953-40f0-ba9c-0e99e3430ab2","resolution":{"observed_at":"2026-08-07T15:02:31.307394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-08-15T10:26:22.896514Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17761","snapshot_observed_at":"2026-08-07T15:02:16.594197Z","title":"Step1x-edit: A practical framework for general image editing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:16.594197Z"},"links":{"cited_paper":"/paper/2504.17761","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:9c0a1912b2ddae35033d656df76f9e509612e46203384a298a9fe57756c36fe9","observation_id":"25e527ad-b55b-4b04-8b6d-e80107cefb9a","resolution":{"observed_at":"2026-08-07T15:02:16.594197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15738","last_updated":"2025-03-29T04:08:47Z","snapshot_observed_at":"2026-08-12T13:55:13.088452Z","submitted_at":"2024-11-24T07:02:56Z","title":"AnyEdit: Mastering Unified High-Quality Image Editing for Any Idea","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15738","snapshot_observed_at":"2026-08-07T15:02:16.680285Z","title":"Anyedit: Mastering unified high-quality image editing for any idea","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:16.680285Z"},"links":{"cited_paper":"/paper/2411.15738","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:ecf4c3c54c51e78e23854a9a2687e25795b99b701ed4b010726bdb705249795d","observation_id":"e322eae4-76f3-49ad-94f2-997e7de49d88","resolution":{"observed_at":"2026-08-07T15:02:16.680285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10639","last_updated":"2025-03-13T17:59:59Z","snapshot_observed_at":"2026-08-16T19:00:31.865937Z","submitted_at":"2025-03-13T17:59:59Z","title":"GoT: Unleashing Reasoning Capability of Multimodal Large Language Model for Visual Generation and Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10639","snapshot_observed_at":"2026-08-07T15:02:16.805570Z","title":"Got: Unleashing reasoning capability of multimodal large language model for visual generation and editing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:16.805570Z"},"links":{"cited_paper":"/paper/2503.10639","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:7af40c21c1a2e11b4cf37053ecc56aaea186a25ea996177b99982ff7c4da6382","observation_id":"2a0928ba-56dc-4f6e-a987-3068b786be3e","resolution":{"observed_at":"2026-08-07T15:02:16.805570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07536","last_updated":"2025-03-11T03:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-10T17:04:14Z","title":"LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07536","snapshot_observed_at":"2026-08-07T15:02:16.891364Z","title":"Lmm-r1: Empowering 3b lmms with strong reasoning abilities through two-stage rule-based rl","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:16.891364Z"},"links":{"cited_paper":"/paper/2503.07536","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:ceb66222894412864f9f09a2d72a40639ce6ac8bf90d8269edc23a9082f7697b","observation_id":"59f4fc20-7288-4d80-ba87-b99cb1092b4a","resolution":{"observed_at":"2026-08-07T15:02:16.891364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:31.016610Z","title":"Dall-eval: Probing the reasoning skills and social biases of text-to-image generation models","venue":null,"work_id":"c4ee7903-ec03-4838-8eaa-fcf6a8b37937","year":2023},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:16.992014Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:d22692d1e51543ef8958f63738d22d91a97ab6df7ef053d5758981a6b8b04359","observation_id":"6b67d462-04ea-4df1-ac7a-65a788cb2310","resolution":{"observed_at":"2026-08-07T15:02:31.123906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:30.741157Z","title":"Smartedit: Exploring complex instruction-based image editing with multimodal large language models","venue":null,"work_id":"d59da0ad-c3c9-4c95-a03c-761c780accea","year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:17.113467Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:f4aece66a83b9177601a978f4d4f3f0a42486234c43430ad87c371801dcefd01","observation_id":"823452fe-5498-4174-8fbc-3a109baaac79","resolution":{"observed_at":"2026-08-07T15:02:30.841829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07265","last_updated":"2026-06-02T17:11:50Z","snapshot_observed_at":"2026-08-16T12:51:32.079370Z","submitted_at":"2025-03-10T12:47:53Z","title":"WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07265","snapshot_observed_at":"2026-08-07T15:02:17.872440Z","title":"Wise: A world knowledge-informed semantic evaluation for text-to-image generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:17.872440Z"},"links":{"cited_paper":"/paper/2503.07265","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:efba662e63dc5ee1cb0ba869f0872e8a1f83c9e403057fcb1b8bf24127041d2e","observation_id":"130e09ea-d2d1-4807-9936-288b3637efc5","resolution":{"observed_at":"2026-08-07T15:02:17.872440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06632","last_updated":"2025-04-09T07:13:08Z","snapshot_observed_at":"2026-08-16T12:42:48.040474Z","submitted_at":"2025-04-09T07:13:08Z","title":"PosterMaker: Towards High-Quality Product Poster Generation with Accurate Text Rendering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.06632","snapshot_observed_at":"2026-08-07T15:02:17.970176Z","title":"Postermaker: Towards high-quality product poster generation with accurate text rendering","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:17.970176Z"},"links":{"cited_paper":"/paper/2504.06632","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:b1e898d9d64a628be7d6818a82b0f8b64588341c9b1467bdef01fa991a29067f","observation_id":"29ab2a45-37e1-4aae-95f5-3144ca400c86","resolution":{"observed_at":"2026-08-07T15:02:17.970176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:30.433516Z","title":"Enhancing image editing with chain-of-thought reasoning and multimodal large language models","venue":null,"work_id":"70f3d41d-b74b-4296-a69c-83c593e60e92","year":2025},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:18.118368Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:d5b398580c1d800c322980074db3eb78cd0e4b090ba51f87b3581f88c7536c5c","observation_id":"349a473c-d2e3-4f13-ae5d-cda8e3a92cf0","resolution":{"observed_at":"2026-08-07T15:02:30.617138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14555","last_updated":"2024-06-20T17:58:52Z","snapshot_observed_at":"2026-08-16T13:40:59.928554Z","submitted_at":"2024-06-20T17:58:52Z","title":"A Survey of Multimodal-Guided Image Editing with Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14555","snapshot_observed_at":"2026-08-07T15:02:18.230361Z","title":"A survey of multimodal-guided image editing with text-to-image diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:18.230361Z"},"links":{"cited_paper":"/paper/2406.14555","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:8d4856f43edb4bba5de1dd5b3c63fdf9897c2099bbde3b07aac0253b0d57fedc","observation_id":"878b40ac-f11b-43b7-a642-64d481dac74d","resolution":{"observed_at":"2026-08-07T15:02:18.230361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:30.292932Z","title":"Multimodal image synthesis and editing: A survey and taxonomy","venue":null,"work_id":"8e614a53-26f6-4f35-97f1-e50a8c644b41","year":2023},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:18.331577Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:d856f4fb5d50133c5cde9265c2ed1707028017b860aa8c8d3bca49c9aa95be7d","observation_id":"5c0a23dc-b10a-42a2-a5fa-a2396ea59955","resolution":{"observed_at":"2026-08-07T15:02:30.353085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:30.133839Z","title":"Fleet, Radu Soricut, Jason Baldridge, Mohammad Norouzi, Peter Anderson, and William Chan","venue":null,"work_id":"2b1d49d5-7bc0-42e9-a0c4-0f87eba1ae78","year":2023},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:18.430034Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:e3ef452d60128160b6e3344b8da9040f8178bb049cf13747b9cc7a1283e33f2c","observation_id":"2c66f45a-baff-45be-80d4-1408aebfc3b9","resolution":{"observed_at":"2026-08-07T15:02:30.222398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02426","last_updated":"2023-10-03T20:46:10Z","snapshot_observed_at":"2026-08-16T14:55:20.395869Z","submitted_at":"2023-10-03T20:46:10Z","title":"EditVal: Benchmarking Diffusion Based Text-Guided Image Editing Methods","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02426","snapshot_observed_at":"2026-08-07T15:02:18.552724Z","title":"Editval: Benchmarking diffusion based text-guided image editing methods, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:18.552724Z"},"links":{"cited_paper":"/paper/2310.02426","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:674915fc576c0efaeeb392197897fae362d67bba50e126e1594170cadd94c25d","observation_id":"0ab5a83b-be6c-4f28-96cb-44d750368d0f","resolution":{"observed_at":"2026-08-07T15:02:18.552724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:30.006737Z","title":"Imagic: Text-based real image editing with diffusion models","venue":null,"work_id":"5c79d09c-474b-4245-ab5b-39a543eeb91d","year":2023},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:18.664486Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:3203b00cbc7c8d3b3e89b333cf7f5473af43345064ca664fceb8ba9f22378f5a","observation_id":"20b816e1-5d43-477b-8e3f-3529f963c43c","resolution":{"observed_at":"2026-08-07T15:02:30.027875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:29.871005Z","title":"I2ebench: A comprehensive benchmark for instruction-based image editing","venue":null,"work_id":"6eb9b7db-4ef0-4d56-b737-03ec6c9d15bf","year":null},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:18.748710Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:ddfc8a256a3620b56d8c83453b32b489a41dc3cf2142dc7fc7593f326c88da8c","observation_id":"51b1847c-dd87-4ea2-9b18-a4430f4461b2","resolution":{"observed_at":"2026-08-07T15:02:29.932577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14482","last_updated":"2025-08-17T13:06:03Z","snapshot_observed_at":"2026-08-16T12:48:53.404744Z","submitted_at":"2025-03-18T17:53:29Z","title":"ICE-Bench: A Unified and Comprehensive Benchmark for Image Creating and Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14482","snapshot_observed_at":"2026-08-07T15:02:18.859063Z","title":"Ice-bench: A unified and comprehensive benchmark for image creating and editing, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:18.859063Z"},"links":{"cited_paper":"/paper/2503.14482","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:d0733ea5d02e85ce8a51181353944b4d0336584285e53334aa661b942c8d2dea","observation_id":"0f2b06b6-95f6-4bda-a215-dc60ee6cdf7d","resolution":{"observed_at":"2026-08-07T15:02:18.859063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11190","last_updated":"2024-05-31T07:24:55Z","snapshot_observed_at":"2026-08-16T13:51:42.771621Z","submitted_at":"2024-05-18T06:03:42Z","title":"ReasonPix2Pix: Instruction Reasoning Dataset for Advanced Image Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11190","snapshot_observed_at":"2026-08-07T15:02:18.948901Z","title":"Reasonpix2pix: Instruction reasoning dataset for advanced image editing, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:18.948901Z"},"links":{"cited_paper":"/paper/2405.11190","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:e9d32cacd0c08b625f5166720f766e6c5489008ef4b36d7251b151c3832c5fb8","observation_id":"14ab3068-66c6-42fd-9074-89f6808faafe","resolution":{"observed_at":"2026-08-07T15:02:18.948901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:29.755786Z","title":"Emu edit: Precise image editing via recognition and generation tasks","venue":null,"work_id":"f69c0451-196e-48b8-8a6b-148f06ebc711","year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:19.055673Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:78ce002b1c219f13fcd165ec8de4281dbcbf4b11b6c08a48c44431b53dc1c7c7","observation_id":"b581966b-fd95-440e-9f83-846e1a6cf04d","resolution":{"observed_at":"2026-08-07T15:02:29.808318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02826","last_updated":"2025-05-27T15:54:58Z","snapshot_observed_at":"2026-08-16T12:44:10.399972Z","submitted_at":"2025-04-03T17:59:56Z","title":"Envisioning Beyond the Pixels: Benchmarking Reasoning-Informed Visual Editing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02826","snapshot_observed_at":"2026-08-07T15:02:19.159437Z","title":"Envisioning beyond the pixels: Benchmarking reasoning-informed visual editing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:19.159437Z"},"links":{"cited_paper":"/paper/2504.02826","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:5b9b199fb099dc638efeeb5ab4935fe2c87513220f14a2e0ee5ac24797128a55","observation_id":"666b9b1c-9535-4cd4-baa4-15a33dc87ff3","resolution":{"observed_at":"2026-08-07T15:02:19.159437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:29.659047Z","title":"A revision of bloom’s taxonomy: An overview","venue":null,"work_id":"74832730-3aea-4e45-bdc6-9c0e2ce4da07","year":2002},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:19.259871Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:f483ea23e0c6faa5442dc646de0d69e46a0c6b61670237cbfa463bd2433a1364","observation_id":"b5031415-7987-492b-9b4d-b0ecc2896725","resolution":{"observed_at":"2026-08-07T15:02:29.688249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:29.549612Z","title":"Sine: Single image editing with text-to-image diffusion models","venue":null,"work_id":"d755dec8-ef2f-4f2e-84de-940333fa1047","year":2023},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:19.364611Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:8a95210d3e534a3965bb5d8774e3a754dd8886f94eb8f221ea8b817c239124b2","observation_id":"a2bf4d0a-8cce-4923-a37d-29896e2443ef","resolution":{"observed_at":"2026-08-07T15:02:29.592667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:29.406623Z","title":"Move and act: Enhanced object manipulation and background integrity for image editing","venue":null,"work_id":"ab94e092-bfb5-43b8-873b-68e0daaf963a","year":2025},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:19.460490Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:2deb04cef7527d11c0ed7923c0f1a03e7ad42cc3c090ba2b404a56f135a44835","observation_id":"792f4c1f-e76f-4166-9d3e-c359d87c6e47","resolution":{"observed_at":"2026-08-07T15:02:29.472693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10462","last_updated":"2025-04-02T13:30:29Z","snapshot_observed_at":"2026-08-16T13:42:47.494667Z","submitted_at":"2024-06-15T01:27:58Z","title":"CoMM: A Coherent Interleaved Image-Text Dataset for Multimodal Understanding and Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10462","snapshot_observed_at":"2026-08-07T15:02:19.589481Z","title":"Comm: A coherent interleaved image-text dataset for multimodal understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:19.589481Z"},"links":{"cited_paper":"/paper/2406.10462","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:964dd884258c287af4e2f4922192029a6a01dfd25abbc25ed935ac7fc1af24d0","observation_id":"37bfe57f-34a9-4846-81af-3f372d66cc03","resolution":{"observed_at":"2026-08-07T15:02:19.589481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:29.223644Z","title":"Vision-language models for vision tasks: A survey","venue":null,"work_id":"270387ea-796f-4fed-8f04-ec4e0c177f63","year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:19.707898Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:a2fa88aa453375bef6acc00a92d585b634fe3078d1aa1df81c4d0c4ce5464396","observation_id":"073caaef-787d-4cda-baeb-9fc99fad332b","resolution":{"observed_at":"2026-08-07T15:02:29.316651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01361","last_updated":"2023-11-02T16:11:09Z","snapshot_observed_at":"2026-08-16T14:46:28.830354Z","submitted_at":"2023-11-02T16:11:09Z","title":"GPT-4V(ision) as a Generalist Evaluator for Vision-Language Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01361","snapshot_observed_at":"2026-08-07T15:02:19.792453Z","title":"Gpt-4v (ision) as a generalist evaluator for vision-language tasks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:19.792453Z"},"links":{"cited_paper":"/paper/2311.01361","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:1bb4810458eff88123a8ea72b76515d7adaef86b92952faff536f68ad34e0474","observation_id":"36b2309e-772f-48ff-a0ad-84e677940287","resolution":{"observed_at":"2026-08-07T15:02:19.792453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:29.067888Z","title":"Collaborative score distillation for consistent visual editing","venue":null,"work_id":"4cd126e4-c901-4d65-b93d-63c622ae3525","year":2023},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:19.927493Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:d43ba6daba47cdc7b6e00c69e71dea3bb26de8556c54c7ea186850924ceff653","observation_id":"30cd135d-2886-45b7-83a3-d2d5c7aea4e5","resolution":{"observed_at":"2026-08-07T15:02:29.129598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:28.948793Z","title":"Editgan: High-precision semantic image editing","venue":null,"work_id":"28a0a37a-5af2-4da9-a9f4-75b3143a28bc","year":2021},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:20.040041Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:7d6115396bfc1381fed4f6bbd47d3e07a1009ca4368c23afbf0aa89759d0812a","observation_id":"3a2ee479-066c-46ef-9ce3-9fa95591ad64","resolution":{"observed_at":"2026-08-07T15:02:29.011952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03629","last_updated":"2025-04-29T00:30:03Z","snapshot_observed_at":"2026-08-16T04:52:01.757305Z","submitted_at":"2025-02-05T21:35:48Z","title":"REALEDIT: Reddit Edits As a Large-scale Empirical Dataset for Image Transformations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03629","snapshot_observed_at":"2026-08-07T15:02:20.132372Z","title":"Realedit: Reddit edits as a large-scale empirical dataset for image transformations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:20.132372Z"},"links":{"cited_paper":"/paper/2502.03629","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:f2270c09c716d7bb46ae0e0ee08edb3f0c9ca537a4ac5a2e7947313809e26382","observation_id":"de46c5c4-34bf-4e94-b65d-11ac9e890768","resolution":{"observed_at":"2026-08-07T15:02:20.132372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:28.773250Z","title":"Mllm-as-a-judge: Assessing multimodal llm-as- a-judge with vision-language benchmark","venue":null,"work_id":"2433199c-762f-47bf-b1bc-aaadc16aebb4","year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:20.226907Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:ab99092cd03260b11e25caa1a0d647f618960f884dd05ac7088b5b1fc003aa51","observation_id":"7b580e15-16fd-4119-b882-b5af54639995","resolution":{"observed_at":"2026-08-07T15:02:28.828385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-13T06:43:22.011336Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-07T15:02:20.346495Z","title":"A survey on llm-as-a-judge","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:20.346495Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:cfb7d29411a859f4bcccb31e2f30d664c6112edbf41bad85b8da83b3b82804ef","observation_id":"9c5d4996-a59b-42b5-9afd-f66c71cf0941","resolution":{"observed_at":"2026-08-07T15:02:20.346495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:28.570023Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena","venue":null,"work_id":"f9d01d3d-61fa-4fe8-a1b4-104d45e7e405","year":2023},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:20.466735Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:d3f67c2a333ddfca7f26b2df87f554445d4d668604a26c33f326ed6490cac273","observation_id":"aa281a56-d3cb-4205-9148-de90d577da8e","resolution":{"observed_at":"2026-08-07T15:02:28.669880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02614","last_updated":"2025-05-31T03:25:45Z","snapshot_observed_at":"2026-08-16T12:53:12.749992Z","submitted_at":"2025-03-04T13:34:19Z","title":"Personalized Generation In Large Model Era: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02614","snapshot_observed_at":"2026-08-07T15:02:20.568946Z","title":"Personalized Generation in Large Model Era: A Survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:20.568946Z"},"links":{"cited_paper":"/paper/2503.02614","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:5fb1fa3c423786c8157d2f74645bb107b95e0da694e3e961e65ced9942426481","observation_id":"68756520-ceb8-40b8-999b-4d5530284032","resolution":{"observed_at":"2026-08-07T15:02:20.568946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17525","last_updated":"2025-03-11T02:16:29Z","snapshot_observed_at":"2026-08-16T14:14:54.562269Z","submitted_at":"2024-02-27T14:07:09Z","title":"Diffusion Model-Based Image Editing: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17525","snapshot_observed_at":"2026-08-07T15:02:20.668967Z","title":"Diffusion Model-Based Image Editing: A Survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:20.668967Z"},"links":{"cited_paper":"/paper/2402.17525","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:a90945f8b80ddb2bac576a04de7b01107c1a5355d5b037293447da28badf557f","observation_id":"5b5c2a59-3f54-4635-bd04-b1ae8de39500","resolution":{"observed_at":"2026-08-07T15:02:20.668967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-08-16T16:53:14.231987Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-07T15:02:20.802755Z","title":"Sdedit: Guided image synthesis and editing with stochastic differential equations, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:20.802755Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:9f3c19cee8a7cd0fdbdd64639dd46181944cad13f600a0e26672d2eddfb33e77","observation_id":"1bf73abb-3ddb-41ba-b869-c867bebf8b32","resolution":{"observed_at":"2026-08-07T15:02:20.802755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-08-17T00:44:11.103098Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-07T15:02:20.905494Z","title":"Prompt-to-prompt image editing with cross attention control, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:20.905494Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:fb32f7e74c418f439a9f3257a67c837889678303647466c8a13723dc3f385412","observation_id":"bf8d85b5-760d-48d3-953a-a402ea153180","resolution":{"observed_at":"2026-08-07T15:02:20.905494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:28.356951Z","title":"Blended diffusion for text-driven editing of natural images","venue":null,"work_id":"b230f2ac-6416-44fe-a4ea-877abfb472ac","year":2022},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:20.964577Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:8fbef8e40887ee990128493112e5ff9b1e7b21d6d1a76137c78e55d9ba4e5957","observation_id":"6bc75397-f74e-4246-9021-0a507d1045e5","resolution":{"observed_at":"2026-08-07T15:02:28.445353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:28.180361Z","title":"PersonaHOI: Effortlessly Improving Personalized Face with Human-Object Interaction Generation","venue":null,"work_id":"bcd77623-4bda-4db6-8f19-b3d3f3758fe0","year":2025},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:21.023488Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:d9ab23ae42f742ebdc558ba816f6eb2d0a98baff91a2ecf92e0d91e87fcdf560","observation_id":"2a3d90f9-b3f4-4581-8619-041395be28ad","resolution":{"observed_at":"2026-08-07T15:02:28.250847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:27.916710Z","title":"Null-text inversion for editing real images using guided diffusion models","venue":null,"work_id":"62df9831-3050-4961-90ee-a29999b168f9","year":2023},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:21.152480Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:7a8e4edf56b893980c7035f4153bb576dbb6064d948449ef9c8671fcde2184e8","observation_id":"8a312027-8bd5-43fb-a0df-57e94866f335","resolution":{"observed_at":"2026-08-07T15:02:28.071344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06738","last_updated":"2024-10-17T01:30:33Z","snapshot_observed_at":"2026-08-16T14:35:47.930089Z","submitted_at":"2023-12-11T17:53:45Z","title":"InstructAny2Pix: Flexible Visual Editing via Multimodal Instruction Following","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06738","snapshot_observed_at":"2026-08-07T15:02:21.257563Z","title":"Instructany2pix: Flexible visual editing via multimodal instruction following, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:21.257563Z"},"links":{"cited_paper":"/paper/2312.06738","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:6afadfdf1d03fb0d6208e20070ebdbfb363a77e58816cbae9da32359c7ad6a37","observation_id":"a1e24974-4400-40e4-ac17-605606a1eca9","resolution":{"observed_at":"2026-08-07T15:02:21.257563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18047","last_updated":"2023-05-29T12:24:58Z","snapshot_observed_at":"2026-08-16T15:28:41.997107Z","submitted_at":"2023-05-29T12:24:58Z","title":"InstructEdit: Improving Automatic Masks for Diffusion-based Image Editing With User Instructions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18047","snapshot_observed_at":"2026-08-07T15:02:21.336958Z","title":"Instructedit: Improving automatic masks for diffusion-based image editing with user instructions, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:21.336958Z"},"links":{"cited_paper":"/paper/2305.18047","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:e9097691216695d518226f9eda565af13e346605731c01059548a496831310c5","observation_id":"9cd40d39-3717-4488-82cc-9b1188a15911","resolution":{"observed_at":"2026-08-07T15:02:21.336958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:27.738653Z","title":"Ultraedit: Instruction-based fine-grained image editing at scale","venue":null,"work_id":"a264b461-af53-4d03-a283-93daf52e6107","year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:21.425844Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:df9cf704057f5a1dc5e75567403c8c16aa297095f70b5e98e2450da2a4144b03","observation_id":"c79dbc28-c525-43b8-9d0d-5d067ae8248e","resolution":{"observed_at":"2026-08-07T15:02:27.808728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09618","last_updated":"2024-03-26T22:59:52Z","snapshot_observed_at":"2026-08-16T15:47:35.296904Z","submitted_at":"2023-03-16T19:47:41Z","title":"HIVE: Harnessing Human Feedback for Instructional Visual Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09618","snapshot_observed_at":"2026-08-07T15:02:21.521448Z","title":"Hive: Harnessing human feedback for instructional visual editing, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:21.521448Z"},"links":{"cited_paper":"/paper/2303.09618","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:6043cfad606d8fa4be1d5d94a81d93dd5260d32917f5f9d0990c902b96f1a8af","observation_id":"32d46877-413a-49ab-b10c-c74ec3dd33ed","resolution":{"observed_at":"2026-08-07T15:02:21.521448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18071","last_updated":"2024-09-26T17:18:39Z","snapshot_observed_at":"2026-08-16T13:15:02.191260Z","submitted_at":"2024-09-26T17:18:39Z","title":"FreeEdit: Mask-free Reference-based Image Editing with Multi-modal Instruction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18071","snapshot_observed_at":"2026-08-07T15:02:21.610738Z","title":"Freeedit: Mask-free reference-based image editing with multi-modal instruction, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:21.610738Z"},"links":{"cited_paper":"/paper/2409.18071","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:d86f139f5cb1221d30df239a0dcb65c58d318a9b6fb161f12825f063f890b84a","observation_id":"5ee9c468-5802-4623-821d-e399ed8d7fd7","resolution":{"observed_at":"2026-08-07T15:02:21.610738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:27.530378Z","title":"Gpt-image-1: Openai’s multimodal image generation model","venue":null,"work_id":"9ff826d7-6d10-4736-90b3-8b59b11c07de","year":2025},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:21.659558Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:5e61d81d45640a5d21f66fb562c72e2a4da6c4b05fe9e5b0afab135e70356084","observation_id":"c41009cb-0a07-40a7-998e-d45bc6d9f438","resolution":{"observed_at":"2026-08-07T15:02:27.623760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:27.255145Z","title":"Doubao: Bytedance’s ai chat assistant","venue":null,"work_id":"4406ac7d-c082-4c86-a4b2-f8fea574bd7a","year":2025},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:21.733696Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:5c525d35d97bef4048a1f423347b3e1e9ac0684179f44fa31745a7f268883497","observation_id":"1d85ba9f-ecef-469c-bfa5-9ffdd2abe375","resolution":{"observed_at":"2026-08-07T15:02:27.404576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:27.016705Z","title":"Experiment with gemini 2.0 flash native im- age generation, March 2025","venue":null,"work_id":"bd4d8746-294b-4839-85a1-d9a0fdf92ba0","year":2025},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:21.835019Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:d93f598056f691d33bf4d4b4c72fe1c08218cad2c6a34df9d57ad2e330d07a71","observation_id":"c3653821-1731-4b84-8a84-0e36b982d5b7","resolution":{"observed_at":"2026-08-07T15:02:27.092162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:26.768229Z","title":"Omniedit: Building image editing generalist models through specialist supervision","venue":null,"work_id":"84c7331a-2fe6-426a-8504-3f4351de5e51","year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:21.913300Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:4686616f4cba0fea62372a71708aef91e781a17f2ee1323c9ba1ea8cc1b881d4","observation_id":"4da1ae78-3217-402d-962c-720a1cfc5fe4","resolution":{"observed_at":"2026-08-07T15:02:26.881978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04007","last_updated":"2024-05-07T04:55:47Z","snapshot_observed_at":"2026-08-16T13:54:49.928296Z","submitted_at":"2024-05-07T04:55:47Z","title":"SEED-Data-Edit Technical Report: A Hybrid Dataset for Instructional Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04007","snapshot_observed_at":"2026-08-07T15:02:21.983159Z","title":"Seed-data-edit technical report: A hybrid dataset for instructional image editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:21.983159Z"},"links":{"cited_paper":"/paper/2405.04007","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:9610bf1db93d832117e2a034828ac03738ee2767e53c7159011c327b2484ba50","observation_id":"3803a5d5-3cb2-4ef3-811a-34ffe195aee0","resolution":{"observed_at":"2026-08-07T15:02:21.983159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-08-16T14:00:43.952995Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-08-07T15:02:22.083378Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:22.083378Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:90b590ea9dce971af8f9ac92be9a77a080090d6e13a5f08cfab18be31885febd","observation_id":"04b0e700-c8fa-4a9a-95b9-d49243cd0d52","resolution":{"observed_at":"2026-08-07T15:02:22.083378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:26.608403Z","title":"Promptfix: You prompt and we fix the photo","venue":null,"work_id":"5a70d35c-361c-4c4d-8e5c-f968041e2d51","year":null},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:22.167585Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:7d112441a203964a219bb8bdb297868a414eb024fb4427d7e94ddc37a970cf75","observation_id":"7c1e4e3c-a9c0-4fb7-85ab-7640ea0bea70","resolution":{"observed_at":"2026-08-07T15:02:26.666083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04280","last_updated":"2025-05-06T09:56:18Z","snapshot_observed_at":"2026-08-13T15:27:11.948100Z","submitted_at":"2024-12-05T16:00:59Z","title":"HumanEdit: A High-Quality Human-Rewarded Dataset for Instruction-based Image Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04280","snapshot_observed_at":"2026-08-07T15:02:22.287337Z","title":"Humanedit: A high-quality human-rewarded dataset for instruction-based image editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:22.287337Z"},"links":{"cited_paper":"/paper/2412.04280","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:d9e292fad7876a440470efce0f48b59a013752f86b0bd0eb02da09b292f55a9f","observation_id":"de9177e2-8e00-4251-96df-85816571f97e","resolution":{"observed_at":"2026-08-07T15:02:22.287337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15098","last_updated":"2025-07-07T17:33:23Z","snapshot_observed_at":"2026-08-12T17:19:10.028618Z","submitted_at":"2024-11-22T17:55:15Z","title":"OminiControl: Minimal and Universal Control for Diffusion Transformer","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15098","snapshot_observed_at":"2026-08-07T15:02:22.387738Z","title":"Ominicontrol: Minimal and universal control for diffusion transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:22.387738Z"},"links":{"cited_paper":"/paper/2411.15098","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:b3a0985d271fb45fa7f1c7d755ca93c8c34595514da11aa0be1361325604b26f","observation_id":"559ea833-9e14-4e14-b79d-99b96b9d190b","resolution":{"observed_at":"2026-08-07T15:02:22.387738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13143","last_updated":"2025-04-17T17:51:59Z","snapshot_observed_at":"2026-08-16T12:11:40.367862Z","submitted_at":"2025-04-17T17:51:59Z","title":"$\\texttt{Complex-Edit}$: CoT-Like Instruction Generation for Complexity-Controllable Image Editing Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13143","snapshot_observed_at":"2026-08-07T15:02:22.459966Z","title":"Complex-Edit: Cot-like instruction generation for complexity-controllable image editing benchmark, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:22.459966Z"},"links":{"cited_paper":"/paper/2504.13143","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:1abd58a542daae14a1c5133110b25e83b83222bee45b15f61ea503b7d65cfe3e","observation_id":"1f1676ea-a518-4a84-9653-f2eb88c9486f","resolution":{"observed_at":"2026-08-07T15:02:22.459966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:26.451076Z","title":"Learning action and reasoning-centric image editing from videos and simulation","venue":null,"work_id":"d27a223c-db94-46e3-8d15-3f3da4b98267","year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:22.543890Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:7d60d942cdb65a66a8a1411957a948e0a15069c017a7940334a0652d204a22be","observation_id":"d61a3fda-22be-46de-80f1-9b27ff32ef79","resolution":{"observed_at":"2026-08-07T15:02:26.535138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-08-17T01:11:44.872398Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14683","snapshot_observed_at":"2026-08-07T15:02:22.593985Z","title":"Emerging properties in unified multimodal pretraining","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:22.593985Z"},"links":{"cited_paper":"/paper/2505.14683","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:d13731ce9b92dae546dfba631f93049a921b8a5b2f84df45a667970994ce034e","observation_id":"868d3bee-4cae-42f7-838d-0c11ea780f5b","resolution":{"observed_at":"2026-08-07T15:02:22.593985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:26.293289Z","title":"Hybridmind: Meta selection of natural language and symbolic language for enhanced llm reasoning","venue":null,"work_id":"86b5fed1-4b2d-4760-a562-78b0a743287c","year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:22.686867Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:38f337fcf4b5508e5f468bce6bd5279e073fa2b86499460feef26952fa58556f","observation_id":"45668b31-ddca-4223-ac6b-8e40dd23c6f6","resolution":{"observed_at":"2026-08-07T15:02:26.373359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:26.145893Z","title":"Abo: Dataset and benchmarks for real-world 3d object understanding","venue":null,"work_id":"667b12fc-77a6-425c-9327-e977f726b0c6","year":2022},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:22.751550Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:48982a4379239b25265ac4f87bdaf4d25d1404f89e9e67efeea502d8d8c8b698","observation_id":"ac38a4f9-e5fc-4eca-b7fc-2fbc179bcd5e","resolution":{"observed_at":"2026-08-07T15:02:26.209757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:25.906454Z","title":"How far are we from intelligent visual deductive reasoning? In First Conference on Language Modeling","venue":null,"work_id":"74405327-f1f6-453d-a1d9-021415059172","year":null},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:22.835429Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:10b15c801516dffa0d521f12fa3a5001e3b7bc6420509ef23279bfaee6989fc2","observation_id":"e3b75f57-9164-4ef8-bdde-28e6cc563f18","resolution":{"observed_at":"2026-08-07T15:02:26.032993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:25.722235Z","title":"V-prom: A benchmark for visual reasoning using visual progressive matrices","venue":null,"work_id":"d39155ea-7a08-45e8-9812-883e977b33be","year":null},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:22.922129Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:cc6fbbfac746fe1f62b3b1777e42718c820f0340c0c7fdbc4c1687cb89961d0d","observation_id":"3a4fe116-62a4-4fb3-8a49-634928a5759a","resolution":{"observed_at":"2026-08-07T15:02:25.774423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:25.579627Z","title":"Viton-hd: High-resolution vir- tual try-on via misalignment-aware normalization","venue":null,"work_id":"f590cc35-62c7-4f82-a3b7-1998ace086b6","year":2021},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:23.002483Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:9ad944edc757e9eb99f865d6d63db342e01d0ef210faee43ebf3a99b7111068b","observation_id":"cb88a8f3-6233-49c7-b588-7ccca538327d","resolution":{"observed_at":"2026-08-07T15:02:25.647559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:25.349690Z","title":"Deepfashion: Powering robust clothes recognition and retrieval with rich annotations","venue":null,"work_id":"1ccd43b5-b427-49b3-bfbc-2162322a1d75","year":2016},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:23.088899Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:2387249113d8cda4afaff4800a2880720e97608680b465338d85f0aeb3297eed","observation_id":"ccc93d6a-6b66-4997-a8e6-542ee1470442","resolution":{"observed_at":"2026-08-07T15:02:25.471540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:25.181471Z","title":"Lvos: A benchmark for long-term video object segmentation","venue":null,"work_id":"b455b84c-3166-410d-ae32-a7bb0378e010","year":2023},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:23.134134Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:d417405ffaa92e054191637ee25d477e41f4dd1cb611d7063836f666099e5cf0","observation_id":"2288aae0-2e29-46fa-ab77-0ddf4fc90554","resolution":{"observed_at":"2026-08-07T15:02:25.215032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:24.880174Z","title":"Towards quantitative evaluation metrics for image editing approaches","venue":null,"work_id":"3e84ac52-330c-45f5-8144-f4b60767de39","year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:23.162640Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:3d91ee53f9ac7da891531f0b88572fc3091210669b89bf9b09458f82dca68a1b","observation_id":"721f0d0a-6592-4260-a1c7-4b95dcdbadac","resolution":{"observed_at":"2026-08-07T15:02:25.051835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:24.770067Z","title":"Viescore: Towards explainable metrics for conditional image synthesis evaluation","venue":null,"work_id":"7bc6df1e-5d6a-4d85-b0b4-9b369f0bf52c","year":null},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:23.244507Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:f2e5240bbff709b964f84b79a4ff56c8ce5cf6d99254d52d14368c7e409a77c9","observation_id":"f912f2f6-3b3e-4a2d-ab37-331a946515b0","resolution":{"observed_at":"2026-08-07T15:02:24.806987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11340","last_updated":"2024-11-21T14:09:12Z","snapshot_observed_at":"2026-08-16T13:17:46.268142Z","submitted_at":"2024-09-17T16:42:46Z","title":"OmniGen: Unified Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11340","snapshot_observed_at":"2026-08-07T15:02:23.311891Z","title":"Omnigen: Unified image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:23.311891Z"},"links":{"cited_paper":"/paper/2409.11340","citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:31a5f5e75dafdda2f8e6358127cab211cf949d4a2232804f79762ff4543fb10a","observation_id":"f1af7fba-d65d-42a0-9041-f210545574b7","resolution":{"observed_at":"2026-08-07T15:02:23.311891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:24.609423Z","title":"complete the bottle cap","venue":null,"work_id":"45071ff9-a0d7-49ee-bb33-41f290d48503","year":2024},"citing_paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:23.393218Z"},"links":{"citing_paper":"/paper/2505.16707"},"observation_digest":"sha256:9d0a1b423f6fc6fcf0c373e8662ebb2594a5943a5ba10e25e5bfffcf55bb8508","observation_id":"db223122-0470-463b-99f5-ac90143cb247","resolution":{"observed_at":"2026-08-07T15:02:24.680160Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16707","last_updated":"2025-05-22T14:08:59Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T15:32:44.875708Z","submitted_at":"2025-05-22T14:08:59Z","title":"KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models"},"reference_resolution":{"displayed":73,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":32,"verified_exact":0,"verified_fuzzy":39},"total_outbound_references":73},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 73 of 73 outbound references and 13 inbound Pith citation observations for arXiv:2505.16707."}