{"as_of":"2026-08-08T13:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7acc9f128c4e54a238e783fde7a2cf90bd1bb8c835d7e2f7414fc1554a8f7934","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":41,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T23:18:33.138406Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T10:19:47.353241Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2302.05543","last_updated":"2023-11-26T22:26:12Z","snapshot_observed_at":"2026-08-04T15:27:22.366324Z","submitted_at":"2023-02-10T23:12:37Z","title":"Adding Conditional Control to Text-to-Image Diffusion Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T22:43:10.880338Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2302.05543"},"observation_digest":"sha256:be82c9a6ecd67e559b85080c77419c4c74f8838c88a89b7ed0c81f9a6a5f6f43","observation_id":"34651357-07bd-470f-85cd-dc9b41cfc461","resolution":{"observed_at":"2026-05-16T22:43:11.001734Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2302.11550","last_updated":"2023-02-22T18:47:51Z","snapshot_observed_at":"2026-08-05T16:16:51.134330Z","submitted_at":"2023-02-22T18:47:51Z","title":"Scaling Robot Learning with Semantically Imagined Experience","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-17T18:59:10.352342Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2302.11550"},"observation_digest":"sha256:5d76424123f5e4b84d20f94b9dfb55ee2a24905655134e3736ff5321c56f024d","observation_id":"922c80f7-4e45-4891-b88f-d5a711fbae3e","resolution":{"observed_at":"2026-05-17T18:59:10.533140Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2303.04671","last_updated":"2023-03-08T15:50:02Z","snapshot_observed_at":"2026-07-06T15:00:13.368355Z","submitted_at":"2023-03-08T15:50:02Z","title":"Visual ChatGPT: Talking, Drawing and Editing with Visual Foundation Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T22:50:24.053411Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2303.04671"},"observation_digest":"sha256:f075debf504428d338c17bc60933a833c32a433c32e083dc6c20bcb315e50220","observation_id":"fa1e7c72-3bf2-44cf-afa8-309a3a5c3638","resolution":{"observed_at":"2026-05-13T22:50:24.120824Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-11T08:22:03.403362Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2304.08485"},"observation_digest":"sha256:823c38a9100ef6ed92272a1b9436cb4b586b421e689b2650f7ecd9112f0d3634","observation_id":"11808f46-2e0f-44c1-ab10-41bbf9d5f819","resolution":{"observed_at":"2026-05-11T08:22:03.765463Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2501.12202","last_updated":"2026-05-14T15:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-21T15:16:54Z","title":"Hunyuan3D 2.0: Scaling Diffusion Models for High Resolution Textured 3D Assets Generation","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-23T04:53:58.465445Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2501.12202"},"observation_digest":"sha256:dffec498ad808c43e4d72a5da658414e79ce19fd202bfd9a7222215389a1168a","observation_id":"c6aeb455-3477-4235-b048-7c12595c190b","resolution":{"observed_at":"2026-05-23T04:55:25.035559Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-07T23:18:33.138406Z","title":"In- structpix2pix: Learning to follow image editing instructions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.08927","last_updated":"2025-08-20T07:14:01Z","snapshot_observed_at":"2026-08-08T00:27:22.697018Z","submitted_at":"2025-02-13T03:23:17Z","title":"Dynamic watermarks in images generated by diffusion models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T23:18:33.138406Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2502.08927"},"observation_digest":"sha256:fe51d0218fa67e28afd3e98aec26bce505ff0d7ff5bf228e4d33b79a5a6db99b","observation_id":"386e9fb3-b3f9-4fce-82af-47e5f9ba8d05","resolution":{"observed_at":"2026-08-07T23:18:33.138406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-07T15:43:12.277342Z","title":"In- structpix2pix: Learning to follow image editing instructions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14028","last_updated":"2025-05-20T07:29:21Z","snapshot_observed_at":"2026-08-08T00:28:20.287182Z","submitted_at":"2025-05-20T07:29:21Z","title":"OmniStyle: Filtering High Quality Style Transfer Data at Scale","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:12.277342Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2505.14028"},"observation_digest":"sha256:d73332afbb75d278fdf0724f23dccacbc735f3ccc807e3cd1e41d253ed40676f","observation_id":"a1c9d41b-2786-45f5-9d06-965b0b4c424b","resolution":{"observed_at":"2026-08-07T15:43:12.277342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-07T13:53:13.438855Z","title":"Instructpix2pix: Learning to follow image editing instructions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20764","last_updated":"2025-05-27T06:09:57Z","snapshot_observed_at":"2026-08-08T10:19:49.995333Z","submitted_at":"2025-05-27T06:09:57Z","title":"ConText-CIR: Learning from Concepts in Text for Composed Image Retrieval","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:13.438855Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2505.20764"},"observation_digest":"sha256:afbea772c70b27295d679efaf4535bb88fdd67917f3ac06d93495017fe92ab03","observation_id":"3bee0394-b482-426b-abc3-b620aa31cd07","resolution":{"observed_at":"2026-08-07T13:53:13.438855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-07T13:23:01.364254Z","title":"Cao, M., Wang, X., Qi, Z., Shan, Y ., Qie, X., and Zheng, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22002","last_updated":"2025-05-28T06:03:41Z","snapshot_observed_at":"2026-08-08T00:08:12.795048Z","submitted_at":"2025-05-28T06:03:41Z","title":"D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:01.364254Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2505.22002"},"observation_digest":"sha256:b7b793234b21ed357403eaf1b3996f54e05fbedbee80e7fb7c9fa3b17f7b2d27","observation_id":"fdc78d5b-3e9c-4473-89d0-cfb761724a05","resolution":{"observed_at":"2026-08-07T13:23:01.364254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-07T12:03:33.037487Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00868","last_updated":"2025-06-16T12:09:09Z","snapshot_observed_at":"2026-08-07T20:37:23.293010Z","submitted_at":"2025-06-01T07:17:16Z","title":"Multiverse Through Deepfakes: The MultiFakeVerse Dataset of Person-Centric Visual and Conceptual Manipulations","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:33.037487Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2506.00868"},"observation_digest":"sha256:80f9ba7a4d79e0c314f783d7ff8c5084b33157c0f84bc1e761148606dae55fcc","observation_id":"cccf28c1-60a8-4def-a0fb-1ab155fb55d4","resolution":{"observed_at":"2026-08-07T12:03:33.037487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-07T04:40:36.403646Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09988","last_updated":"2025-06-11T17:58:25Z","snapshot_observed_at":"2026-08-08T12:33:20.911722Z","submitted_at":"2025-06-11T17:58:25Z","title":"EditInspector: A Benchmark for Evaluation of Text-Guided Image Edits","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:36.403646Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2506.09988"},"observation_digest":"sha256:f4f0fd06f222fb54db8c6236a47bf36c361cc98e46b17485223765a44b34bf33","observation_id":"61af728a-1a10-497a-ac43-c29e965d6ebf","resolution":{"observed_at":"2026-08-07T04:40:36.403646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-07T04:14:28.819047Z","title":null,"venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2506.11380","last_updated":"2025-06-13T01:03:29Z","snapshot_observed_at":"2026-08-08T00:28:18.847167Z","submitted_at":"2025-06-13T01:03:29Z","title":"Enhance Multimodal Consistency and Coherence for Text-Image Plan Generation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T04:14:28.819047Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2506.11380"},"observation_digest":"sha256:ccbff6aaf5ab22dff7ea355ca65c0e01f392e69a6334593217e486c328198614","observation_id":"baed8f9a-6e54-423d-8192-56728cce2a6f","resolution":{"observed_at":"2026-08-07T04:14:28.819047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-07T00:43:14.170464Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.13827","last_updated":"2025-06-15T17:12:57Z","snapshot_observed_at":"2026-08-08T00:29:09.111554Z","submitted_at":"2025-06-15T17:12:57Z","title":"Balancing Preservation and Modification: A Region and Semantic Aware Metric for Instruction-Based Image Editing","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T00:43:14.170464Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2506.13827"},"observation_digest":"sha256:08b7f51c70ffe675d97b7193a269a2cd9bfc3b3a31e2c02a62418aecf48f9f64","observation_id":"f3bbb458-e222-4b58-93c6-596f1e009382","resolution":{"observed_at":"2026-08-07T00:43:14.170464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-06T23:48:36.246517Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15903","last_updated":"2025-06-18T22:17:30Z","snapshot_observed_at":"2026-08-08T00:30:28.826495Z","submitted_at":"2025-06-18T22:17:30Z","title":"VectorEdits: A Dataset and Benchmark for Instruction-Based Editing of Vector Graphics","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:48:36.246517Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2506.15903"},"observation_digest":"sha256:f36700c851daa197206858658412cb426985ec3de7a82fe7f829c403df265204","observation_id":"ea8fbe9a-87ea-411f-90f5-9c4c64d68460","resolution":{"observed_at":"2026-08-06T23:48:36.246517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2507.22163","last_updated":"2026-05-10T17:17:20Z","snapshot_observed_at":"2026-07-29T16:08:31.536872Z","submitted_at":"2025-07-29T18:53:49Z","title":"IdeaBlocks: Expressing and Reusing Divergent Intents for Graphic Design Exploration using Generative AI","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T02:07:33.016608Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2507.22163"},"observation_digest":"sha256:221be19cfdb6b86b62711fd718ebca2d4016a896d40fec5c64ea0d1ae87cfc3a","observation_id":"1a5bff8e-7310-44af-8f0a-d530163efac2","resolution":{"observed_at":"2026-05-19T02:11:59.520541Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-05T19:03:04.735019Z","title":"arXiv:2211.09800","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.13628","last_updated":"2025-08-20T12:14:16Z","snapshot_observed_at":"2026-08-08T13:07:05.585934Z","submitted_at":"2025-08-19T08:41:49Z","title":"DiffIER: Optimizing Diffusion Models with Iterative Error Reduction","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T19:03:04.735019Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2508.13628"},"observation_digest":"sha256:5d97c98500a177549b9129e58ae16ddc288d37199632ed2e370c7ed0034e481b","observation_id":"08e3e62b-3e29-48f2-8d61-66cffb66356e","resolution":{"observed_at":"2026-08-05T19:03:04.735019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2509.05342","last_updated":"2026-04-12T20:41:39Z","snapshot_observed_at":"2026-07-06T22:24:42.849960Z","submitted_at":"2025-09-01T21:51:24Z","title":"Delta Rectified Flow Sampling for Text-to-Image Editing","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T19:02:18.176561Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2509.05342"},"observation_digest":"sha256:018fb90a072d445df3887afc859b1d76a48418fee64fc32d1a0fd727a3aa99cf","observation_id":"8f01c66d-4a3d-4e75-bf91-16c3b69fc7ed","resolution":{"observed_at":"2026-05-18T19:02:48.587947Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-02T19:26:23.720833Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.02370","last_updated":"2026-06-22T14:36:47Z","snapshot_observed_at":"2026-08-06T21:10:45.594134Z","submitted_at":"2026-03-02T20:19:53Z","title":"Cultural Counterfactuals: Evaluating Cultural Biases in Large Vision-Language Models with Counterfactual Examples","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T19:26:23.720833Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2603.02370"},"observation_digest":"sha256:69bdb290b8ae730104a712b8f09b0e93374ec86c65a9c695f637008523d39503","observation_id":"06513b82-e5ca-455f-851a-2fe0d7f0ea78","resolution":{"observed_at":"2026-08-02T19:26:23.720833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-02T19:14:04.763185Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.03143","last_updated":"2026-06-28T07:21:56Z","snapshot_observed_at":"2026-08-07T08:56:16.763487Z","submitted_at":"2026-03-03T16:31:10Z","title":"Edit in 2D, Verify in 3D: Reinforcement Learning for Multi-view Consistent Scene Editing","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T19:14:04.763185Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2603.03143"},"observation_digest":"sha256:8e50afb1ea6c8bdadc1ed3488f364e53168c216b86ead424e7db4963176a574b","observation_id":"edddbb6d-b6b1-42bd-af50-7f243d42f846","resolution":{"observed_at":"2026-08-02T19:14:04.763185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-15T13:50:51.666642Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.06453","last_updated":"2026-06-01T03:19:19Z","snapshot_observed_at":"2026-08-07T15:10:20.067130Z","submitted_at":"2026-03-06T16:43:44Z","title":"Pinterest Canvas: Large-Scale Image Generation at Pinterest","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-15T13:50:51.666642Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2603.06453"},"observation_digest":"sha256:f52aa7919a10fd7c834f0c17e2dd70ff7a3fbdda863fe44787c9b1fd693a45ad","observation_id":"355b8205-b0dc-438d-89df-505769fd47cb","resolution":{"observed_at":"2026-07-15T13:50:51.666642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2603.14186","last_updated":"2026-05-07T22:04:09Z","snapshot_observed_at":"2026-07-06T22:49:06.164294Z","submitted_at":"2026-03-15T02:22:27Z","title":"Setting-Matched and Semantics-Scaled Benchmarking of One-Step Generative Models Against Multistep Diffusion and Flow Models","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T12:15:38.186914Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2603.14186"},"observation_digest":"sha256:7dae2e11ed75bbdd4a14714a37aa3f1819060fe3538b292de85b678901aa37a7","observation_id":"a6fb18b7-afa4-4db4-8329-5f3cf95c5d2c","resolution":{"observed_at":"2026-05-15T12:20:00.845639Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2604.04974","last_updated":"2026-06-03T17:05:28Z","snapshot_observed_at":"2026-08-05T03:49:14.637609Z","submitted_at":"2026-04-04T15:37:11Z","title":"From Video to Control: A Survey of Learning Manipulation Interfaces from Temporal Visual Data","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-13T17:02:18.358675Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2604.04974"},"observation_digest":"sha256:4d3f28a59b87c76784e8595bc7492509ff37a217621a072f12b715f66e84240c","observation_id":"5a2df389-9536-4f65-9144-3fb1f3fe585d","resolution":{"observed_at":"2026-05-13T17:03:01.182136Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2604.13863","last_updated":"2026-04-15T13:29:08Z","snapshot_observed_at":"2026-08-02T17:57:41.943762Z","submitted_at":"2026-04-15T13:29:08Z","title":"PostureObjectstitch: Anomaly Image Generation Considering Assembly Relationships in Industrial Scenarios","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T14:16:40.509571Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2604.13863"},"observation_digest":"sha256:85ea602fcf2f4be9705f0edd1ccb89bdb23bd4e54d48ebe55d82e3924686ec0c","observation_id":"5c975759-e2d1-4b93-acea-1314cb1582fe","resolution":{"observed_at":"2026-05-10T14:20:30.532026Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2605.00707","last_updated":"2026-05-01T14:51:52Z","snapshot_observed_at":"2026-08-02T19:50:16.785716Z","submitted_at":"2026-05-01T14:51:52Z","title":"PhysEdit: Physically-Consistent Region-Aware Image Editing via Adaptive Spatio-Temporal Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-09T19:33:13.609552Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2605.00707"},"observation_digest":"sha256:213392842ff136eadc142b1b118e6bb3257333380ce5e2cb692a96eea0a59bf8","observation_id":"c03836f6-970c-464a-90b5-3d94a2152bd8","resolution":{"observed_at":"2026-05-11T15:36:10.241697Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2605.02583","last_updated":"2026-05-04T13:34:14Z","snapshot_observed_at":"2026-07-06T23:15:37.099197Z","submitted_at":"2026-05-04T13:34:14Z","title":"Stylistic Attribute Control in Latent Diffusion Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-08T18:43:21.423012Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2605.02583"},"observation_digest":"sha256:e67659c5fe5cb79bb116dfeae05ac28826f5118fa14e03a91552121ba38929f8","observation_id":"05d3ca51-54b0-4702-82d0-3e083d7410fe","resolution":{"observed_at":"2026-05-09T06:15:38.115740Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2605.16951","last_updated":"2026-05-16T12:05:39Z","snapshot_observed_at":"2026-08-02T16:28:04.937142Z","submitted_at":"2026-05-16T12:05:39Z","title":"Edit-GRPO: A Locality-Preserving Policy Optimization Framework for Image Editing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-19T20:44:54.356658Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2605.16951"},"observation_digest":"sha256:a699727e1e5230264d27d2f06762451fddb1afaa121902981ecbe20443baa008","observation_id":"b9fab31e-863d-4804-afa5-3b8c8244141d","resolution":{"observed_at":"2026-05-19T20:47:45.919637Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2605.18010","last_updated":"2026-05-18T08:05:07Z","snapshot_observed_at":"2026-08-02T12:16:21.427153Z","submitted_at":"2026-05-18T08:05:07Z","title":"Functionalization via Structure Completion and Motion Rectification","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-05-20T12:25:07.157086Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2605.18010"},"observation_digest":"sha256:b2f8aced40ddbda02f309ff4bf560b80412698625d73d549365be7e3352d99a9","observation_id":"86a3163b-14b5-4e60-91a9-8dad8fbd0a02","resolution":{"observed_at":"2026-05-20T12:28:16.854252Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2605.21611","last_updated":"2026-05-20T18:17:50Z","snapshot_observed_at":"2026-08-02T20:45:07.454387Z","submitted_at":"2026-05-20T18:17:50Z","title":"UniVL: Unified Vision-Language Embedding for Spatially Grounded Contextual Image Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T09:25:19.066598Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2605.21611"},"observation_digest":"sha256:04d9af440ad7827a4d4577b8bc7489c018466525855a2325698fecbc7bee1f4e","observation_id":"8ce526d6-a5da-497b-a961-57b2ea8a45b8","resolution":{"observed_at":"2026-05-22T09:26:20.779221Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2605.23245","last_updated":"2026-05-22T05:28:56Z","snapshot_observed_at":"2026-07-06T23:33:29.550551Z","submitted_at":"2026-05-22T05:28:56Z","title":"SimInsert: Seamless Video Object Insertion via Regional Sparse Attention Fusion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-25T04:46:50.749223Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2605.23245"},"observation_digest":"sha256:7665f5617eb71775aa5c4b9895554dbbfd917e672e1577e87d193300bb0d7f07","observation_id":"5ebbcc7c-0bda-4033-8050-a93dad14a216","resolution":{"observed_at":"2026-05-25T04:50:21.388354Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2605.25343","last_updated":"2026-05-25T01:57:43Z","snapshot_observed_at":"2026-07-06T23:35:16.647496Z","submitted_at":"2026-05-25T01:57:43Z","title":"Toward Native Multimodal Modeling: A Roadmap","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-06-29T22:58:38.610609Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2605.25343"},"observation_digest":"sha256:beeb7d07ea62245fd6919fb31bdada97f9005db56752a21de9bdd405492b2ae9","observation_id":"77169000-6a4a-4a34-a9c1-f9bb71bc9ffc","resolution":{"observed_at":"2026-06-29T23:04:01.954409Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2606.01825","last_updated":"2026-07-01T05:50:06Z","snapshot_observed_at":"2026-08-05T10:25:09.105468Z","submitted_at":"2026-06-01T07:41:44Z","title":"ROGLE: Robust Global-Local Alignment with Automated Region Supervision for Text-Based Person Search","version":1},"reference_index":135,"source":"arxiv_source","source_observed_at":"2026-06-28T15:18:17.427707Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2606.01825"},"observation_digest":"sha256:dc31b59f245e861b2d367f1543f919a0e925035e3d7abe83918274d0dbf9e76d","observation_id":"863259a4-4e01-465e-b3e2-2d932d79820b","resolution":{"observed_at":"2026-07-01T22:36:16.968065Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2606.01825","last_updated":"2026-07-01T05:50:06Z","snapshot_observed_at":"2026-08-05T10:25:09.105468Z","submitted_at":"2026-06-01T07:41:44Z","title":"ROGLE: Robust Global-Local Alignment with Automated Region Supervision for Text-Based Person Search","version":2},"reference_index":135,"source":"arxiv_source","source_observed_at":"2026-07-02T23:17:03.456746Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2606.01825"},"observation_digest":"sha256:c25302911d53b3c0476410779aef326609ed67e25e394c44d7422600f991a894","observation_id":"04f877a9-7018-40cc-bdcd-7835cf3eec3c","resolution":{"observed_at":"2026-07-02T23:17:28.938252Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2606.03401","last_updated":"2026-06-02T09:42:29Z","snapshot_observed_at":"2026-07-31T19:49:58.852979Z","submitted_at":"2026-06-02T09:42:29Z","title":"Towards Characterizing Scientific Image Utility and Upgradability","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T11:10:37.254428Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2606.03401"},"observation_digest":"sha256:20a08f3a34bf1aaf5db4f1bcbd016edb51096bfeef0cc13042bdaa8df94557e3","observation_id":"c2042e52-ee71-4825-838d-6b24c348afd3","resolution":{"observed_at":"2026-07-02T02:06:27.858570Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2606.04306","last_updated":"2026-06-03T00:25:56Z","snapshot_observed_at":"2026-08-05T10:27:41.050145Z","submitted_at":"2026-06-03T00:25:56Z","title":"Organizational Control Layer: Governance Infrastructure at the Execution Boundary of LLM Agent Systems","version":1},"reference_index":114,"source":"arxiv_source","source_observed_at":"2026-06-28T04:17:18.483765Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2606.04306"},"observation_digest":"sha256:a6347146b21a712ac156cebe71d82c8b718ec7a773175ab51a58004bf9d306fb","observation_id":"89529731-c2a7-4cea-a778-0bc9f75f5248","resolution":{"observed_at":"2026-07-02T11:16:53.842480Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2606.05665","last_updated":"2026-06-04T03:48:42Z","snapshot_observed_at":"2026-08-06T12:53:30.658638Z","submitted_at":"2026-06-04T03:48:42Z","title":"V2V-Bench: A Comprehensive Benchmark for Video-to-Video Generation Evaluation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T02:20:05.748127Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2606.05665"},"observation_digest":"sha256:878157810857b82f645fb8756d36e0c0a958b1651cf75cc73545a4b1365a9b75","observation_id":"c9a827fd-2e15-493f-98fd-f320ebffea8f","resolution":{"observed_at":"2026-07-02T12:16:56.708468Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2606.07568","last_updated":"2026-05-26T02:19:47Z","snapshot_observed_at":"2026-07-06T23:47:10.030985Z","submitted_at":"2026-05-26T02:19:47Z","title":"A Systematic Study of Behavioral Cloning for Scientific Data Annotation","version":1},"reference_index":252,"source":"arxiv_source","source_observed_at":"2026-06-29T16:23:08.402194Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2606.07568"},"observation_digest":"sha256:9091d058b9f82bff61295b818b24393bc02e1d803b3b769c59ef28770bda6662","observation_id":"a289de02-4cc8-4a9d-897a-e471dd055dae","resolution":{"observed_at":"2026-06-29T16:23:39.126376Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":"2211.09800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-04T10:19:47.353241Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","venue":null,"work_id":"de9c4a95-36ff-4e97-a0c0-3cca39f60b1a","year":2022},"citing_paper":{"arxiv_id":"2606.23221","last_updated":"2026-06-22T12:09:29Z","snapshot_observed_at":"2026-07-06T23:57:57.606047Z","submitted_at":"2026-06-22T12:09:29Z","title":"RS-Gen: A Multi-Stage Agentic Framework for Reasoning and Search-Augmented Image Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T08:59:40.467458Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2606.23221"},"observation_digest":"sha256:1dae4ca8839ccb976175ab0b1341d776a55b9164bb91689dabe67e57744871bf","observation_id":"b8a358a4-3344-4a8c-93da-c1a1a31630ee","resolution":{"observed_at":"2026-07-04T10:19:47.354767Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-07-14T06:49:04.349040Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.11136","last_updated":"2026-07-13T06:12:41Z","snapshot_observed_at":"2026-08-02T20:44:01.311010Z","submitted_at":"2026-07-13T06:12:41Z","title":"Xema: Efficient Diffusion Serving through Fine-Grained Memory Management and Auto-Configuration","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T06:49:04.349040Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2607.11136"},"observation_digest":"sha256:67624ee4dbbc66113e009b1131b695705ceefcec700ac82ea01034ac176eec2f","observation_id":"d7f77fce-cb2f-4147-8067-3f8ee17353b0","resolution":{"observed_at":"2026-07-14T06:49:04.349040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-01T21:07:57.019322Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16409","last_updated":"2026-07-17T18:02:44Z","snapshot_observed_at":"2026-08-08T00:27:24.450465Z","submitted_at":"2026-07-17T18:02:44Z","title":"Think, Plan, Paint: Layout-Aware Reasoning for Controllable Image Generation in Unified Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T21:07:57.019322Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2607.16409"},"observation_digest":"sha256:95edd46ea21f4d321a1960cb617a39d16a634bb21165870ca73233b76cb5e123","observation_id":"3f2f0e2d-9c25-493c-8a7a-0a695b88da38","resolution":{"observed_at":"2026-08-01T21:07:57.019322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-01T13:38:58.541944Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19064","last_updated":"2026-07-22T15:23:32Z","snapshot_observed_at":"2026-08-08T13:02:51.341719Z","submitted_at":"2026-07-21T12:55:34Z","title":"Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T13:38:58.541944Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2607.19064"},"observation_digest":"sha256:7eaf4e9726afb9f8c2e2378b8bea5a5649ab17dc0619de3962a8cc614890a63c","observation_id":"c1b52947-7354-4cd5-b1bc-5a32b213b692","resolution":{"observed_at":"2026-08-01T13:38:58.541944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-01T11:29:13.382881Z","title":"arXiv preprint arXiv:2211.09800 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19895","last_updated":"2026-07-22T08:29:30Z","snapshot_observed_at":"2026-08-05T22:48:00.791575Z","submitted_at":"2026-07-22T08:29:30Z","title":"OSVE: One Step Video Editing with One Step Diffusion Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T11:29:13.382881Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2607.19895"},"observation_digest":"sha256:903c8634154a8668039b79538b05415e3c5b93e63af5c893257e3d3733f861fa","observation_id":"d86f7635-6d70-449c-b424-9f0d501077c6","resolution":{"observed_at":"2026-08-01T11:29:13.382881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2211.09800/citation-record","integrity":"/paper/2211.09800/integrity","json":"/paper/2211.09800/citation-record.json","paper":"/paper/2211.09800"},"outbound":[],"paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T07:25:23.651829Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 41 inbound Pith citation observations for arXiv:2211.09800."}