{"as_of":"2026-08-16T12:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:810883f35f4a951c0d4f1f5125e65b8dd0b42781b6b0a7ea0c34afb2d9f4faf0","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:53:14.367407Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:06:40.198757Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T12:06:40.953593Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"cited_work":{"arxiv_id":"2505.00751","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00751","snapshot_observed_at":"2026-08-07T12:06:40.953593Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","venue":"cs.CV","work_id":"717f92e4-6324-4552-9113-1ad6ae773d23","year":2025},"citing_paper":{"arxiv_id":"2506.00562","last_updated":"2025-05-31T13:39:45Z","snapshot_observed_at":"2026-08-13T05:47:06.564754Z","submitted_at":"2025-05-31T13:39:45Z","title":"SEED: A Benchmark Dataset for Sequential Facial Attribute Editing with Diffusion Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:06:40.198757Z"},"links":{"cited_paper":"/paper/2505.00751","citing_paper":"/paper/2506.00562"},"observation_digest":"sha256:ff1818d15178fab8ead620342102a59d999ada0a1195bee7c780852a5ca35581","observation_id":"8fa207d1-41e3-4a4b-a563-61c69e49902f","resolution":{"observed_at":"2026-08-07T12:06:41.023937Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.00751/citation-record","integrity":"/paper/2505.00751/integrity","json":"/paper/2505.00751/citation-record.json","paper":"/paper/2505.00751"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:16.652862Z","title":"Attention is all you need.Advances in neural information processing systems, 30:I, 2017","venue":null,"work_id":"d83a0765-3f3c-4471-9f01-12f47575c32e","year":2017},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.668702Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:eec07293d93461333f92d2825dcb2ebaa0b3e2da3f789c8f8d3d2af4f0affb88","observation_id":"e824d6e1-c082-49a0-869b-bfc12f3b4278","resolution":{"observed_at":"2026-08-16T04:53:16.659723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.11096","last_updated":"2019-02-25T21:32:06Z","snapshot_observed_at":"2026-07-06T07:04:57.275371Z","submitted_at":"2018-09-28T15:38:49Z","title":"Large Scale GAN Training for High Fidelity Natural Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.11096","snapshot_observed_at":"2026-08-16T04:53:13.678668Z","title":"Large scale gan training for high fidelity natural image synthesis","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.678668Z"},"links":{"cited_paper":"/paper/1809.11096","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:4313354eb74f1685bbad650bef221099c76b12ecf683467a9c5b3ba4ddb6bb2c","observation_id":"28c364d8-1274-470e-8e23-8bfd188c634e","resolution":{"observed_at":"2026-08-16T04:53:13.678668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:16.628095Z","title":"In- structpix2pix: Learning to follow image editing instructions","venue":null,"work_id":"71d88673-019f-4ea7-a26e-844f5d7a6edb","year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.689124Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:e76a9050a8f73a0611dbcda076e00c8e026da5c2531c72fc5224563836203738","observation_id":"2ab18bb9-a8c6-48c7-afdc-796639a6d55d","resolution":{"observed_at":"2026-08-16T04:53:16.634344Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:16.604190Z","title":"Colorpeel: Color prompt learning with diffusion models via color and shape disentanglement","venue":null,"work_id":"e121e69d-0407-4295-8743-2342e1346669","year":2024},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.698284Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:ff81e59cc465453bd4290bf16e9ef2869e50869c9d03c75bf972fd88a64746ad","observation_id":"39e26b92-f36b-4bb1-bcd4-d19dcfb2ac55","resolution":{"observed_at":"2026-08-16T04:53:16.612585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:16.565211Z","title":"Masactrl: Tuning-free mu- tual self-attention control for consistent image synthesis and editing","venue":null,"work_id":"c7d8ce05-bb74-44da-87a4-aee18c9f7166","year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.707494Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:2b17e1a1e44226bde145ae2e9471da50e854a97a51f3b4ba99c0046bcc6f178a","observation_id":"c9ced356-9eac-41d5-8044-c1d2edc55c73","resolution":{"observed_at":"2026-08-16T04:53:16.575949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:16.532962Z","title":"Emerg- ing properties in self-supervised vision transformers","venue":null,"work_id":"7e88ecd1-b70a-4e14-b9eb-9375ee9ad183","year":2021},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.720457Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:366884b7b9e4c78da83379328b3e4f3f32997590228313d833db695c5d0403fc","observation_id":"8d573bee-04b7-454f-9859-457936203627","resolution":{"observed_at":"2026-08-16T04:53:16.540503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09481","last_updated":"2024-05-08T03:21:34Z","snapshot_observed_at":"2026-08-13T10:53:07.664749Z","submitted_at":"2023-07-18T17:59:02Z","title":"AnyDoor: Zero-shot Object-level Image Customization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09481","snapshot_observed_at":"2026-08-16T04:53:13.729774Z","title":"Anydoor: Zero-shot object-level im- age customization.arXiv preprint arXiv:2307.09481, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.729774Z"},"links":{"cited_paper":"/paper/2307.09481","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:313b55e29c9d5f7b64e178b8fc1f6d65c5852f3f0dcf4027107075114ec4456f","observation_id":"505bf655-26f1-41b3-afa3-dac69acc33e0","resolution":{"observed_at":"2026-08-16T04:53:13.729774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:13.743251Z","title":"Stargan: Unified genera- tive adversarial networks for multi-domain image-to-image translation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.743251Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:a516b13c9250f5e68941cd186ce0867d8588fd1c04cc95f5bd7c2db133fdf7ae","observation_id":"c9d981d5-25f7-46fa-bff1-b28bdb556e27","resolution":{"observed_at":"2026-08-16T04:53:13.743251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:16.486880Z","title":"Stargan v2: Diverse image synthesis for multiple domains","venue":null,"work_id":"0ed36753-3e63-46c7-8cee-1084d6473a73","year":2020},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.763314Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:c1acad75c6ba4d1941614009ed43cf659f82328fc62f29dd20d71820ba71cb74","observation_id":"f9f9d665-d1b1-4f4c-8f66-c7935b92f33e","resolution":{"observed_at":"2026-08-16T04:53:16.495657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11427","last_updated":"2022-10-20T17:16:37Z","snapshot_observed_at":"2026-08-13T22:13:36.544823Z","submitted_at":"2022-10-20T17:16:37Z","title":"DiffEdit: Diffusion-based semantic image editing with mask guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11427","snapshot_observed_at":"2026-08-16T04:53:13.776207Z","title":"Diffedit: Diffusion-based seman- tic image editing with mask guidance.arXiv preprint arXiv:2210.11427, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.776207Z"},"links":{"cited_paper":"/paper/2210.11427","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:05a8e6a07ae436d8728228188a7b79a287568c996f342bcbdde8c64634103d97","observation_id":"b26bcaec-23b0-4a79-82f3-a227638dbb1b","resolution":{"observed_at":"2026-08-16T04:53:13.776207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:16.465337Z","title":"Imagenet: A large-scale hierarchical image 12 database","venue":null,"work_id":"34c1f1f5-4537-47d0-bf64-afc5e0fd3168","year":2009},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.783128Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:50309c8a6990dd809f186a9980132f268791f550822f23129007e55ba71c805b","observation_id":"a43b8f80-ed27-4085-95ba-9c9ce8eab9ec","resolution":{"observed_at":"2026-08-16T04:53:16.473384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:16.441133Z","title":"Visualizing ambiguity: Analyzing linguistic ambigu- ity resolution in text-to-image models.Computers, 14(1):19,","venue":null,"work_id":"aed53129-48ce-4679-b3b1-e9233900b5c9","year":null},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.791924Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:be2adee1ce368ed4cc18b9b9cdbd2333bf9fbdda0ad5ad95c6752e0c6a814b1b","observation_id":"d91ae3b5-6861-4109-aab7-dbb200b06f78","resolution":{"observed_at":"2026-08-16T04:53:16.448750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:16.411422Z","title":"Diffusion self-guidance for control- lable image generation.Advances in Neural Information Processing Systems, 36:16222–16239, 2023","venue":null,"work_id":"0178cc89-f24e-465e-844b-57844a224c8a","year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.800039Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:f2665e5d54fff92207abc9fe72eaacc085dd75632668feca7e146a19ff9205f9","observation_id":"04cc0e1e-37c0-4121-b7d9-69adac6fada1","resolution":{"observed_at":"2026-08-16T04:53:16.421233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17102","last_updated":"2024-02-05T05:04:53Z","snapshot_observed_at":"2026-08-14T09:55:58.225636Z","submitted_at":"2023-09-29T10:01:50Z","title":"Guiding Instruction-based Image Editing via Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17102","snapshot_observed_at":"2026-08-16T04:53:13.813010Z","title":"Guiding instruction-based im- age editing via multimodal large language models.arXiv preprint arXiv:2309.17102, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.813010Z"},"links":{"cited_paper":"/paper/2309.17102","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:b46cf1ae59bb6bea121ff45c4debc677cb5e4bf6353d116ea32586efa798c707","observation_id":"51ee5bff-47a5-4e17-bc56-35f573a2d9dc","resolution":{"observed_at":"2026-08-16T04:53:13.813010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:16.385400Z","title":"Instructdiffusion: A generalist modeling inter- face for vision tasks","venue":null,"work_id":"a2255d50-65dc-4e3e-ba57-00c97de9eb13","year":2024},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.820913Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:4cd8e3d95cdd734574eb5fe4613e30e2b9dd1902bcc2be88bc8868c09179d109","observation_id":"efd8e4f5-f432-45c5-b70e-197ac0d7d9b2","resolution":{"observed_at":"2026-08-16T04:53:16.393724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17546","last_updated":"2024-04-08T16:49:16Z","snapshot_observed_at":"2026-08-13T12:13:06.513926Z","submitted_at":"2023-03-30T17:13:56Z","title":"PAIR-Diffusion: A Comprehensive Multimodal Object-Level Image Editor","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17546","snapshot_observed_at":"2026-08-16T04:53:13.831427Z","title":"Pair-diffusion: Object-level image editing with structure- and-appearance paired diffusion models.arXiv preprint arXiv:2303.17546, 1, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.831427Z"},"links":{"cited_paper":"/paper/2303.17546","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:4819e31249413f7944e0ed17e23430ebed8524efbcc47019f81a516d8711df1e","observation_id":"96235a63-7f88-4b8e-b33f-a03dde8622ba","resolution":{"observed_at":"2026-08-16T04:53:13.831427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:13.844416Z","title":"Generative adversarial nets.Advances in neural information processing systems, 27, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.844416Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:254b58196f0d353530f696deb739737c0c89ede1c6ca532354ba5cc4b3b02d3b","observation_id":"b646dd01-ffe4-4bb9-9df9-ea4995b16643","resolution":{"observed_at":"2026-08-16T04:53:13.844416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:13.852335Z","title":"Vec- tor quantized diffusion model for text-to-image synthesis","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.852335Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:43c37590ef85d568e2ecc137ff40468f8aad3e80ec71a075ca7e0dcfb14e2d83","observation_id":"cfbc98aa-affa-42a8-bad0-b7879636a8ce","resolution":{"observed_at":"2026-08-16T04:53:13.852335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:16.317178Z","title":"Focus on your instruction: Fine-grained and multi-instruction image editing by atten- tion modulation","venue":null,"work_id":"0d704aa3-8f63-4491-b1d1-dc621932812a","year":null},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.858911Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:0efb001c987fb13e12b5d0ffe8c782a3da4d01258b41dab8a3d15d9d58b0cd8c","observation_id":"e0a8bd21-fd86-47a1-94fc-3a62556b46f3","resolution":{"observed_at":"2026-08-16T04:53:16.326017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00086","last_updated":"2024-11-05T12:25:32Z","snapshot_observed_at":"2026-08-15T07:22:21.789695Z","submitted_at":"2024-09-30T17:56:27Z","title":"ACE: All-round Creator and Editor Following Instructions via Diffusion Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00086","snapshot_observed_at":"2026-08-16T04:53:13.866947Z","title":"Ace: All- round creator and editor following instructions via diffusion transformer.arXiv preprint arXiv:2410.00086, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.866947Z"},"links":{"cited_paper":"/paper/2410.00086","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:cd9f687b163756f4e3cba168a88d7b4c252a654507b2655b1cc20c3228588b58","observation_id":"79f2a8b2-334f-4d5b-9fa6-2c9000b7396d","resolution":{"observed_at":"2026-08-16T04:53:13.866947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-16T04:53:13.874343Z","title":"Prompt-to-prompt im- age editing with cross attention control.arXiv preprint arXiv:2208.01626, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.874343Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:e0d501c7f36acc637054e102694743055968e6dda65eae89f663df903b28ae65","observation_id":"e44386ac-1440-4027-846b-13077bb8a925","resolution":{"observed_at":"2026-08-16T04:53:13.874343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-16T04:53:13.883331Z","title":"Classifier-free diffusion guidance.arXiv preprint arXiv:2207.12598, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.883331Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:17af5606aa3a3e9ba0b0c4771f66946740d4475a7eb62964240b0254162006d3","observation_id":"92772336-97ee-4ac2-92c8-de0b8ab9fb9b","resolution":{"observed_at":"2026-08-16T04:53:13.883331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:13.895369Z","title":"Denoising dif- fusion probabilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.895369Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:dd41d6dfe5d40af10e22ef2e136629ffa76e090044235bdae90d8dddb5c1a63e","observation_id":"8b7d9fbf-5fea-40d8-87c8-39ff34d863b5","resolution":{"observed_at":"2026-08-16T04:53:13.895369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:16.259059Z","title":"Kv inversion: Kv embeddings learning for text-conditioned real image action editing","venue":null,"work_id":"2acc764f-4b92-4d46-b4c4-693206089d94","year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.904416Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:f42ab3a428bbfcd630fe29699ec2300ef0dc809b9024e813bda69260b99efe2b","observation_id":"100d381b-c8f6-4128-bf5e-5b3b9b3fa602","resolution":{"observed_at":"2026-08-16T04:53:16.273378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:13.911377Z","title":"Smartedit: Exploring complex instruction-based image editing with multimodal large lan- guage models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.911377Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:8efa6b5bfddb2b4af045b4a9ad4bcd9d7a57a17fe7b79a939f6718967ada0be1","observation_id":"35ae0854-1535-4fbd-b27f-baeb044a311c","resolution":{"observed_at":"2026-08-16T04:53:13.911377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:16.203767Z","title":"Unicolor: A unified framework for multi-modal colorization with trans- former.ACM Transactions on Graphics (TOG), 41(6):1–16,","venue":null,"work_id":"9d4c0aba-4445-47ce-b64b-3af717d40968","year":null},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.919345Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:bc8a4a94490adc4795c3faa94054e33dff90d6c556c432093d11cdeabede2fcf","observation_id":"d404932e-e318-4a8f-88ae-1ca7aee2471d","resolution":{"observed_at":"2026-08-16T04:53:16.213207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-08-15T12:43:45.689817Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-08-16T04:53:13.932069Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.932069Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:a2a36d6f4870595126e6879263ad7988548bb6199f8b5c57a8d8459d32c06dfd","observation_id":"07676eb2-e812-44ac-bbe5-710debb9aa32","resolution":{"observed_at":"2026-08-16T04:53:13.932069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-16T04:53:13.949523Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.949523Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:425354ca17e4c34b8b1cc04e670b728f55ed9df21ad611115ccfe9a0da7f1f42","observation_id":"c621c35e-c1e2-4eb8-bc25-4a6963ea43ef","resolution":{"observed_at":"2026-08-16T04:53:13.949523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:13.958986Z","title":"A style-based generator architecture for generative adversarial networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.958986Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:e384e3e59caf4a898605543fe1d53e9fa8365f740c52e15e082226e3ad1b5fc8","observation_id":"f790ebec-271d-4037-8d8f-8d8d164445f1","resolution":{"observed_at":"2026-08-16T04:53:13.958986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:13.967111Z","title":"Imagic: Text-based real image editing with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.967111Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:485edfd25da4a181c9b0b816a8bc6d6b081aa6addd4b19985d813adcafc91398","observation_id":"cbf476c3-272a-4382-b802-508878c65b34","resolution":{"observed_at":"2026-08-16T04:53:13.967111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:16.143264Z","title":"Segment any- thing","venue":null,"work_id":"3c3f0ba0-878e-44f5-ab9b-e16a31edfe57","year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.976030Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:4c90d38ed6059a0375119e0606db9813d415dc7ad4c3b86bf9a8ab3eecb5e4d3","observation_id":"a4b2515e-250b-451b-abc3-c75d7a6f4fee","resolution":{"observed_at":"2026-08-16T04:53:16.151315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:16.115218Z","title":"Visual genome: Connecting language and vision using crowdsourced dense image annotations.International journal of computer vision, 123:32–73, 2017","venue":null,"work_id":"4d2b790f-4a02-457a-9d28-732b5b82ca5a","year":2017},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.984596Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:c3ba681d6ba69409aebf07c1f01e2048cf431557ac553108b5f7cef381fa6206","observation_id":"51ef5170-eaec-44a1-969d-7ad062ffa597","resolution":{"observed_at":"2026-08-16T04:53:16.122530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:13.998730Z","title":null,"venue":null,"work_id":null,"year":1956},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:13.998730Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:39c26902b72552b9eadb490263032ab7b47c977a461573ee6e77e31c7ea24103","observation_id":"fd93217d-3bc4-4af0-9761-c3e3bdfb838d","resolution":{"observed_at":"2026-08-16T04:53:13.998730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19708","last_updated":"2024-05-30T05:36:32Z","snapshot_observed_at":"2026-08-14T09:32:52.551708Z","submitted_at":"2024-05-30T05:36:32Z","title":"Text Guided Image Editing with Automatic Concept Locating and Forgetting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19708","snapshot_observed_at":"2026-08-16T04:53:14.006960Z","title":"Text guided image editing with au- tomatic concept locating and forgetting.arXiv preprint arXiv:2405.19708, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.006960Z"},"links":{"cited_paper":"/paper/2405.19708","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:12d0cf3284e97638bed3422981e79296a6d439b7283cb005d54cc70e9aa5a223","observation_id":"74ab77c3-92e5-4aea-b8e1-2ea2209079c5","resolution":{"observed_at":"2026-08-16T04:53:14.006960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:16.062028Z","title":"Layerdiffusion: Layered controlled image editing with dif- fusion models","venue":null,"work_id":"db189e92-62e3-4b86-a25b-3f784d287eab","year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.015434Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:7d1d7e8aa103fb17b2547d80da620145535da81830ebfb9c5af6cc50b3537d19","observation_id":"11aafa3c-5f16-4ec9-8a91-0faf5eebb3fb","resolution":{"observed_at":"2026-08-16T04:53:16.068925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10855","last_updated":"2024-02-16T17:51:13Z","snapshot_observed_at":"2026-08-13T04:17:23.309347Z","submitted_at":"2024-02-16T17:51:13Z","title":"Control Color: Multimodal Diffusion-based Interactive Image Colorization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10855","snapshot_observed_at":"2026-08-16T04:53:14.026985Z","title":"Control color: Multi- 13 modal diffusion-based interactive image colorization.arXiv preprint arXiv:2402.10855, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.026985Z"},"links":{"cited_paper":"/paper/2402.10855","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:f1e139015bab891602bc074ea8d22ed3ec164c445af7294a54eb19c0e18012dc","observation_id":"ed1725a4-5eb5-4730-9364-0310c389bb35","resolution":{"observed_at":"2026-08-16T04:53:14.026985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:14.036820Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.036820Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:ae28fccd949d02acde8d76ce7b40a43537af486cd36c8d2be3d22613219b677e","observation_id":"4ba47e99-78ab-43d1-b714-5f08c2633fca","resolution":{"observed_at":"2026-08-16T04:53:14.036820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:16.014282Z","title":"Towards understanding cross and self-attention in stable diffusion for text-guided image editing","venue":null,"work_id":"311033eb-292c-4a0c-866c-11dcf1b0063e","year":2024},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.058099Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:480dd90f529eb8b64b921d5e4c36cc57df1ee6222bafe29e72abd5d4d3fe4fbb","observation_id":"4343aef5-bcb5-4ad2-825d-7224c7b9ddf6","resolution":{"observed_at":"2026-08-16T04:53:16.024044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:15.973642Z","title":"Visual instruction tuning, 2023","venue":null,"work_id":"a0126ba4-9e1a-4897-af3c-0942b96ce5b7","year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.069847Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:a66069a87638bbeb64c8477b2442d9f16b3acc9ef51c250c07335a2bb1dae612","observation_id":"da7c2def-4705-4fed-a39c-3cd933f7823a","resolution":{"observed_at":"2026-08-16T04:53:15.984349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-16T04:53:14.076983Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection.arXiv preprint arXiv:2303.05499, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.076983Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:283983e67e6f3ce6a030a695b41292c48f8fa1a05bb1306d19142cc0a512b6cf","observation_id":"8a3efece-5676-4f26-94ab-1aac6ef251cb","resolution":{"observed_at":"2026-08-16T04:53:14.076983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:15.921360Z","title":"Mate- rial palette: Extraction of materials from a single image","venue":null,"work_id":"b30d12fc-02d6-4665-a141-e7819e901290","year":2024},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.086235Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:69d6becd4dbdc1991ef069844a4b9df5b05ebf97278c5301c98fc0e923e57f7d","observation_id":"a33393b3-2dcf-42c6-8fb1-ebe18d7ad6f8","resolution":{"observed_at":"2026-08-16T04:53:15.944105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:15.893106Z","title":"Fixed-point inversion for text- to-image diffusion models.CoRR, 2023","venue":null,"work_id":"f178cefd-233c-4672-ba9f-6d04456825c9","year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.095122Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:615b8a7c0dbe1d5140403390b4010aa23dd9032aebdfc3935829ee72db12fd0a","observation_id":"1db3917c-4a0a-481f-8752-192188375506","resolution":{"observed_at":"2026-08-16T04:53:15.901854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-08-14T03:40:56.071989Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-16T04:53:14.104729Z","title":"Sdedit: Image synthesis and editing with stochastic differential equations.arXiv preprint arXiv:2108.01073, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.104729Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:1d541177efaa32ca7b91e2bdf737598b00bb89be3ed57d9b844b3b11e184ee1f","observation_id":"7cff016f-3e89-4e77-ad44-b6e4ab08fc39","resolution":{"observed_at":"2026-08-16T04:53:14.104729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:14.114194Z","title":"On distillation of guided diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.114194Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:e1cea38aa6afe718b463a90e26c41314dde1c13689aba14f976f0c287053ddb5","observation_id":"83f7a777-ebd7-4699-a2f7-41e3f0832101","resolution":{"observed_at":"2026-08-16T04:53:14.114194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:15.843973Z","title":"Null-text inversion for editing real im- ages using guided diffusion models","venue":null,"work_id":"06d1df5c-3466-403d-a8bd-5f1cd269e27d","year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.124583Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:4b099919f3d3974347d79305f81b5bd72abc2430bf8d909b0b8507c44dd46102","observation_id":"6ea1d49f-a849-422b-a6ef-27be24bf07ac","resolution":{"observed_at":"2026-08-16T04:53:15.852692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-16T04:53:14.141888Z","title":"Glide: Towards photorealistic image generation and editing with text-guided diffusion models.arXiv preprint arXiv:2112.10741, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.141888Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:f09de136922be9436a759b66dd8baaed36521a6dfd744a1cb9809e1c7d9ec7ee","observation_id":"aa95ff51-0e0f-441a-9f7b-b8c373424c62","resolution":{"observed_at":"2026-08-16T04:53:14.141888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:15.814210Z","title":"Dall·e 3 system card.https://openai.com/ research/dall-e-3-system-card, 2023","venue":null,"work_id":"111f37d5-3002-4297-9d30-de288330091e","year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.152186Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:bd00ca5cdb0c4d1a69135fa284c190d841f9ec1bf0b2d97aadab143f9a416b0a","observation_id":"47f9b20c-e97f-442c-a4d3-49745eb73902","resolution":{"observed_at":"2026-08-16T04:53:15.821910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:15.788463Z","title":"Gpt-4v system card.https://openai.com/ index/gpt-4v-system-card/, 2023","venue":null,"work_id":"ce80aac9-8a95-495b-b07b-5b21487c0f66","year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.160205Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:314519face742eeac3c4c9720f88b3fa8766f10c39a232bbf3849be2a32049a3","observation_id":"ac997c68-76b2-4b3a-93ab-4b43c001b176","resolution":{"observed_at":"2026-08-16T04:53:15.797769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:15.745443Z","title":"Localizing object-level shape variations with text-to-image diffusion models","venue":null,"work_id":"ee44a781-b550-4f6f-84f7-61a4db005601","year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.176146Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:37a3c7a2804559332573dc47229ae67ba15af7f3c0e35a1470b5cfd0703e90f6","observation_id":"ae001f05-8cb4-425c-83b9-c5f0ff47f075","resolution":{"observed_at":"2026-08-16T04:53:15.759218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-16T04:53:14.197040Z","title":"Sdxl: Improving latent diffusion mod- els for high-resolution image synthesis.arXiv preprint arXiv:2307.01952, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.197040Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:82825c5a236531afa387035663a77e58159956970211885f8369dfa687dd158f","observation_id":"e8efc8b0-5854-4ffe-aabc-bf16e801852e","resolution":{"observed_at":"2026-08-16T04:53:14.197040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:15.685828Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"1baec8a2-b592-4346-a88e-42a3acf215c5","year":2021},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.203170Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:d6e1bc0dde18b3f59128b552a0b76a086585333b748e92abbb8d55db601fabe6","observation_id":"a0a9e507-3f23-4cc1-8308-2043e9088764","resolution":{"observed_at":"2026-08-16T04:53:15.705535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-16T04:53:14.211179Z","title":"Hierarchical text-conditional image gener- ation with clip latents.arXiv preprint arXiv:2204.06125, 1 (2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.211179Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:1ba12b70f2db28fba7fc083211b4e601ce534869bc5434e6390eb0bec99c347d","observation_id":"92a98053-e286-4f3b-be37-8f9e8275c076","resolution":{"observed_at":"2026-08-16T04:53:14.211179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:15.648915Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"42f0df25-7b2a-493c-8236-b031b57b419e","year":2022},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.222737Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:150b446812ab7ba3eccdb826b798235cd398617e4df7b3df3547eb8c41431ab3","observation_id":"b12d4d10-2c2f-442b-b643-31d7b64d0783","resolution":{"observed_at":"2026-08-16T04:53:15.659588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:14.236896Z","title":"U- net: Convolutional networks for biomedical image segmen- tation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.236896Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:2d2021df456d6242990a8b0025620d5b1a435ad31c00e419b0d1f947ca0337f7","observation_id":"a7de533f-7128-4f0f-b53e-35c5763d2958","resolution":{"observed_at":"2026-08-16T04:53:14.236896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:14.249282Z","title":"Photorealistic text-to-image diffusion models with deep language understanding.Advances in neural information processing systems, 35:36479–36494, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.249282Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:94e08afcd39b2af8fd6c874714b698c70a57ee8bad9b3e3e5ac48126cb122865","observation_id":"414f03e8-2845-4a65-aa7c-6d725812bb6f","resolution":{"observed_at":"2026-08-16T04:53:14.249282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:15.568024Z","title":"Emu edit: Precise image editing via recognition and genera- tion tasks","venue":null,"work_id":"88df8e44-b0be-412b-b0bd-ced6a454ac07","year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.259740Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:bc68107a20e3f9a941b860b4670d0efb92eee885641f30b883018841fcff6fc2","observation_id":"b6779c31-903e-401b-bb93-0c1118125c32","resolution":{"observed_at":"2026-08-16T04:53:15.577035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-16T04:53:14.268435Z","title":"Score-based generative modeling through stochastic differential equa- tions.arXiv preprint arXiv:2011.13456, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.268435Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:2ce78ab35fa74e6d7821e2a6c50c2e7d1e6321a61deefa83ce95c8ce84a91d13","observation_id":"fa1b8bdc-c3c8-477a-ab95-edc9ff50a955","resolution":{"observed_at":"2026-08-16T04:53:14.268435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:15.538902Z","title":"Plug-and-play diffusion features for text-driven image-to-image translation","venue":null,"work_id":"76ea543b-ff68-470b-bad1-7bfdd244982e","year":1921},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.282105Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:378db1793347620c75d8dc1d736468a1ac6f373fcfc642a5d7ef48400ba3035f","observation_id":"68b052d1-b044-4d36-9aa1-9ee756173949","resolution":{"observed_at":"2026-08-16T04:53:15.551844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:14.307481Z","title":"Singular value decomposition and principal component anal- ysis","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.307481Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:9659cf8a4863d24704bb7587668d1a2631cd8ca4a4734ae7cd0272bfa858523a","observation_id":"20facef7-1794-42c4-b42c-31f693fa2c76","resolution":{"observed_at":"2026-08-16T04:53:14.307481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:14.315347Z","title":"Edict: Exact diffusion inversion via coupled transformations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.315347Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:918ba132fc406c74b9558cf6925e9e4af49241e3e1db989c08a72d91476ebfc0","observation_id":"6d1dc69f-4106-45dc-88e3-d008b1c7d9b5","resolution":{"observed_at":"2026-08-16T04:53:14.315347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23897","last_updated":"2025-03-31T09:46:56Z","snapshot_observed_at":"2026-08-14T13:54:32.379383Z","submitted_at":"2025-03-31T09:46:56Z","title":"Training-Free Text-Guided Image Editing with Visual Autoregressive Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23897","snapshot_observed_at":"2026-08-16T04:53:14.324482Z","title":"Training-free text-guided image editing with visual autoregressive model.arXiv preprint arXiv:2503.23897, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.324482Z"},"links":{"cited_paper":"/paper/2503.23897","citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:52a4e3e2f85074a42b5c352bccf5fe2c55de2059737663c779eb33d25982bb30","observation_id":"ff595701-99d5-4f78-8043-ffcec778b55f","resolution":{"observed_at":"2026-08-16T04:53:14.324482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:15.460500Z","title":"Image quality assessment: from error visibility to 14 structural similarity.IEEE transactions on image processing, 13(4):600–612, 2004","venue":null,"work_id":"fde181b0-3419-4d4b-9409-692184214529","year":2004},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.331164Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:4201fcb3bb37872c1c1128f4aae2e11a76f2afa3b3ed3639b142947f3900a997","observation_id":"d9effdfb-1528-4b0e-9a81-bded9694aed8","resolution":{"observed_at":"2026-08-16T04:53:15.474069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:15.425318Z","title":"L-cad: Language-based colorization with any-level descrip- tions using diffusion priors.Advances in Neural Information Processing Systems, 36:77174–77186, 2023","venue":null,"work_id":"2e150971-c197-4d19-8fb4-b7beda3fa9c0","year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.344072Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:265c67d082a23836e9bd2ed97208442293280f69673cf612beb5c6a0e9200e72","observation_id":"884b054b-d40a-47e3-a4e6-ffe8be1e919e","resolution":{"observed_at":"2026-08-16T04:53:15.438526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:15.387001Z","title":"Magicbrush: A manually annotated dataset for instruction- guided image editing","venue":null,"work_id":"e22ea647-4ba7-4b26-a920-c69365a95407","year":2023},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.349519Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:495af346056a16613379b3a578162349f51937f66d6d731f9ea5cb7d570f8641","observation_id":"51029f1e-4b70-4d22-91d6-405960eae41c","resolution":{"observed_at":"2026-08-16T04:53:15.399871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:14.354559Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.354559Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:3da1bc8a4ec020684fd1216dcc7ee2c0b301d44147352518ab005ac8718d4b74","observation_id":"87488f31-1f40-48f2-9c50-601dd63f4a03","resolution":{"observed_at":"2026-08-16T04:53:14.354559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:15.324073Z","title":"Hive: Harnessing human feedback for instructional visual editing","venue":null,"work_id":"420afada-fe15-447d-b1f5-1d85c6aa6629","year":2024},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.360728Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:bb09abebfe230cf002720d9f4b998f423e2fe198249011c4866c2b05e2993054","observation_id":"d5420341-697d-4ca4-a1bd-7a1bb23d9a5b","resolution":{"observed_at":"2026-08-16T04:53:15.335932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:53:15.266098Z","title":"Ultraedit: Instruction-based fine-grained im- age editing at scale, 2024","venue":null,"work_id":"da2bad1d-f443-4c77-8535-22a9b41d939e","year":2024},"citing_paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-16T04:53:14.367407Z"},"links":{"citing_paper":"/paper/2505.00751"},"observation_digest":"sha256:3f7360c6cd97a0188ea192a21d81d27ef938a8ca02424bafc7a3a0f9ee9bc163","observation_id":"662b6559-2cbe-4591-a30d-f191654ff65d","resolution":{"observed_at":"2026-08-16T04:53:15.296029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.00751","last_updated":"2025-06-23T13:49:33Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T04:44:14.844890Z","submitted_at":"2025-05-01T03:24:28Z","title":"InstructAttribute: Fine-grained Object Attributes editing with Instruction"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":32},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 1 inbound Pith citation observation for arXiv:2505.00751."}