{"as_of":"2026-08-18T18:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:66fc143660cb88ca1c385726c460218bd29ba2a03d3e27ec8468fe42a211df55","coverage":[{"denominator":82,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":82,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:51:00.788879Z","state":"measured"},{"denominator":83,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":83,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-09T18:01:22.816796Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"cited_work":{"arxiv_id":"2504.17269","doi":"10.48550/arxiv.2504.17269","metadata_source":"pith","pith_arxiv_id":"2504.17269","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","venue":"cs.CV","work_id":"2eb8a9c9-deb6-4dff-8299-69abe5385b6e","year":2025},"citing_paper":{"arxiv_id":"2607.07187","last_updated":"2026-07-08T09:21:22Z","snapshot_observed_at":"2026-08-17T01:10:33.554451Z","submitted_at":"2026-07-08T09:21:22Z","title":"EditVerse3D: High-Quality 3D Object Editing with Region-Aware Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-09T18:01:22.816796Z"},"links":{"cited_paper":"/paper/2504.17269","citing_paper":"/paper/2607.07187"},"observation_digest":"sha256:901f436e7cec46102c774b61cf72606dc7d7b17ed55123fab851abfeddeeec3c","observation_id":"ec5c8166-86f9-4e37-b059-acc459dc838b","resolution":{"observed_at":"2026-07-09T18:06:25.471675Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.17269/citation-record","integrity":"/paper/2504.17269/integrity","json":"/paper/2504.17269/citation-record.json","paper":"/paper/2504.17269"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2304.04968","last_updated":"2023-04-26T13:20:56Z","snapshot_observed_at":"2026-08-16T19:00:25.602607Z","submitted_at":"2023-04-11T04:29:57Z","title":"Re-imagine the Negative Prompt Algorithm: Transform 2D Diffusion into 3D, alleviate Janus problem and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.04968","snapshot_observed_at":"2026-08-16T10:51:00.482479Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.482479Z"},"links":{"cited_paper":"/paper/2304.04968","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:d405db2aa3c2c91337e4d118dde917d37cf01a60855f4a61fe0757e2982b8310","observation_id":"19731274-dec8-4f36-a275-6cf3efbaf68c","resolution":{"observed_at":"2026-08-16T10:51:00.482479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.01767","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:51:01.807843Z","title":null,"venue":null,"work_id":"2c735b94-94f2-4c22-9e75-a7e0ea372245","year":2022},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.487152Z"},"links":{"citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:f83225ba51250782a62b67fe873e9dd4b40725285b8b1a8ac2237eec47f6c835","observation_id":"c6e761ba-1c29-49f3-8f10-5a8b69ed06d1","resolution":{"observed_at":"2026-08-16T10:51:01.814680Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12247","last_updated":"2023-11-02T18:17:01Z","snapshot_observed_at":"2026-08-16T15:59:29.531445Z","submitted_at":"2023-01-28T16:43:07Z","title":"SEGA: Instructing Text-to-Image Models using Semantic Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12247","snapshot_observed_at":"2026-08-16T10:51:00.491206Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.491206Z"},"links":{"cited_paper":"/paper/2301.12247","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:bd550ace1705068fe70b1a54b614b71c8ccab4677f47f94d05f34f613daf0128","observation_id":"9972c92c-da9b-4b44-bc1b-d3c97d1b98eb","resolution":{"observed_at":"2026-08-16T10:51:00.491206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16711","last_updated":"2024-06-25T22:33:57Z","snapshot_observed_at":"2026-08-18T09:43:42.814308Z","submitted_at":"2023-11-28T11:45:35Z","title":"LEDITS++: Limitless Image Editing using Text-to-Image Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16711","snapshot_observed_at":"2026-08-16T10:51:00.495406Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.495406Z"},"links":{"cited_paper":"/paper/2311.16711","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:ae8a638f39e08a155ad84ca6f003b1d421e53236ca3a75fedd1a5c77161fc125","observation_id":"59450c19-ef7f-4db2-8d34-b0af3f8f9402","resolution":{"observed_at":"2026-08-16T10:51:00.495406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:51:00.500010Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.500010Z"},"links":{"citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:b387c952a7aa4fac58ac81c5ab270a343b2c278e25160889d21ade680dfd3a67","observation_id":"30b400bf-a4a6-4c49-aef4-ac9c26630d73","resolution":{"observed_at":"2026-08-16T10:51:00.500010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12688","last_updated":"2023-03-22T16:36:10Z","snapshot_observed_at":"2026-08-16T15:46:11.195862Z","submitted_at":"2023-03-22T16:36:10Z","title":"Pix2Video: Video Editing using Image Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12688","snapshot_observed_at":"2026-08-16T10:51:00.503779Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.503779Z"},"links":{"cited_paper":"/paper/2303.12688","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:eb597ef581b41b1e7e7d2409248bd403c0d02d5f78b3910571f3e9c31e6dbfa0","observation_id":"e9f785a9-86b3-4c4d-8d35-da72b8480467","resolution":{"observed_at":"2026-08-16T10:51:00.503779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09246","last_updated":"2023-12-14T18:59:06Z","snapshot_observed_at":"2026-08-18T09:44:41.914655Z","submitted_at":"2023-12-14T18:59:06Z","title":"SHAP-EDITOR: Instruction-guided Latent 3D Editing in Seconds","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09246","snapshot_observed_at":"2026-08-16T10:51:00.508231Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.508231Z"},"links":{"cited_paper":"/paper/2312.09246","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:546759bbf707d1c540df8403a9d834d38c9fd5e66fc1f5e78c3421c6e9af79b9","observation_id":"d801085d-97ab-40b8-9268-c7e5ee5464ab","resolution":{"observed_at":"2026-08-16T10:51:00.508231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-08-18T11:39:42.707769Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-16T10:51:00.511929Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.511929Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:91feeadf6fd2b680e0110e4546e2064406da25135d93421accc13aaefb0b8959","observation_id":"12d17305-89b8-40b8-a1ca-c0b35ca375e0","resolution":{"observed_at":"2026-08-16T10:51:00.511929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11784","last_updated":"2024-03-16T10:33:40Z","snapshot_observed_at":"2026-08-18T09:44:40.200961Z","submitted_at":"2023-10-18T08:23:14Z","title":"Progressive3D: Progressively Local Editing for Text-to-3D Content Creation with Complex Semantic Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11784","snapshot_observed_at":"2026-08-16T10:51:00.515574Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.515574Z"},"links":{"cited_paper":"/paper/2310.11784","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:b659913f9595629441b6038426d80da3ebf574f6b6aaa480fbf830f576fc3722","observation_id":"5acaedf5-0f57-417f-8d12-421916ebf5f5","resolution":{"observed_at":"2026-08-16T10:51:00.515574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10079","last_updated":"2023-12-20T08:49:59Z","snapshot_observed_at":"2026-08-16T15:07:18.830992Z","submitted_at":"2023-08-19T17:59:12Z","title":"MeDM: Mediating Image Diffusion Models for Video-to-Video Translation with Temporal Correspondence Guidance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10079","snapshot_observed_at":"2026-08-16T10:51:00.519283Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.519283Z"},"links":{"cited_paper":"/paper/2308.10079","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:74c9d1ba617b9a4ed3ca352391632d76c505387b12c6d3b47e7455544c944bc5","observation_id":"7bbc0d98-2630-457c-92f1-b649e838fa86","resolution":{"observed_at":"2026-08-16T10:51:00.519283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05922","last_updated":"2024-02-29T21:06:58Z","snapshot_observed_at":"2026-08-18T09:43:45.589906Z","submitted_at":"2023-10-09T17:59:53Z","title":"FLATTEN: optical FLow-guided ATTENtion for consistent text-to-video editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05922","snapshot_observed_at":"2026-08-16T10:51:00.522961Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.522961Z"},"links":{"cited_paper":"/paper/2310.05922","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:e51b89f4337229af46f467b6ac1d2be4b34ca552eb1cd1f9512709792120fd79","observation_id":"9312852c-8d6f-4bdc-9090-db678d0b0397","resolution":{"observed_at":"2026-08-16T10:51:00.522961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:51:00.526586Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.526586Z"},"links":{"citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:410aa752b8538f2cae3ba4e6f9674ade932535e6807d357cdfe7a25640b7a408","observation_id":"3954cd90-5409-446d-a5e6-8a494665d497","resolution":{"observed_at":"2026-08-16T10:51:00.526586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09571","last_updated":"2023-11-16T05:13:44Z","snapshot_observed_at":"2026-08-18T09:44:11.867320Z","submitted_at":"2023-11-16T05:13:44Z","title":"3D Paintbrush: Local Stylization of 3D Shapes with Cascaded Score Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09571","snapshot_observed_at":"2026-08-16T10:51:00.533614Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.533614Z"},"links":{"cited_paper":"/paper/2311.09571","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:a0b5a66f5dc123c2a5e8238a5b1e14f0853c202fb237020f0b8ffb3bad2d2e5a","observation_id":"609ef133-c0d6-4f79-9144-1b7c5b7b5abd","resolution":{"observed_at":"2026-08-16T10:51:00.533614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.03677","last_updated":"2020-04-07T20:02:49Z","snapshot_observed_at":"2026-08-17T12:08:16.877650Z","submitted_at":"2020-04-07T20:02:49Z","title":"Semantic Image Manipulation Using Scene Graphs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.03677","snapshot_observed_at":"2026-08-16T10:51:00.537546Z","title":"Hager, Fed- erico Tombari, and Christian Rupprecht","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.537546Z"},"links":{"cited_paper":"/paper/2004.03677","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:b6e2c71ae74a11cc49b35ac05869da2b9160fb7354546e6739d51f71392cf793","observation_id":"8c42765a-6fc5-457c-915d-1f0c21312ae0","resolution":{"observed_at":"2026-08-16T10:51:00.537546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00864","last_updated":"2024-02-01T18:59:09Z","snapshot_observed_at":"2026-08-18T09:44:47.256189Z","submitted_at":"2024-02-01T18:59:09Z","title":"ViCA-NeRF: View-Consistency-Aware 3D Editing of Neural Radiance Fields","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00864","snapshot_observed_at":"2026-08-16T10:51:00.545600Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.545600Z"},"links":{"cited_paper":"/paper/2402.00864","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:c1c52115ac283455c5ff33d6ae261bead20a2122dde02b269648d27f2a4f4370","observation_id":"cfe3d534-30f2-479b-8f0c-0b2ddc754f53","resolution":{"observed_at":"2026-08-16T10:51:00.545600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03011","last_updated":"2023-02-06T18:50:23Z","snapshot_observed_at":"2026-08-16T15:57:19.481262Z","submitted_at":"2023-02-06T18:50:23Z","title":"Structure and Content-Guided Video Synthesis with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03011","snapshot_observed_at":"2026-08-16T10:51:00.549115Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.549115Z"},"links":{"cited_paper":"/paper/2302.03011","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:ca97941eced3995be19fc32df0cbb5e89aeb29e03f43a95219d6d19347df81df","observation_id":"b7de3de6-2f35-4e26-9893-7af208fa984d","resolution":{"observed_at":"2026-08-16T10:51:00.549115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03206","last_updated":"2024-03-05T18:45:39Z","snapshot_observed_at":"2026-08-13T01:47:21.043519Z","submitted_at":"2024-03-05T18:45:39Z","title":"Scaling Rectified Flow Transformers for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03206","snapshot_observed_at":"2026-08-16T10:51:00.552600Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.552600Z"},"links":{"cited_paper":"/paper/2403.03206","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:b2514e85507e2ce06dbf04824dcad5b22f418184a17c00ff867b78b5ed3e71d1","observation_id":"6c389cc5-f115-4afc-8215-e53ce66082b8","resolution":{"observed_at":"2026-08-16T10:51:00.552600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04917","last_updated":"2023-11-30T03:59:28Z","snapshot_observed_at":"2026-08-18T09:44:34.604205Z","submitted_at":"2023-09-10T02:31:50Z","title":"Editing 3D Scenes via Text Prompts without Retraining","version":3},"cited_work":{"arxiv_id":"2309.04917","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.04917","snapshot_observed_at":"2026-08-16T10:51:01.561399Z","title":"Editing 3D Scenes via Text Prompts without Retraining","venue":"cs.CV","work_id":"e8d9d0be-9699-4823-9023-bb78b0529370","year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.556372Z"},"links":{"cited_paper":"/paper/2309.04917","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:b33f3bde1dc1fb84e28c70c9c29c5df14c6eea8e1042da7ed3a78c3fdb49b46a","observation_id":"7ffd47bf-22e3-40fd-a1f9-0514aaa839d3","resolution":{"observed_at":"2026-08-16T10:51:01.566590Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:51:01.978439Z","title":null,"venue":null,"work_id":"152be466-09fa-407a-97f0-4b54b0b881fe","year":null},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.559956Z"},"links":{"citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:bc153c3519a3a1ad0632373ef1866237cff6087e0574a5d558a1cefd51eb28ca","observation_id":"4b51d0c9-d49e-46b8-a4eb-15af2d9cfa6e","resolution":{"observed_at":"2026-08-16T10:51:01.982226Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-16T10:51:00.566701Z","title":"Bermano, Gal Chechik, and Daniel Cohen-Or","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.566701Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:7f67525acb80fec06455805ad57d36159c40615bcb2d37465dc130773848fe0f","observation_id":"d5942c9f-5501-4be0-86b1-6057150f0001","resolution":{"observed_at":"2026-08-16T10:51:00.566701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:51:01.966584Z","title":null,"venue":null,"work_id":"0299d48f-02cb-4783-a940-89bbc82ab157","year":null},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.571121Z"},"links":{"citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:8d959517fd8b131791c07d7f0fe5160e6dd4c2bb3f1234a858bda04ecc2244c6","observation_id":"0f3ba658-b696-4efe-aedb-75c5a1024e4e","resolution":{"observed_at":"2026-08-16T10:51:01.970572Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10373","last_updated":"2023-11-20T10:54:09Z","snapshot_observed_at":"2026-08-15T03:17:05.670808Z","submitted_at":"2023-07-19T18:00:03Z","title":"TokenFlow: Consistent Diffusion Features for Consistent Video Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10373","snapshot_observed_at":"2026-08-16T10:51:00.578458Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.578458Z"},"links":{"cited_paper":"/paper/2307.10373","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:54b1c603c305abbaafa867e546f45e032c7e581fcda5d6ec1b880b7e34d9f095","observation_id":"0798e517-6c0f-429f-8414-482a9a2b8bd9","resolution":{"observed_at":"2026-08-16T10:51:00.578458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:51:00.582056Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.582056Z"},"links":{"citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:5a426b4eae05198928d79fdae8132f74c6bdc4fbf90ca048a7c8f90d72b8f26f","observation_id":"102ad8c2-4ca0-49bb-874c-6b7e8d408c27","resolution":{"observed_at":"2026-08-16T10:51:00.582056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.00946","last_updated":"2021-12-16T17:05:46Z","snapshot_observed_at":"2026-08-18T09:43:50.068709Z","submitted_at":"2021-08-02T14:46:46Z","title":"StyleGAN-NADA: CLIP-Guided Domain Adaptation of Image Generators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.00946","snapshot_observed_at":"2026-08-16T10:51:00.574828Z","title":"arXiv:2108.00946 [cs.CV]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.574828Z"},"links":{"cited_paper":"/paper/2108.00946","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:0c1d2e21ff4fbd692393cb6bd13b08e2df01bd9ef25095a9b97461ff72861985","observation_id":"26994995-8907-4405-9f38-4927b102ab17","resolution":{"observed_at":"2026-08-16T10:51:00.574828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:51:01.946784Z","title":null,"venue":null,"work_id":"02127e44-6441-4704-a32e-04d68a712bc1","year":2022},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.588672Z"},"links":{"citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:8ad7a5ab0308062aa25f1d85e08f1ec1959889c57a3740150fb3e5c203a7aecc","observation_id":"16c7d482-4cfc-4478-8149-8a3cb6e06756","resolution":{"observed_at":"2026-08-16T10:51:01.950581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:51:00.592160Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.592160Z"},"links":{"citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:268732dfc0f9c267d95cd5f4f228a9675ea9b54c8a5d98cd854b870804d6e248","observation_id":"209b60f8-903e-4284-9440-845c99db29d5","resolution":{"observed_at":"2026-08-16T10:51:00.592160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12789","last_updated":"2023-06-01T17:17:38Z","snapshot_observed_at":"2026-08-16T15:46:09.300147Z","submitted_at":"2023-03-22T17:57:57Z","title":"Instruct-NeRF2NeRF: Editing 3D Scenes with Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12789","snapshot_observed_at":"2026-08-16T10:51:00.585224Z","title":"Efros, Aleksander Holynski, and Angjoo Kanazawa","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.585224Z"},"links":{"cited_paper":"/paper/2303.12789","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:33914dd8df52d06ae03dc3956092cd021bc71aa3db6667e94432413338062e45","observation_id":"93ca2085-5c4a-473a-b0e3-8e1d31d6a5a7","resolution":{"observed_at":"2026-08-16T10:51:00.585224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12570","last_updated":"2023-06-21T21:09:45Z","snapshot_observed_at":"2026-08-18T09:44:09.584217Z","submitted_at":"2023-06-21T21:09:45Z","title":"Local 3D Editing via 3D Distillation of CLIP Knowledge","version":1},"cited_work":{"arxiv_id":"2306.12570","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.12570","snapshot_observed_at":"2026-08-16T10:51:01.460479Z","title":"Local 3D Editing via 3D Distillation of CLIP Knowledge","venue":"cs.CV","work_id":"a5b47c33-a6bb-4138-9882-576b7cecd8f1","year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.603515Z"},"links":{"cited_paper":"/paper/2306.12570","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:5ec1a7691ab25fe0a0d2c60dfd8d71a21d33817a8c10769ee6e59bb4d1b78e6b","observation_id":"0d970434-db55-4308-8c82-87436491f333","resolution":{"observed_at":"2026-08-16T10:51:01.465080Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:51:01.926268Z","title":null,"venue":null,"work_id":"060e89ce-5a6f-4350-a640-99799548f3e3","year":2024},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.607496Z"},"links":{"citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:88322596fd9c1f14f212ba85621ccd0f853e26f23701781ee5529928122ea325","observation_id":"997f9316-04af-400c-aa0e-fe4c29e9c456","resolution":{"observed_at":"2026-08-16T10:51:01.930539Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15780","last_updated":"2023-03-28T07:50:45Z","snapshot_observed_at":"2026-08-16T21:26:31.535428Z","submitted_at":"2023-03-28T07:50:45Z","title":"Instruct 3D-to-3D: Text Instruction Guided 3D-to-3D conversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15780","snapshot_observed_at":"2026-08-16T10:51:00.610862Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.610862Z"},"links":{"cited_paper":"/paper/2303.15780","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:c432db837ee4072e6ce64b80af5f949a22c1f2aee2f51a80efedb1c8bdecd75c","observation_id":"a58b6505-da38-4e07-bedf-882c3bbac2a6","resolution":{"observed_at":"2026-08-16T10:51:00.610862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11239","last_updated":"2020-12-16T21:15:05Z","snapshot_observed_at":"2026-08-10T05:21:27.485481Z","submitted_at":"2020-06-19T17:24:44Z","title":"Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11239","snapshot_observed_at":"2026-08-16T10:51:00.599652Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.599652Z"},"links":{"cited_paper":"/paper/2006.11239","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:5f2ac43a505085cada7beade97d971582f95ff179ba3e2c7de12537c983c612e","observation_id":"a68fa887-3d56-4924-8a39-263e82b5efe0","resolution":{"observed_at":"2026-08-16T10:51:00.599652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09276","last_updated":"2023-03-20T15:58:50Z","snapshot_observed_at":"2026-08-16T16:23:28.167909Z","submitted_at":"2022-10-17T17:27:32Z","title":"Imagic: Text-Based Real Image Editing with Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09276","snapshot_observed_at":"2026-08-16T10:51:00.618097Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.618097Z"},"links":{"cited_paper":"/paper/2210.09276","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:2b735bb7a3672d8ce04dedf86b49faf51dcc32b55942873a7bab276ae0ef9b4d","observation_id":"50f8fe0d-2ef9-4422-88f9-60172e3db57d","resolution":{"observed_at":"2026-08-16T10:51:00.618097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.04079","last_updated":"2023-08-08T06:37:06Z","snapshot_observed_at":"2026-08-16T15:10:03.937507Z","submitted_at":"2023-08-08T06:37:06Z","title":"3D Gaussian Splatting for Real-Time Radiance Field Rendering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.04079","snapshot_observed_at":"2026-08-16T10:51:00.621983Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.621983Z"},"links":{"cited_paper":"/paper/2308.04079","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:c722fd267e77a00bb7a214fcbf7828f859e46469d470c36381637dc3f3aa88c4","observation_id":"74e4ff02-a371-41ca-a09a-1ee0440e83de","resolution":{"observed_at":"2026-08-16T10:51:00.621983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09313","last_updated":"2024-07-13T19:04:43Z","snapshot_observed_at":"2026-08-18T14:49:28.344644Z","submitted_at":"2023-12-14T19:38:06Z","title":"LatentEditor: Text Driven Local Editing of 3D Scenes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09313","snapshot_observed_at":"2026-08-16T10:51:00.625634Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.625634Z"},"links":{"cited_paper":"/paper/2312.09313","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:a0362fdf3150dd0fb23eac6ca284d27761587fe8b574abb9de6b90218e01837d","observation_id":"9485ca67-8b00-44c6-bb37-b6aef8c823c5","resolution":{"observed_at":"2026-08-16T10:51:00.625634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.04948","last_updated":"2019-03-29T11:08:46Z","snapshot_observed_at":"2026-08-14T17:44:45.577553Z","submitted_at":"2018-12-12T13:59:43Z","title":"A Style-Based Generator Architecture for Generative Adversarial Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.04948","snapshot_observed_at":"2026-08-16T10:51:00.614562Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.614562Z"},"links":{"cited_paper":"/paper/1812.04948","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:46d4a7a970b192cfde8ebb33274a66ad95484453acb8528b22c1ce299eb41e05","observation_id":"b5a0a254-c3d9-4aaa-aea7-31968e93e4f5","resolution":{"observed_at":"2026-08-16T10:51:00.614562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.13369","last_updated":"2021-09-01T08:04:54Z","snapshot_observed_at":"2026-08-18T09:43:50.734806Z","submitted_at":"2021-04-27T17:57:19Z","title":"Explaining in Style: Training a GAN to explain a classifier in StyleSpace","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.13369","snapshot_observed_at":"2026-08-16T10:51:00.633098Z","title":"Freeman, Phillip Isola, Amir Globerson, Michal Irani, and Inbar Mosseri","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.633098Z"},"links":{"cited_paper":"/paper/2104.13369","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:22f8c4cabafd6e5f507dad283ae913a17983b57f36e3d9fc4eb7a211d4b3b7ed","observation_id":"aafafd56-894a-4ebb-85b5-f62c94d09120","resolution":{"observed_at":"2026-08-16T10:51:00.633098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.12136","last_updated":"2020-10-23T02:43:02Z","snapshot_observed_at":"2026-08-18T09:44:54.055750Z","submitted_at":"2020-10-23T02:43:02Z","title":"Lightweight Generative Adversarial Networks for Text-Guided Image Manipulation","version":1},"cited_work":{"arxiv_id":"2010.12136","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.12136","snapshot_observed_at":"2026-08-16T10:51:01.337010Z","title":"Lightweight Generative Adversarial Networks for Text-Guided Image Manipulation","venue":"cs.CV","work_id":"4745bcfe-ee8c-40d6-8268-396f18a0d339","year":2020},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.636942Z"},"links":{"cited_paper":"/paper/2010.12136","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:ce74e0e6fd98b229f478fffd505d5d267985aab38571c8d3fc0eec59867ee2b6","observation_id":"c5adbd4f-24f0-477c-8445-0dc45ac971d0","resolution":{"observed_at":"2026-08-16T10:51:01.343423Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.02826","last_updated":"2024-02-02T11:56:41Z","snapshot_observed_at":"2026-08-18T09:44:42.589899Z","submitted_at":"2023-11-06T02:21:11Z","title":"InstructPix2NeRF: Instructed 3D Portrait Editing from a Single Image","version":2},"cited_work":{"arxiv_id":"2311.02826","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.02826","snapshot_observed_at":"2026-08-16T10:51:01.319018Z","title":"InstructPix2NeRF: Instructed 3D Portrait Editing from a Single Image","venue":"cs.CV","work_id":"4bca58b8-2480-40da-a83c-274ae3b62817","year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.640631Z"},"links":{"cited_paper":"/paper/2311.02826","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:f78f3f127466b522350a7e161fac7102cd93116a4e451d10f4e9ba170e6623bf","observation_id":"dd8050dc-33d0-4c52-9946-d4b27625be2a","resolution":{"observed_at":"2026-08-16T10:51:01.324178Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.02711","last_updated":"2022-08-11T13:36:19Z","snapshot_observed_at":"2026-08-16T17:51:28.357407Z","submitted_at":"2021-10-06T12:59:39Z","title":"DiffusionCLIP: Text-Guided Diffusion Models for Robust Image Manipulation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.02711","snapshot_observed_at":"2026-08-16T10:51:00.629596Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.629596Z"},"links":{"cited_paper":"/paper/2110.02711","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:9387a805b7eed7dd3c07442e2a245ee800f298139070f15c1e62bef96d242c26","observation_id":"d6b419d1-5edc-440d-a427-38c14314469b","resolution":{"observed_at":"2026-08-16T10:51:00.629596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:51:01.913881Z","title":null,"venue":null,"work_id":"eabd4e26-5416-482b-b5e7-8d0cb6b3b8f1","year":null},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.648153Z"},"links":{"citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:5441f3fb3d4b0b65cbf8c7b57d37eaeb527310ad9e526f2aaac021998d185c6f","observation_id":"806e2c45-81a6-46d7-9fe7-0a350dcfa380","resolution":{"observed_at":"2026-08-16T10:51:01.918245Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.09778","last_updated":"2022-10-31T09:05:25Z","snapshot_observed_at":"2026-08-16T17:20:02.890207Z","submitted_at":"2022-02-20T10:37:52Z","title":"Pseudo Numerical Methods for Diffusion Models on Manifolds","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.09778","snapshot_observed_at":"2026-08-16T10:51:00.655245Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.655245Z"},"links":{"cited_paper":"/paper/2202.09778","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:658b0b9c515f93d57b1e0e4b659c85f496dd5a403d2d65ed9762e5fb559172f9","observation_id":"f5cff63f-5ba4-4c60-bb78-8fa493e4dbcb","resolution":{"observed_at":"2026-08-16T10:51:00.655245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15764","last_updated":"2023-08-04T15:07:54Z","snapshot_observed_at":"2026-08-18T09:44:45.561050Z","submitted_at":"2023-03-28T06:45:31Z","title":"X-Mesh: Towards Fast and Accurate Text-driven 3D Stylization via Dynamic Textual Guidance","version":2},"cited_work":{"arxiv_id":"2303.15764","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.15764","snapshot_observed_at":"2026-08-16T10:51:01.261710Z","title":"X-Mesh: Towards Fast and Accurate Text-driven 3D Stylization via Dynamic Textual Guidance","venue":"cs.CV","work_id":"3617e4c3-4088-48f5-935d-0b0bf30b7e47","year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.659230Z"},"links":{"cited_paper":"/paper/2303.15764","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:7a96a5faa07f19373ca19480d94950ef765afef7f78b5cf17c2415bf7e61c2a5","observation_id":"929272c4-591d-4685-a57e-8ccc21694d17","resolution":{"observed_at":"2026-08-16T10:51:01.267319Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10656","last_updated":"2023-12-19T13:54:15Z","snapshot_observed_at":"2026-08-18T09:44:11.389351Z","submitted_at":"2023-12-17T09:05:56Z","title":"VidToMe: Video Token Merging for Zero-Shot Video Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10656","snapshot_observed_at":"2026-08-16T10:51:00.644261Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.644261Z"},"links":{"cited_paper":"/paper/2312.10656","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:e13fc4e7a0d9f4ade06baf8989d571c93a6913b9997681a685bc7b7b69a8e521","observation_id":"7b1e0f0b-5ecd-4426-8167-9869aeb63423","resolution":{"observed_at":"2026-08-16T10:51:00.644261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-08-16T16:53:14.231987Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-16T10:51:00.666311Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.666311Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:4b2c5d2d4d228e32f5d45172893beed6cbbdaa837999609d4b788434ab55ddec","observation_id":"fbb4c087-b239-4ea8-8dab-8ba43cb6d30f","resolution":{"observed_at":"2026-08-16T10:51:00.666311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:51:00.669735Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.669735Z"},"links":{"citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:7a8fd28d10c0772aef8889d6d31e43e08b28abf7be5bce5152b6d52fc42b77f3","observation_id":"fc188617-e0b3-4cac-bc88-afbad4bd07a1","resolution":{"observed_at":"2026-08-16T10:51:00.669735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.08934","last_updated":"2020-08-03T22:17:31Z","snapshot_observed_at":"2026-08-07T21:12:33.939201Z","submitted_at":"2020-03-19T17:57:23Z","title":"NeRF: Representing Scenes as Neural Radiance Fields for View Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.08934","snapshot_observed_at":"2026-08-16T10:51:00.677172Z","title":"Srinivasan, Matthew Tancik, Jonathan T","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.677172Z"},"links":{"cited_paper":"/paper/2003.08934","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:2a85d70400e52662cf0426c480916d3128755b1b1a8c22c854b116e0bea25b75","observation_id":"fbe7655c-ed4e-48e4-b9c8-b10086b903c2","resolution":{"observed_at":"2026-08-16T10:51:00.677172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:51:01.891135Z","title":"Brubaker, Jonathan Kelly, Alex Levinshtein, Konstantinos G","venue":null,"work_id":"2779d0e1-8a56-46b1-a43d-fd0813a50eee","year":null},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.680799Z"},"links":{"citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:3a87ada6ad7c4acd77a3ec398459b7d4d12de9f9af0c46f8ea3048d5c6a33d56","observation_id":"51019d4e-dd4f-43f9-b631-80daf41203b5","resolution":{"observed_at":"2026-08-16T10:51:01.895309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15679","last_updated":"2023-09-14T12:07:40Z","snapshot_observed_at":"2026-08-18T09:44:52.552288Z","submitted_at":"2023-06-19T15:35:19Z","title":"Generating Parametric BRDFs from Natural Language Descriptions","version":2},"cited_work":{"arxiv_id":"2306.15679","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.15679","snapshot_observed_at":"2026-08-16T10:51:01.244201Z","title":"Generating Parametric BRDFs from Natural Language Descriptions","venue":"cs.GR","work_id":"ff6c589c-a31b-438e-909c-d9fddb43b26c","year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.662767Z"},"links":{"cited_paper":"/paper/2306.15679","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:0355a91688e468bd98cd25e153fd9fc29026f31688bb3931112e016aa821b677","observation_id":"5c91a5d8-088c-4e13-ae05-a84142aa1bd0","resolution":{"observed_at":"2026-08-16T10:51:01.249117Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-16T10:51:00.692022Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.692022Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:d1df9db759bc09f0719f439a4216c55705cf0122c579bf5b592a34057d272d10","observation_id":"d8e02cc4-b4f9-4201-802a-db86faef1e50","resolution":{"observed_at":"2026-08-16T10:51:00.692022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:51:00.695299Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.695299Z"},"links":{"citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:057555942413b23858e8cb7debabf8c16d2c36b7c174520918e10df1b8fddc39","observation_id":"9088b1f8-4f71-4e15-98b7-0f8c06b0a7b9","resolution":{"observed_at":"2026-08-16T10:51:00.695299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10735","last_updated":"2023-08-18T21:32:50Z","snapshot_observed_at":"2026-08-18T09:44:32.823786Z","submitted_at":"2023-03-19T18:40:44Z","title":"SKED: Sketch-guided Text-based 3D Editing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.10735","snapshot_observed_at":"2026-08-16T10:51:00.673192Z","title":"arXiv:2303.10735 [cs.CV] https://arxiv.org/abs/2303.10735","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.673192Z"},"links":{"cited_paper":"/paper/2303.10735","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:008a89be3243e06c285394c68a2736d9bcd09ca6de60ed737ba5b9f42f65c3dc","observation_id":"f7374a1a-2798-40e8-9eec-048b2fbff4c5","resolution":{"observed_at":"2026-08-16T10:51:00.673192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14988","last_updated":"2022-09-29T17:50:40Z","snapshot_observed_at":"2026-07-06T13:57:54.539656Z","submitted_at":"2022-09-29T17:50:40Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14988","snapshot_observed_at":"2026-08-16T10:51:00.706193Z","title":"Barron, and Ben Mildenhall","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.706193Z"},"links":{"cited_paper":"/paper/2209.14988","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:deb07ddbf3171750d082b06de47d4f07707176749eb4d27dd1bd88d18eb4554a","observation_id":"07bf948e-5e16-4587-aa56-e91164f19325","resolution":{"observed_at":"2026-08-16T10:51:00.706193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09535","last_updated":"2023-10-11T17:46:21Z","snapshot_observed_at":"2026-08-16T15:47:37.197317Z","submitted_at":"2023-03-16T17:51:13Z","title":"FateZero: Fusing Attentions for Zero-shot Text-based Video Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09535","snapshot_observed_at":"2026-08-16T10:51:00.710313Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.710313Z"},"links":{"cited_paper":"/paper/2303.09535","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:325cd34727151d8b0df3c7fa17e3cc9785cad349048e9e94e0a8538446cca66a","observation_id":"31bbb364-30e1-47ea-95c7-7b3ce4dc22b8","resolution":{"observed_at":"2026-08-16T10:51:00.710313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08947","last_updated":"2023-08-17T12:39:06Z","snapshot_observed_at":"2026-08-18T09:44:14.458957Z","submitted_at":"2023-08-17T12:39:06Z","title":"Watch Your Steps: Local Image and Scene Editing by Text Instructions","version":1},"cited_work":{"arxiv_id":"2308.08947","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.08947","snapshot_observed_at":"2026-08-16T10:51:01.155936Z","title":"Watch Your Steps: Local Image and Scene Editing by Text Instructions","venue":"cs.CV","work_id":"c0fca3e8-b3b7-4536-aef8-2298885f5766","year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.684212Z"},"links":{"cited_paper":"/paper/2308.08947","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:9dc7fc84bbf8073136bf59c4f59ddd70ef276fa0e184fa897adc52501ade36a8","observation_id":"3575cee0-20a3-4bac-addf-3228f384728d","resolution":{"observed_at":"2026-08-16T10:51:01.161193Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01329","last_updated":"2023-02-02T18:58:58Z","snapshot_observed_at":"2026-08-16T15:58:06.886842Z","submitted_at":"2023-02-02T18:58:58Z","title":"Dreamix: Video Diffusion Models are General Video Editors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01329","snapshot_observed_at":"2026-08-16T10:51:00.688263Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.688263Z"},"links":{"cited_paper":"/paper/2302.01329","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:bc931f1a3a25d0b6e80eb165d84cc8cd79793ecee6dd4c339550429b57f015e2","observation_id":"78c09521-2266-42e3-a4b2-365041616575","resolution":{"observed_at":"2026-08-16T10:51:00.688263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16512","last_updated":"2024-04-18T04:12:32Z","snapshot_observed_at":"2026-08-17T23:11:03.362702Z","submitted_at":"2023-08-31T07:49:06Z","title":"MVDream: Multi-view Diffusion for 3D Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16512","snapshot_observed_at":"2026-08-16T10:51:00.722637Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.722637Z"},"links":{"cited_paper":"/paper/2308.16512","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:6b4bb2e0e1e7d2994638c3bc11da1455fa3c306125091322e3a346fe5c76e6b9","observation_id":"88848cd2-30a1-4fab-a24c-d3068a137717","resolution":{"observed_at":"2026-08-16T10:51:00.722637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.07945","last_updated":"2023-11-17T12:43:46Z","snapshot_observed_at":"2026-08-18T09:44:36.871289Z","submitted_at":"2023-03-14T14:35:59Z","title":"Edit-A-Video: Single Video Editing with Object-Aware Consistency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.07945","snapshot_observed_at":"2026-08-16T10:51:00.726271Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.726271Z"},"links":{"cited_paper":"/paper/2303.07945","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:bd794fd81d458f6377c46211272edf4a6539a74588ff5437301a2dffab806a28","observation_id":"8a01b52b-5292-4630-afae-2eddb1091dca","resolution":{"observed_at":"2026-08-16T10:51:00.726271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:51:01.877047Z","title":null,"venue":null,"work_id":"d94397a3-cb27-4626-be96-f1d3e89239ae","year":null},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.699029Z"},"links":{"citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:07d7ef67169ec00a4c3c2f98a65f7edef41ff46cc8859afeb9c908a9300a70aa","observation_id":"946c2d21-3356-4cd0-aa77-e3ff6d7b2b9b","resolution":{"observed_at":"2026-08-16T10:51:01.881458Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05154","last_updated":"2024-05-21T08:21:52Z","snapshot_observed_at":"2026-08-18T14:52:27.210466Z","submitted_at":"2024-03-08T08:42:23Z","title":"GSEdit: Efficient Text-Guided Editing of 3D Objects via Gaussian Splatting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05154","snapshot_observed_at":"2026-08-16T10:51:00.702388Z","title":"arXiv:2403.05154 [cs.CV] https://arxiv.org/abs/2403.05154","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.702388Z"},"links":{"cited_paper":"/paper/2403.05154","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:1723913cf624f3cfbc672df747c699f517ad741fafb292a9097d3303470234df","observation_id":"b30357cf-83ad-4873-ada8-93a138278e32","resolution":{"observed_at":"2026-08-16T10:51:00.702388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.05600","last_updated":"2020-10-10T07:46:19Z","snapshot_observed_at":"2026-08-01T16:44:46.833530Z","submitted_at":"2019-07-12T07:37:26Z","title":"Generative Modeling by Estimating Gradients of the Data Distribution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.05600","snapshot_observed_at":"2026-08-16T10:51:00.741115Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.741115Z"},"links":{"cited_paper":"/paper/1907.05600","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:58b6eddf5afe19ebb80de4f8977cdc3a19c57d658bb066f7919099821c2763a5","observation_id":"34184fef-7bf8-4604-b321-38bb07dade30","resolution":{"observed_at":"2026-08-16T10:51:00.741115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05054","last_updated":"2024-02-07T17:57:03Z","snapshot_observed_at":"2026-08-16T14:20:30.813052Z","submitted_at":"2024-02-07T17:57:03Z","title":"LGM: Large Multi-View Gaussian Model for High-Resolution 3D Content Creation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05054","snapshot_observed_at":"2026-08-16T10:51:00.744683Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.744683Z"},"links":{"cited_paper":"/paper/2402.05054","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:5f754258ca65177734c338db31bff5289285337a674a374bf44251535132f672","observation_id":"8046bc43-f13a-4240-83e6-c22747b10a7c","resolution":{"observed_at":"2026-08-16T10:51:00.744683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:51:00.714060Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.714060Z"},"links":{"citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:060e9220cbc91031bf521032eb18638d6fab36ab67b21c70edbb8a50f2e29252","observation_id":"15a9a028-bf4a-470d-9965-4dd10c28d9d0","resolution":{"observed_at":"2026-08-16T10:51:00.714060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.12242","last_updated":"2023-03-15T17:52:27Z","snapshot_observed_at":"2026-08-16T16:36:51.160261Z","submitted_at":"2022-08-25T17:45:49Z","title":"DreamBooth: Fine Tuning Text-to-Image Diffusion Models for Subject-Driven Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.12242","snapshot_observed_at":"2026-08-16T10:51:00.718886Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.718886Z"},"links":{"cited_paper":"/paper/2208.12242","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:c7e56738137b3aadb37f9d41d42f712fbfe45e8776a3a4ef8b919ad70e4cbb19","observation_id":"72eebeeb-8c9f-4d01-bdae-490a0c6c4181","resolution":{"observed_at":"2026-08-16T10:51:00.718886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.16765","last_updated":"2023-03-30T11:42:41Z","snapshot_observed_at":"2026-08-18T09:43:51.461146Z","submitted_at":"2023-03-29T14:57:54Z","title":"MDP: A Generalized Framework for Text-Guided Image Editing by Manipulating the Diffusion Path","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.16765","snapshot_observed_at":"2026-08-16T10:51:00.759403Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.759403Z"},"links":{"cited_paper":"/paper/2303.16765","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:76fb6eb111715462b21a05652c3b2aa10b744fc1ab7dc30a172122de2c0e46eb","observation_id":"9ae46a3f-6cb7-4083-8aac-622b632775ba","resolution":{"observed_at":"2026-08-16T10:51:00.759403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17599","last_updated":"2024-01-04T01:30:50Z","snapshot_observed_at":"2026-08-16T15:43:58.927323Z","submitted_at":"2023-03-30T17:59:25Z","title":"Zero-Shot Video Editing Using Off-The-Shelf Image Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17599","snapshot_observed_at":"2026-08-16T10:51:00.763162Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.763162Z"},"links":{"cited_paper":"/paper/2303.17599","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:2580b150304a387490693be0de79ba4967d3112f9ab9de8a3c03d5191b481cce","observation_id":"58615114-2f68-4553-84ac-35b85afb6d67","resolution":{"observed_at":"2026-08-16T10:51:00.763162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:51:01.855471Z","title":null,"venue":null,"work_id":"4923e428-d477-400b-b19e-9200c2585d86","year":null},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.729833Z"},"links":{"citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:471f3c0ed2a2be416a09ed86010c2ce2208095d46bca6882e4700697daa61297","observation_id":"31ad5ad1-5534-4ce2-ac8f-e164296c2990","resolution":{"observed_at":"2026-08-16T10:51:01.861436Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11974","last_updated":"2023-09-11T13:18:55Z","snapshot_observed_at":"2026-08-18T09:44:52.927828Z","submitted_at":"2023-08-23T07:46:44Z","title":"Blending-NeRF: Text-Driven Localized Editing in Neural Radiance Fields","version":2},"cited_work":{"arxiv_id":"2308.11974","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.11974","snapshot_observed_at":"2026-08-16T10:51:00.984908Z","title":"Blending-NeRF: Text-Driven Localized Editing in Neural Radiance Fields","venue":"cs.CV","work_id":"f975ddaa-cde6-41a8-be57-4d2b7348d689","year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.733350Z"},"links":{"cited_paper":"/paper/2308.11974","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:116a1871bd896ba0d17f83792bae3b511e62e665b76170f0f53cd7fba777f4e8","observation_id":"2209fcfe-c6c3-4c73-8920-b6ec8f8560e4","resolution":{"observed_at":"2026-08-16T10:51:00.989250Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-16T10:51:00.737502Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.737502Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:f4d146d216ce62bb274d08c90f8651adcf65c8eadf4bcc1a70b4216b3c43dbcc","observation_id":"141eb853-0078-42ae-b062-6b23a5d136a6","resolution":{"observed_at":"2026-08-16T10:51:00.737502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.05278","last_updated":"2022-03-22T18:49:03Z","snapshot_observed_at":"2026-08-18T09:44:40.715556Z","submitted_at":"2021-01-14T14:11:00Z","title":"GAN Inversion: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.05278","snapshot_observed_at":"2026-08-16T10:51:00.777982Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.777982Z"},"links":{"cited_paper":"/paper/2101.05278","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:653269db4198ab3c5b59775803317922fda07841fc4cd00065fc659bdc6121ee","observation_id":"085d7753-f7f9-4673-85c0-f1bf8c7cd3c0","resolution":{"observed_at":"2026-08-16T10:51:00.777982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00908","last_updated":"2023-09-02T11:13:29Z","snapshot_observed_at":"2026-08-16T15:03:49.762634Z","submitted_at":"2023-09-02T11:13:29Z","title":"MagicProp: Diffusion-based Video Editing via Motion-aware Appearance Propagation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00908","snapshot_observed_at":"2026-08-16T10:51:00.781638Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.781638Z"},"links":{"cited_paper":"/paper/2309.00908","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:a1dc4c9d1574686b05d4befbc9b83291612624b640e20323110ed7a6df01b17f","observation_id":"0e0d2a3e-840b-4bb4-857d-1b6fc7bba855","resolution":{"observed_at":"2026-08-16T10:51:00.781638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:51:01.840599Z","title":null,"venue":null,"work_id":"72edb44b-9132-47be-95a2-9a7572a461dd","year":null},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.748721Z"},"links":{"citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:6aacdd57aff7798dbdd233a2734e136d82d359d38eeaf2a40dc61af38044d9c8","observation_id":"b4e52fe5-8fac-4055-951f-2f4fecb355e0","resolution":{"observed_at":"2026-08-16T10:51:01.845512Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.01160","last_updated":"2022-08-20T15:46:46Z","snapshot_observed_at":"2026-08-18T09:44:47.723163Z","submitted_at":"2022-06-02T17:20:52Z","title":"DE-Net: Dynamic Text-guided Image Editing Adversarial Networks","version":2},"cited_work":{"arxiv_id":"2206.01160","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.01160","snapshot_observed_at":"2026-08-16T10:51:00.934148Z","title":"DE-Net: Dynamic Text-guided Image Editing Adversarial Networks","venue":"cs.CV","work_id":"0cc77176-d58c-46b2-bbb4-e0c19dd29cc0","year":2022},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.752114Z"},"links":{"cited_paper":"/paper/2206.01160","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:507ebad3c193baff83b5b79ef1bb827aba3685f9831f197e5c1424bfdac06cee","observation_id":"3a4d8e8a-c87f-4592-a7d7-54435dcc2b90","resolution":{"observed_at":"2026-08-16T10:51:00.940522Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12572","last_updated":"2022-11-22T20:39:18Z","snapshot_observed_at":"2026-08-16T16:14:03.998741Z","submitted_at":"2022-11-22T20:39:18Z","title":"Plug-and-Play Diffusion Features for Text-Driven Image-to-Image Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12572","snapshot_observed_at":"2026-08-16T10:51:00.755613Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.755613Z"},"links":{"cited_paper":"/paper/2211.12572","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:aa36bad684ac652f74a81fa0b59d49fdf2dc037de2dcf138b88a54ecc208f09a","observation_id":"b8020e08-1b0d-49b8-b808-74ed0da2e65d","resolution":{"observed_at":"2026-08-16T10:51:00.755613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13040","last_updated":"2024-12-04T14:38:11Z","snapshot_observed_at":"2026-08-16T13:59:23.849166Z","submitted_at":"2024-04-19T17:53:43Z","title":"Analysis of Classifier-Free Guidance Weight Schedulers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13040","snapshot_observed_at":"2026-08-16T10:51:00.766882Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.766882Z"},"links":{"cited_paper":"/paper/2404.13040","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:67abfc24061a6a11585d786ba1fee71a60f3f4a19e69e37535fdd2c8cfbffabb","observation_id":"bf9cff08-afcb-47cc-a33e-5079de4008e6","resolution":{"observed_at":"2026-08-16T10:51:00.766882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13490","last_updated":"2024-02-21T03:01:17Z","snapshot_observed_at":"2026-08-18T09:44:34.682475Z","submitted_at":"2024-02-21T03:01:17Z","title":"Contrastive Prompts Improve Disentanglement in Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13490","snapshot_observed_at":"2026-08-16T10:51:00.770565Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.770565Z"},"links":{"cited_paper":"/paper/2402.13490","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:5671df81ac82a294704e2c317b1ea2dfeff16f1cdb8d436d41eeec19c8383fcf","observation_id":"95f5dd77-a843-4139-8924-070316a60bed","resolution":{"observed_at":"2026-08-16T10:51:00.770565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.11565","last_updated":"2023-03-17T17:28:04Z","snapshot_observed_at":"2026-08-18T09:44:48.496427Z","submitted_at":"2022-12-22T09:43:36Z","title":"Tune-A-Video: One-Shot Tuning of Image Diffusion Models for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.11565","snapshot_observed_at":"2026-08-16T10:51:00.774032Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.774032Z"},"links":{"cited_paper":"/paper/2212.11565","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:dcd6c473c9909d78f25da36df19035b39638da32822df4e8abec18486a56b210","observation_id":"63cbf87c-8590-4d6e-a031-f91967617d1d","resolution":{"observed_at":"2026-08-16T10:51:00.774032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07954","last_updated":"2023-09-17T09:57:20Z","snapshot_observed_at":"2026-08-18T09:44:15.395691Z","submitted_at":"2023-06-13T17:52:23Z","title":"Rerender A Video: Zero-Shot Text-Guided Video-to-Video Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07954","snapshot_observed_at":"2026-08-16T10:51:00.785248Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.785248Z"},"links":{"cited_paper":"/paper/2306.07954","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:41c7ea99f79b80afff79a59bd964af75ec74151a8406f62f3cd54c7f4101d466","observation_id":"f9bb2161-4dc5-4957-aac2-5edcf5458985","resolution":{"observed_at":"2026-08-16T10:51:00.785248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05543","last_updated":"2023-11-26T22:26:12Z","snapshot_observed_at":"2026-08-14T19:07:37.876970Z","submitted_at":"2023-02-10T23:12:37Z","title":"Adding Conditional Control to Text-to-Image Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05543","snapshot_observed_at":"2026-08-16T10:51:00.788879Z","title":"=0.05 𝑤\"=0.4 𝑤","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.788879Z"},"links":{"cited_paper":"/paper/2302.05543","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:6b6daa53f125a76b13a8e78ebfa0dd96ae31f36d4427d69dc38a20479bbfa9f3","observation_id":"1451cd6d-f455-4624-bbe1-8711ec41e6bf","resolution":{"observed_at":"2026-08-16T10:51:00.788879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:51:00.563189Z","title":"Neural Networks 144 (Dec","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.563189Z"},"links":{"citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:f96c7d090cf85f681900cc8af2db3f3457c451e693138cb5c92a73ffec8ee805","observation_id":"2a7beb53-3423-4a5a-abd8-03492cd4db23","resolution":{"observed_at":"2026-08-16T10:51:00.563189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08718","last_updated":"2022-03-23T19:47:21Z","snapshot_observed_at":"2026-07-06T11:01:02.207193Z","submitted_at":"2021-04-18T05:00:29Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08718","snapshot_observed_at":"2026-08-16T10:51:00.595461Z","title":"arXiv:2104.08718 [cs.CV] https://arxiv.org/abs/2104.08718","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.595461Z"},"links":{"cited_paper":"/paper/2104.08718","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:6cce45b620ec8556610336f1e52c4d24fe4b2533fd97b733fffdb568df0f4fa7","observation_id":"cf1244dc-bb41-421a-9079-099772494e4b","resolution":{"observed_at":"2026-08-16T10:51:00.595461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11284","last_updated":"2023-12-02T02:57:54Z","snapshot_observed_at":"2026-08-16T14:42:05.138573Z","submitted_at":"2023-11-19T09:59:09Z","title":"LucidDreamer: Towards High-Fidelity Text-to-3D Generation via Interval Score Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11284","snapshot_observed_at":"2026-08-16T10:51:00.651603Z","title":"arXiv:2311.11284 [cs.CV] https://arxiv.org/abs/2311.11284","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.651603Z"},"links":{"cited_paper":"/paper/2311.11284","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:7111d5ab83dc6c164f8afad1faaab9b3bb3a82ade0632a7660fcde04d464bed3","observation_id":"5445a2ea-f9bf-43a9-9676-8451ae1be7e2","resolution":{"observed_at":"2026-08-16T10:51:00.651603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08707","last_updated":"2024-04-02T11:08:12Z","snapshot_observed_at":"2026-08-18T09:44:31.734515Z","submitted_at":"2023-06-14T19:15:49Z","title":"VidEdit: Zero-Shot and Spatially Aware Text-Driven Video Editing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08707","snapshot_observed_at":"2026-08-16T10:51:00.530007Z","title":"arXiv:2306.08707 [cs.CV] https://arxiv.org/abs/2306.08707","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T10:51:00.530007Z"},"links":{"cited_paper":"/paper/2306.08707","citing_paper":"/paper/2504.17269"},"observation_digest":"sha256:0315dbb326972fa75b41b095b002241cc709a617f8facd1797fae8bd4994983c","observation_id":"2837ba4b-4f2c-4a83-870d-82925894cf2a","resolution":{"observed_at":"2026-08-16T10:51:00.530007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.17269","last_updated":"2025-07-01T14:10:46Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T12:09:08.463793Z","submitted_at":"2025-04-24T05:54:56Z","title":"Towards Generalized and Training-Free Text-Guided Semantic Manipulation"},"reference_resolution":{"displayed":82,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":71,"verified_exact":7,"verified_fuzzy":1},"total_outbound_references":82},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 82 of 82 outbound references and 1 inbound Pith citation observation for arXiv:2504.17269."}