{"as_of":"2026-08-15T22:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dcd81040cf60f6efaad9aa37f8e7b4e9b22eb62acccc22ea3e59cd2ca9023ff5","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T15:28:56.209954Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.14046/citation-record","integrity":"/paper/2501.14046/integrity","json":"/paper/2501.14046/citation-record.json","paper":"/paper/2501.14046"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.744192Z","title":"Blended diffusion for text-driven editing of natural images","venue":null,"work_id":"b34d6439-f0b0-42ad-a048-a3b2bcc6209c","year":2022},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.052571Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:11010dd13c515c95d3ca55e5098c59ad469ac312527e26f338beed8a29eeb04f","observation_id":"c6167753-5f32-4bdb-9b97-dece69809d71","resolution":{"observed_at":"2026-08-10T15:28:56.748611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.730503Z","title":"Break-a-scene: Extracting multiple concepts from a single image","venue":null,"work_id":"2d10bc14-5595-45d2-a127-bc5700ae6cb8","year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.057822Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:ca1bf41666ea807c43ebb8d954d383a1cb70822d532c3fd43066a2272dea7cef","observation_id":"77067a6d-39aa-4e86-b442-a160c7d6ab37","resolution":{"observed_at":"2026-08-10T15:28:56.734847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.717018Z","title":"Blended latent diffusion","venue":null,"work_id":"a172d6b9-42c8-4ab4-a1f3-a33ad7990d23","year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.061956Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:5919b3ca6f180c1651a8cb33f7ae2ad201448f1e972ef1e34429f4569dfb4e78","observation_id":"be8f0e30-fece-4698-bcdb-3937ce529e8a","resolution":{"observed_at":"2026-08-10T15:28:56.721423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.703645Z","title":"Universal guidance for diffusion models","venue":null,"work_id":"e76af125-9b47-43aa-bd6f-5587d4922d67","year":2024},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.065961Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:cbf5deaaac9490e62476bf410e77e86841a1639088c806615e22b29f946501ea","observation_id":"728c1fff-a6f1-4764-9035-40f8d3e28bb7","resolution":{"observed_at":"2026-08-10T15:28:56.707737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.690336Z","title":"Improving image generation with better captions, 2023","venue":null,"work_id":"79178dfd-aecc-41b3-a98f-55a3bf8ac68a","year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.070002Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:c9d65f45593622591e16ed1a6f441135e46a5e927359c4c3bfb3f1298e75a47b","observation_id":"3cfb0b04-3d65-4569-a84d-5aa0f7cf9c14","resolution":{"observed_at":"2026-08-10T15:28:56.694474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.677351Z","title":null,"venue":null,"work_id":"98ac7db6-95d2-4677-a0de-3ebf968496a7","year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.073967Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:3a3069a398e92cadb4904a76c084939cd6f098e2a666f387ec72797590954386","observation_id":"b0a9e1b1-23cd-4663-aa66-663c290a1583","resolution":{"observed_at":"2026-08-10T15:28:56.681188Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.664313Z","title":"Language models are few-shot learners","venue":null,"work_id":"7f5dea52-ff16-487b-b652-a47902bb9df8","year":1901},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.078457Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:b177311ef9bd6862a5acca1fef8609ace7f9d77cc49e0dd7989fe95c475a4e02","observation_id":"2574eac1-a817-405e-851f-b46c423e705b","resolution":{"observed_at":"2026-08-10T15:28:56.668831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.649610Z","title":"DiffEdit: Diffusion-based semantic image editing with mask guidance","venue":null,"work_id":"59a3cca5-3dd6-47a3-a928-ec2bfc140455","year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.082428Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:e63f5df1732476022575b5bb4bac50bc681ab3a454137becaf37ae41b5c17079","observation_id":"1b26c6b8-dc92-493e-a2ab-213c6b82eddd","resolution":{"observed_at":"2026-08-10T15:28:56.654311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.635272Z","title":"Diffusion models beat GANs on image syn- thesis","venue":null,"work_id":"ede4fb7a-0b82-4edd-b11d-993a8ece7de4","year":2021},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.086298Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:7c2451c3ac38f6d38fa5ef8f36eebf9451e4dab8c948302244c5cdbdfe994a73","observation_id":"fefe8c52-f2a5-4e08-93f9-250a8882c3f5","resolution":{"observed_at":"2026-08-10T15:28:56.639725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.621396Z","title":"Diffu- sion Self-Guidance for controllable image generation","venue":null,"work_id":"720f77f6-0dd8-4461-8c1d-7a8b3304b508","year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.090184Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:52d3c3c7ab764384f7b444fa9e4e299156d10b2bb9efcb7d4ab16eb078c8cdb8","observation_id":"f7a5825d-9a3b-4877-a7dd-c447e3178876","resolution":{"observed_at":"2026-08-10T15:28:56.625908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03206","last_updated":"2024-03-05T18:45:39Z","snapshot_observed_at":"2026-08-13T01:47:21.043519Z","submitted_at":"2024-03-05T18:45:39Z","title":"Scaling Rectified Flow Transformers for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03206","snapshot_observed_at":"2026-08-10T15:28:56.094553Z","title":"Scaling rectified flow transformers for high-resolution image syn- thesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.094553Z"},"links":{"cited_paper":"/paper/2403.03206","citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:2ce34941db2829c8b78acad9a6e6dcd1f0cfab3203620adfd63d7869fffd7f3c","observation_id":"d8827997-e7d0-45d6-8238-7a97cae0c884","resolution":{"observed_at":"2026-08-10T15:28:56.094553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.607846Z","title":"An image is worth one word: Personalizing text-to-image genera- tion using textual inversion","venue":null,"work_id":"4497c1a4-00de-475c-b570-4144e137490e","year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.099142Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:cfcdbb083ec843510fda8c2d2734620af5e686f8aa5a19f68fb32287a9a372bd","observation_id":"780e8d1a-449f-48d8-92ff-6f32a01adc9a","resolution":{"observed_at":"2026-08-10T15:28:56.612301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.594438Z","title":"Diffusion models as plug-and-play priors","venue":null,"work_id":"9cf8e5eb-99cb-4c58-90bc-2d1f1e72d163","year":2022},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.103250Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:d6e3e219bcee01e0b9302a986e720a560c1f523ca28f64e10793e88b46bda81f","observation_id":"cbea1d66-5243-49e8-8855-017be9d9d569","resolution":{"observed_at":"2026-08-10T15:28:56.598469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.581467Z","title":"Prompt-to-prompt image editing with cross-attention control","venue":null,"work_id":"485ce4cb-5f60-46bd-a6ea-29d915e2fb6d","year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.107687Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:53deb2b17ed248d72c22c0b557f8daffb6521e420d5b86ef6ef264a529703310","observation_id":"15a42542-c963-4cc9-b32d-756ee4eb125c","resolution":{"observed_at":"2026-08-10T15:28:56.585383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.111938Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.111938Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:fe27518bfdc80f52337bee98ef2dea999844490afd3ebd1ad867fb6dabe38f5e","observation_id":"ef35354b-de24-40af-9a0a-1b2134293da7","resolution":{"observed_at":"2026-08-10T15:28:56.111938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.116102Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.116102Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:288b86ef3a11607d2f8844a5d69b4473f34f482ddd789b56e7e9a4e97ef2db6b","observation_id":"914b68cc-25f8-48b9-83d5-ce8129a356fc","resolution":{"observed_at":"2026-08-10T15:28:56.116102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-10T15:28:56.120194Z","title":"Jiang et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.120194Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:8b9ac18b0f00db6e9dda0f5a204ea20989d54edec0291922bf31bd3d238a2932","observation_id":"11de8e1a-e3a6-404a-98fb-b0d200e71379","resolution":{"observed_at":"2026-08-10T15:28:56.120194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.549374Z","title":"Imagic: Text-based real image editing with diffusion models","venue":null,"work_id":"34957cee-9800-4da1-b407-ef5ec52ba8f9","year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.124872Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:edf8a06897a2a05185bc3932f9d46d43e0c8a96d72db675604cbc4d97df7e3a4","observation_id":"888dfb6d-b480-41b3-94cc-e76376368e73","resolution":{"observed_at":"2026-08-10T15:28:56.553992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.536047Z","title":"Variational diffusion models","venue":null,"work_id":"955fa463-3939-4241-bd5a-8c177d7422e0","year":2021},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.129137Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:269aeeefbaac9bfb603dee9733926ccedbe5aaf0d0ac094fbb8fcd96f5b89abf","observation_id":"61a8b553-bcb5-4023-99f1-eecbef662f6f","resolution":{"observed_at":"2026-08-10T15:28:56.540130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.133237Z","title":"Multi-concept customization of text-to-image diffusion","venue":null,"work_id":null,"year":1931},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.133237Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:19011702ce762ee200a22716b07d96104b58771872696a16c9d9556b4f0a4216","observation_id":"6c3b6794-85c5-4013-a5d0-4a24e36c4564","resolution":{"observed_at":"2026-08-10T15:28:56.133237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13655","last_updated":"2024-03-04T18:43:49Z","snapshot_observed_at":"2026-08-14T02:27:06.690299Z","submitted_at":"2023-05-23T03:59:06Z","title":"LLM-grounded Diffusion: Enhancing Prompt Understanding of Text-to-Image Diffusion Models with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13655","snapshot_observed_at":"2026-08-10T15:28:56.136764Z","title":"Llm-grounded diffusion: En- hancing prompt understanding of text-to-image diffusion models with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.136764Z"},"links":{"cited_paper":"/paper/2305.13655","citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:82acfc377ebbb45bfc868eda292d10aad0b6d5ea96f9b1f55f362c47bebc8a5a","observation_id":"3d237b25-88e6-47e2-ae72-8f8ceeee0e56","resolution":{"observed_at":"2026-08-10T15:28:56.136764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.512745Z","title":"Compo- sitional visual generation with composable diffusion models","venue":null,"work_id":"fbdd2869-e168-47cd-b4c7-2a420efdc8d8","year":2022},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.141061Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:8153d896ae0229fd18bf08d936bd56df46aabe3307aec7a9fb11c0bc9ba0e9f6","observation_id":"ab75c67c-b9a5-4f83-a478-f3a9aaf09f37","resolution":{"observed_at":"2026-08-10T15:28:56.517184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-10T15:28:56.144895Z","title":"Gemma: Open models based on gemini research and technol- ogy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.144895Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:0a27fdfaf5a1724631ba719215ff985d103a9fb47efb2d2669b845ca5f88ee35","observation_id":"33576f37-d36a-450c-bd66-883292bba580","resolution":{"observed_at":"2026-08-10T15:28:56.144895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.498296Z","title":"Scaling open-vocabulary object detection","venue":null,"work_id":"621f888d-946d-48da-be91-fcf2d4bb0a2e","year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.148676Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:25699aa50d710308f60283d0d6438cd5178fe74788e5d767b47608f435ef2fd6","observation_id":"0c4e6579-f3e0-43b1-ae5f-af391c46a444","resolution":{"observed_at":"2026-08-10T15:28:56.503279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.482872Z","title":"DragonDiffu- sion: Enabling drag-style manipulation on diffusion models","venue":null,"work_id":"735e247f-1423-44fb-8849-a95ae2c62aae","year":2024},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.152276Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:ed5cbfd87e7fd99b5170979b445fe197e75d551b389c4e7c2d6df1846672054b","observation_id":"596db516-6881-480b-9b51-7194dfb41a36","resolution":{"observed_at":"2026-08-10T15:28:56.487822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.469256Z","title":"SDXL: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":"09f4fbce-4b08-4edb-9f01-aebe1825ec8e","year":2024},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.155662Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:7e900bcad1c0eb68944b2ddf32b8c5813048b805b749c7fea4fc9d3a6e0ae252","observation_id":"77caa4de-f3b4-4a37-ab3b-cd691590c931","resolution":{"observed_at":"2026-08-10T15:28:56.473292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.456022Z","title":"Learning transferable visual models from natural language super- vision","venue":null,"work_id":"206511cf-2dbd-464b-b2ce-c2bd347cfb90","year":2021},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.159283Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:9b72851bfc8796193898cdd9b252b9f37e000fe01d32f8b3cceeb0ab05b44172","observation_id":"ab422940-b4c1-44f7-9aa4-4240efdd7c19","resolution":{"observed_at":"2026-08-10T15:28:56.460327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.442839Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":"0d5f9c87-bbf7-4054-b5fa-ab55b327e028","year":2021},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.163552Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:5c196137030658e80728558b6fcb2ab22b7b1dba5faf638a94dc55016bef1778","observation_id":"bdc06ff8-cf0e-4e95-baaf-c000b90a9e6b","resolution":{"observed_at":"2026-08-10T15:28:56.446881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.428878Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"840a962a-4601-4bcf-962b-e3cdb88f9120","year":2022},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.167716Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:22417df1fca662d1501d579139c82cd90aefddca79388b463bfb895aa945b4e7","observation_id":"94ecbbad-4356-458d-a05a-01280c522a47","resolution":{"observed_at":"2026-08-10T15:28:56.433497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.172328Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.172328Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:a69826396de661bb36f30fa743d05c260a23bc06cc77316bb6f777136c9c0da4","observation_id":"22e2dc97-2617-45ff-806a-3ad8d1e82cb6","resolution":{"observed_at":"2026-08-10T15:28:56.172328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.403894Z","title":"Photorealistic text-to-image diffusion models with deep lan- guage understanding","venue":null,"work_id":"c3319bc0-32bc-4bf7-aa40-96b3af268d2a","year":2022},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.176633Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:6ef419222207e8eb22b8350a838eeac73622e7ab4182061f9e04dbbd12ffa22d","observation_id":"d635cb3d-7c17-437d-b6e7-c34c29ba6a71","resolution":{"observed_at":"2026-08-10T15:28:56.408594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.180780Z","title":"Denoising diffusion implicit mod- els","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.180780Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:13d0314032febd5fefc97a8222d04f668c357ace0713ea71d902a79e935a749b","observation_id":"13ce9922-8653-4a78-b5e6-c0d3cda17966","resolution":{"observed_at":"2026-08-10T15:28:56.180780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.184943Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.184943Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:22d1b7cfc5a73a7a0b240ba481cd4aa2bf1d533a05581048264741a8f4d5dd74","observation_id":"c301d897-a153-4a2f-909e-223da9dc4a4b","resolution":{"observed_at":"2026-08-10T15:28:56.184943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-10T15:28:56.189112Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.189112Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:1829b60b9b5c3349669747fc8b6b3e66fe66b48b407a6af69e8825072e2c0894","observation_id":"e61b4fd5-6962-46b9-a686-2ea88c2c5d62","resolution":{"observed_at":"2026-08-10T15:28:56.189112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.370125Z","title":"Plug-and-play diffusion features for text-driven image-to-image translation","venue":null,"work_id":"923e4e31-7ed0-4d75-ac86-d17bcce97124","year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.193676Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:73a27414b60ad711938500670bb75ccf41ce85bd5b7958c6b1634d56a8e97440","observation_id":"39a5271a-a6dd-4b1d-8d46-e6f79eb07550","resolution":{"observed_at":"2026-08-10T15:28:56.374856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.355201Z","title":"Dy- namic prompt learning: Addressing cross-attention leakage for text-based image edit- ing","venue":null,"work_id":"68b4d488-1c1b-452b-8715-11da61088bcf","year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.197814Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:4db95047aa6007761728793ac16914d2de0019f76809c4243b919520d0d44393","observation_id":"52aad501-4818-4260-9355-0b57c81a164a","resolution":{"observed_at":"2026-08-10T15:28:56.360036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16090","last_updated":"2023-11-27T18:56:37Z","snapshot_observed_at":"2026-08-15T17:31:19.267596Z","submitted_at":"2023-11-27T18:56:37Z","title":"Self-correcting LLM-controlled Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16090","snapshot_observed_at":"2026-08-10T15:28:56.202130Z","title":"Self- correcting llm-controlled diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.202130Z"},"links":{"cited_paper":"/paper/2311.16090","citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:b786ae836e3ebf2befeb1762dbc4330ab22533f0025b02872eb6421243fc0ac4","observation_id":"fd16baf5-8fc1-430c-a23e-4259795f900f","resolution":{"observed_at":"2026-08-10T15:28:56.202130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.340718Z","title":"Adding conditional control to text- to-image diffusion models","venue":null,"work_id":"bbb163a9-a239-4bc8-b3a4-5a18e18b72cb","year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.206392Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:5d64b6f8dd57574a3697b67053cacfc64a2042f885ecf04bbe98f12df0449122","observation_id":"018fbb71-7047-4334-90a9-c711368fbe90","resolution":{"observed_at":"2026-08-10T15:28:56.345042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:28:56.324866Z","title":"Sur- adapter: Enhancing text-to-image pre-trained diffusion models with large language models","venue":null,"work_id":"fe0ab46b-5870-4abf-b0bf-b1c262d04190","year":2023},"citing_paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T15:28:56.209954Z"},"links":{"citing_paper":"/paper/2501.14046"},"observation_digest":"sha256:b943c7a6bf9748959d7c292ed2ac227f03ae7faf55f7760b09ac16bede80e780","observation_id":"24088f72-890c-414a-815a-facae9994ccc","resolution":{"observed_at":"2026-08-10T15:28:56.331088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.14046","last_updated":"2025-01-23T19:26:14Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T18:25:04.856108Z","submitted_at":"2025-01-23T19:26:14Z","title":"LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2501.14046."}