{"as_of":"2026-08-15T10:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3d57b4c4a14fc695970a78d670e9c241034e5cd6b75c103e7644926ca3ade140","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:54:41.801190Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.06826/citation-record","integrity":"/paper/2506.06826/integrity","json":"/paper/2506.06826/citation-record.json","paper":"/paper/2506.06826"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.500210Z","title":"Wan 2.1 flf2v: First-last frame video generation","venue":null,"work_id":"6b62b858-5f23-4ce7-99d6-4c72f531a865","year":2025},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.569936Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:311939c48ed0e71d782f93413d39f5a68eb3b9338714041b6cb566134eff4dfe","observation_id":"59fd8493-e45f-4ffb-a7ae-48a93d98fa71","resolution":{"observed_at":"2026-08-07T05:54:42.503855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.489347Z","title":"Blended diffusion for text-driven editing of natural images","venue":null,"work_id":"f295c83b-1e0a-472b-8345-48dc814dc85a","year":2022},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.573980Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:a585d0a291f94cd1a277ab64967aa77258ad10a28d7274240c26e5d8d9ddda54","observation_id":"4a2b3ec0-a74a-4b26-9106-6535725b38cf","resolution":{"observed_at":"2026-08-07T05:54:42.493422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.0473","last_updated":"2016-05-19T21:53:22Z","snapshot_observed_at":"2026-08-12T12:07:33.202888Z","submitted_at":"2014-09-01T16:33:02Z","title":"Neural Machine Translation by Jointly Learning to Align and Translate","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.0473","snapshot_observed_at":"2026-08-07T05:54:41.578096Z","title":"Neural machine translation by jointly learning to align and translate","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.578096Z"},"links":{"cited_paper":"/paper/1409.0473","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:caf9f646782514196e69fe05b2cad872c6a69b3ab15b78902516bdf58a93c332","observation_id":"787b3a90-8077-4bf2-933d-8a3bc98d9f7f","resolution":{"observed_at":"2026-08-07T05:54:41.578096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.478383Z","title":"Flux.1 redux [dev]: Image variation adapter for flux.1 models","venue":null,"work_id":"4b64984b-92bb-4467-bfda-407ed4a6f9e9","year":2025},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.582028Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:5f9cf5be12b69e41e24fd1f114018c2f00270e1b53a45c4c0ee9a8a3da39caee","observation_id":"6bbaeca0-49a0-4222-a39f-7574acedcb97","resolution":{"observed_at":"2026-08-07T05:54:42.482289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.468036Z","title":"Instructpix2pix: Learning to follow image editing instructions","venue":null,"work_id":"d19265b7-e75f-4c29-8164-1b982b3a6cc8","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.586109Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:b554c3e0fb365b71ff0fe47b021cd07739df1a856d30029beb03cd86c3e4d48a","observation_id":"2d6741c8-7af0-46e8-a20d-fb25052ea07f","resolution":{"observed_at":"2026-08-07T05:54:42.471625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.457456Z","title":"Multi-view consistency loss for improved single-image 3d reconstruction of clothed people","venue":null,"work_id":"94949cb0-92db-4e71-807b-53d50cfd3bf7","year":2020},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.589807Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:67bf0b295af698d781dd50beac2270fe0847d65160c821a7fed56260bd776ba8","observation_id":"bbd622f8-04a3-4509-9d1b-60481d70fa7e","resolution":{"observed_at":"2026-08-07T05:54:42.460943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.593481Z","title":"Masactrl: Tuning-free mutual self-attention control for consistent image synthesis and editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.593481Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:d4d9cdde14d3ad86ca3cfee067fe915d987ac8c5550af9e5c125f9eccd708dd5","observation_id":"c9888a0e-b5e4-4a83-a448-9c851a467d50","resolution":{"observed_at":"2026-08-07T05:54:41.593481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.441122Z","title":"Training-free layout control with cross-attention guidance","venue":null,"work_id":"a906cbbd-34b8-4544-859f-bdd65056fbf7","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.596805Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:66f780d47e2d54fe1e3aab4c61e6ed989ba396a16127219d61af705a9e6d01ba","observation_id":"3cfe740e-c9b9-48d9-ac89-0ac2ecbb309e","resolution":{"observed_at":"2026-08-07T05:54:42.444962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.430732Z","title":"Perception prioritized training of diffusion models","venue":null,"work_id":"305a517b-79f0-419e-96ca-40e5e8711490","year":2022},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.599952Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:dc190f5c709fd3ff016bd51bc3b5c84cf6d64419a0c954717df18833f832438d","observation_id":"edb52951-f602-428d-96b4-acdba64a8fe9","resolution":{"observed_at":"2026-08-07T05:54:42.434340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.420535Z","title":"Flux.1-dev-controlnet-inpainting-beta","venue":null,"work_id":"0a2c4279-3ad7-4463-94f0-b7074a711dd3","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.603120Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:fa18fadc693aed999e8397fe9032c1ce8095051c19168dbf5a1a833279c000ff","observation_id":"2c21c13d-d4fc-4429-971f-37c78afeefc7","resolution":{"observed_at":"2026-08-07T05:54:42.424038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.609794Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.609794Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:ba1df7ca4f5e897cf0f04b7138f5d4d8bba634231188d50f8a7d5a7b2e71eb6c","observation_id":"802e2eb3-7063-4a09-be43-d3629119f161","resolution":{"observed_at":"2026-08-07T05:54:41.609794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16420","last_updated":"2024-01-29T18:59:02Z","snapshot_observed_at":"2026-08-05T03:42:54.599829Z","submitted_at":"2024-01-29T18:59:02Z","title":"InternLM-XComposer2: Mastering Free-form Text-Image Composition and Comprehension in Vision-Language Large Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16420","snapshot_observed_at":"2026-08-07T05:54:41.613378Z","title":"Internlm-xcomposer2: Mastering free-form text-image composition and comprehension in vision-language large model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.613378Z"},"links":{"cited_paper":"/paper/2401.16420","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:080f055488053e4a9846e976941ab3c53d530974fabb06006289fd6a8a4e9ed6","observation_id":"2bb1ccdb-5715-4bcc-b5d3-4d8d6b0713e4","resolution":{"observed_at":"2026-08-07T05:54:41.613378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.404277Z","title":"Efros, and Aleksander Holynski","venue":null,"work_id":"bbd8ee9f-9f0f-4993-9861-165fe0209078","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.617190Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:fb8ac13dd36b9b69ffa3c220bbb687053adec788d87dcc6f34a14dd1dd003058","observation_id":"09d67ae2-211d-4260-85e5-264bcffaf608","resolution":{"observed_at":"2026-08-07T05:54:42.407838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09630","last_updated":"2026-06-05T14:06:55Z","snapshot_observed_at":"2026-08-07T17:12:06.463329Z","submitted_at":"2025-03-11T18:20:20Z","title":"CASteer: Cross-Attention Steering for Controllable Concept Erasure","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09630","snapshot_observed_at":"2026-08-07T05:54:41.620334Z","title":"Casteer: Steering diffusion models for controllable generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.620334Z"},"links":{"cited_paper":"/paper/2503.09630","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:adecbeb8ab364d0f492784d2bde8a8dbe4acdd50cf5700634684252213ce9e8d","observation_id":"d10cfc10-2eb7-4846-be85-743208858275","resolution":{"observed_at":"2026-08-07T05:54:41.620334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.624039Z","title":"Generative adversarial networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.624039Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:e1cc6a86de0a55aeccb05ba170dab10c71555eeba588a3e76b1d5d4e7f26236f","observation_id":"8d1e1d5e-64f6-4a23-b870-5e180255454a","resolution":{"observed_at":"2026-08-07T05:54:41.624039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.627283Z","title":"Generative adversarial nets","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.627283Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:05a4f5b29addf73bae0803632830020244549c95c18285a8d31300ace6d13982","observation_id":"b8e76a78-def9-46dc-8648-420519faac55","resolution":{"observed_at":"2026-08-07T05:54:41.627283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-07T05:54:41.630660Z","title":"Prompt-to-prompt image editing with cross attention control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.630660Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:047b18914330f8d0b8edde6d149616c6aee324bc71df503653e9da3cc26296d7","observation_id":"0bb73e4f-1d0b-43d5-a824-2eb1bf5cd69b","resolution":{"observed_at":"2026-08-07T05:54:41.630660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08718","last_updated":"2022-03-23T19:47:21Z","snapshot_observed_at":"2026-07-06T11:01:02.207193Z","submitted_at":"2021-04-18T05:00:29Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08718","snapshot_observed_at":"2026-08-07T05:54:41.634098Z","title":"Clipscore: A reference-free evaluation metric for image captioning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.634098Z"},"links":{"cited_paper":"/paper/2104.08718","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:9278208c6914dfaee22ee918334e1292313c09bb5a899ebc74e01189f8e24e86","observation_id":"61a4a234-c2ea-4081-8d17-dce417e66eb7","resolution":{"observed_at":"2026-08-07T05:54:41.634098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.637948Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.637948Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:84bb54ecd568ab2fbf823698badfc48ee7b77b7212e7f7d46f91c3e9671554b2","observation_id":"fec7d823-1454-42e7-9e41-c6abac6a9db0","resolution":{"observed_at":"2026-08-07T05:54:41.637948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.375258Z","title":"3d shape completion with multi-view consistent inference","venue":null,"work_id":"a2a87e61-a858-4924-a420-8522d564c517","year":2020},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.641284Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:38cda921a947d1cf786adbdef5a807c30ae78a5e10e110622252d6f78b6c4e2a","observation_id":"2bdab274-0e9c-44c5-b836-317b192a671d","resolution":{"observed_at":"2026-08-07T05:54:42.379063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.364276Z","title":"Globally and locally consistent image completion","venue":null,"work_id":"b025da63-7d99-43e0-a39a-63e8e63cf59b","year":2017},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.644508Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:94f8cd5af3cf6e63211c4b5425c187531beb406b7653688bade0d017ad3e619a","observation_id":"6a9dba46-3dc8-4ad4-a41b-2819cef99ada","resolution":{"observed_at":"2026-08-07T05:54:42.367896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.353630Z","title":"Video interpolation with diffusion models","venue":null,"work_id":"b8e26bd4-908a-42c4-8cc4-ef0c8594b998","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.647545Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:463f05a425b416e655572d60a56c48eea87cb4f2d7ba56e08532f2cd150d9be5","observation_id":"ead48133-d038-4d02-b34d-7fd93def5f03","resolution":{"observed_at":"2026-08-07T05:54:42.357276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15842","last_updated":"2025-08-27T10:30:27Z","snapshot_observed_at":"2026-08-14T15:18:20.844684Z","submitted_at":"2024-07-22T17:58:05Z","title":"DiffArtist: Towards Structure and Appearance Controllable Image Stylization","version":4},"cited_work":{"arxiv_id":"2407.15842","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.15842","snapshot_observed_at":"2026-08-07T05:54:41.942928Z","title":"DiffArtist: Towards Structure and Appearance Controllable Image Stylization","venue":"cs.CV","work_id":"2ad512cf-6eba-427a-a5ba-04d51ec77ec3","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.650780Z"},"links":{"cited_paper":"/paper/2407.15842","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:97e2b038f1893da31011b5fbcfb2ba2e039261abc85e5baad1ca849dee577216","observation_id":"5bf12def-21ea-404c-bf78-14152976fd60","resolution":{"observed_at":"2026-08-07T05:54:41.949073Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.342691Z","title":"Imagic: Text-based real image editing with diffusion models","venue":null,"work_id":"7c59a4a4-7abe-40c4-b560-9040398dcdc8","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.654339Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:5accab1b74aaadf4aeced32b6ad47b12421630d262765bf6ec3b207ffcd9eb4d","observation_id":"4c4632a6-e9fa-44c0-aedc-f90cbd76f935","resolution":{"observed_at":"2026-08-07T05:54:42.346788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.331347Z","title":"Dense text-to-image generation with attention modulation","venue":null,"work_id":"3cc091ed-530a-4994-b841-276f7c733bac","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.657495Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:3237169be7393817f3fd3b7e3d936fd0b253beaf58afcf82b0c793580f73ca6d","observation_id":"c7547ae0-7f0c-4100-95b2-d7ae25e6aacf","resolution":{"observed_at":"2026-08-07T05:54:42.335324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.660443Z","title":"Auto-encoding variational bayes, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.660443Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:66e1d0a4f0b17ec98d21702480ce961f12c2240d2db8d2c44af862c62c1b74f4","observation_id":"e26dfa68-bce1-4c9e-9b8a-9f921ac150e1","resolution":{"observed_at":"2026-08-07T05:54:41.660443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.663699Z","title":"Segment anything","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.663699Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:8c0401d6da5eb9512b0ab7afce7332b360c0376690dc55f59769bd02876d1848","observation_id":"d7dafdb3-97b3-476e-90a5-2d0229d5512c","resolution":{"observed_at":"2026-08-07T05:54:41.663699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.308446Z","title":"o hler, Christian Schuler, Bernhard Sch \\","venue":null,"work_id":"986298ec-65dc-4e75-a3c7-2817885c9d17","year":2014},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.666782Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:dbc4cbc67abab34ca315b560c96d81d5f77922f75ad0c0c98c3fc368cf144de4","observation_id":"ddce91d7-8351-470b-9e66-d498b28b8f2d","resolution":{"observed_at":"2026-08-07T05:54:42.311815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.298480Z","title":"Kuaishou unveils proprietary video generation model 'kling'","venue":null,"work_id":"08605a55-6288-49b4-81be-ed5afbad21e5","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.669974Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:1b32ebc7a5cb98637538cb158146bfc4e50ae74d07ac884921088bdb36451ad3","observation_id":"feedae91-8c63-4fc9-85e4-092822a90c06","resolution":{"observed_at":"2026-08-07T05:54:42.302012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.288027Z","title":"Flux.1 [dev]","venue":null,"work_id":"a87341a0-b479-48e3-8f89-81368e99ad81","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.672951Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:e23fb87cb54d753fa4e5340347bae3e6b0f14a34aeaae168364520bd0e94a7ab","observation_id":"92480f6c-b441-4bf2-a92e-d823a3384506","resolution":{"observed_at":"2026-08-07T05:54:42.291527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.277942Z","title":null,"venue":null,"work_id":"8fb73eba-f311-4c74-9420-138d69422f62","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.676144Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:3401dbfc023f4af10388b87fa5ba205ba147c4e5d778e9520fbb772337ed2792","observation_id":"3cf7a701-e983-4e6a-bb70-78f472e0966f","resolution":{"observed_at":"2026-08-07T05:54:42.281429Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.267030Z","title":"Context-aware synthesis and placement of object instances","venue":null,"work_id":"dbc1dae7-4a47-43f8-8f22-0e41841eae0e","year":2018},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.679202Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:43e25c9a065e834a290f509b2389e528ea79b72e0c7b09f85805964cc2d2d3ab","observation_id":"57b75549-3e03-4ccf-bd1d-19d5d6d1252d","resolution":{"observed_at":"2026-08-07T05:54:42.270996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.256037Z","title":"Layerdiffusion: Layered controlled image editing with diffusion models","venue":null,"work_id":"a8a537ed-2d28-41e5-9f83-b823be1b413b","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.682081Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:6077d0e7ea80b55d37205124001b43009d0f82b93dbdb2fec460fb93f4c91fb5","observation_id":"3a38e6fc-55b1-46e6-866b-c0ac8e09cd1a","resolution":{"observed_at":"2026-08-07T05:54:42.259766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.245558Z","title":"Mt-gan: toward realistic image composition based on spatial features","venue":null,"work_id":"d0614c63-6768-411b-8c71-35d7e2303e74","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.685287Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:2bef03d837f4c34a02f54b3eacdae14b5e1d9b61791fc823a245ee3d2c1f4aab","observation_id":"2a54b398-2597-45d4-aabf-a8f338277591","resolution":{"observed_at":"2026-08-07T05:54:42.249323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-07T05:54:41.688572Z","title":"Flow matching for generative modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.688572Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:b2c0f38bac8e8be27c4680df5f382a714e1462e0037b3ca9c6e9ef5d0c5112b3","observation_id":"57312b3f-d82d-48b8-8900-04aff4faf300","resolution":{"observed_at":"2026-08-07T05:54:41.688572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.234574Z","title":"Image inpainting for irregular holes using partial convolutions","venue":null,"work_id":"d159b5e2-ad78-4cd4-a3cc-2be51e29ed82","year":2018},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.692193Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:d7faef7bbc969bc74cb0e11a0aaa8845ad60d63507921af666222b0a42af648d","observation_id":"61867c1d-f6b2-46d4-8b0f-7aee92b97f2c","resolution":{"observed_at":"2026-08-07T05:54:42.238359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20280","last_updated":"2024-10-26T21:12:32Z","snapshot_observed_at":"2026-08-12T22:14:33.415253Z","submitted_at":"2024-10-26T21:12:32Z","title":"MarDini: Masked Autoregressive Diffusion for Video Generation at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20280","snapshot_observed_at":"2026-08-07T05:54:41.695472Z","title":"Mardini: Masked autoregressive diffusion for video generation at scale","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.695472Z"},"links":{"cited_paper":"/paper/2410.20280","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:e0e1a2cb7f29666f8965c2c9116421c5e5fb3ccc88298c9a00551e71bef4dce2","observation_id":"141567d3-d732-4661-8fad-0912920fecb9","resolution":{"observed_at":"2026-08-07T05:54:41.695472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.223862Z","title":"Diffpop: Plausibility-guided object placement diffusion for image composition","venue":null,"work_id":"c752a560-a2d6-46fa-aea3-75a573713896","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.698894Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:150d7e3c7cb1fc8741f18d5b745fc7f33c2f0b55d13884445972729092c38c3f","observation_id":"0e421cde-1b84-4b88-94cb-4ec75163e71b","resolution":{"observed_at":"2026-08-07T05:54:42.227537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-08-15T10:26:22.896514Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17761","snapshot_observed_at":"2026-08-07T05:54:41.701802Z","title":"Step1x-edit: A practical framework for general image editing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.701802Z"},"links":{"cited_paper":"/paper/2504.17761","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:9833e49800bbf9cbfbeee6d43f39c46b9cc04c989f4db5971b5f2f8b6ade1e0a","observation_id":"c5c04562-cf32-4c74-9092-7469807673db","resolution":{"observed_at":"2026-08-07T05:54:41.701802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.212287Z","title":"Directed diffusion: Direct control of object placement through attention guidance","venue":null,"work_id":"8ddfc057-18f8-4198-930f-d0e6802f01b2","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.705201Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:f5daad37bc701cc5d4dfd3ff760a09c238eefb2bba254ca4c79194757693b648","observation_id":"6a7425a3-5da8-4c08-906f-c5557d15dae3","resolution":{"observed_at":"2026-08-07T05:54:42.216754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.708387Z","title":"Null-text inversion for editing real images using guided diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.708387Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:068b250b505d629a34629dff89b66365caccbf1afcdeb498b6c9b094c05fdb18","observation_id":"a13828ed-edbc-4243-949e-67f68bbbe8d6","resolution":{"observed_at":"2026-08-07T05:54:41.708387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.195851Z","title":"Intelligent scissors for image composition","venue":null,"work_id":"045da0fd-1aa2-482f-b4ac-ea875cf794f5","year":1995},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.711574Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:5aba807a55453211b3b79542e00603e2216f57f944ff60f93486cc4eb7728b7d","observation_id":"cc3360f5-8d2c-4ec4-b9a5-57e4aaa31ace","resolution":{"observed_at":"2026-08-07T05:54:42.199383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.715058Z","title":"T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.715058Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:bce8cb19784d25e6a260f1b16df22895d8a950df3e243e6c27397bff2388284d","observation_id":"148ebdb7-6825-42dc-b3ce-1756929de76b","resolution":{"observed_at":"2026-08-07T05:54:41.715058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.178654Z","title":"Understanding the latent space of diffusion models through the lens of riemannian geometry","venue":null,"work_id":"33c30635-df4e-4e72-a976-58602c82d601","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.718376Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:5f328716df919b9c0174d906356379b5a878ad1bcf2acace694f6960c1c2ea17","observation_id":"cb3a8ada-4db7-4545-aa3f-fab94cda353e","resolution":{"observed_at":"2026-08-07T05:54:42.182317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.721778Z","title":"Context encoders: Feature learning by inpainting","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.721778Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:d14011a6b85b8274a931f2afa6550b1917de6483aa90f796608a1765a3d7b284","observation_id":"fa1d4024-6f5a-47dc-9cc7-3cb387776a68","resolution":{"observed_at":"2026-08-07T05:54:41.721778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.161352Z","title":"Grounded text-to-image synthesis with attention refocusing","venue":null,"work_id":"71f907b4-df88-4dd8-86c4-edffdd5b7554","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.725119Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:906060d8dd062553229c18abb76a5c61b3656b69ab520af2ced9360ee5d013f2","observation_id":"22244d90-b74f-4e7d-9dee-2578d27685de","resolution":{"observed_at":"2026-08-07T05:54:42.165312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.149961Z","title":"Deadiff: An efficient stylization diffusion model with disentangled representations","venue":null,"work_id":"c41e771f-3866-4c1b-a89f-05347cc8729c","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.728199Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:17ab00359436e104b1aae7d7c471cfe698ec79148e65f9b98c4fe7870cd09123","observation_id":"740e2af0-01b0-499e-a332-4656633327f5","resolution":{"observed_at":"2026-08-07T05:54:42.153765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11147","last_updated":"2023-11-02T17:59:06Z","snapshot_observed_at":"2026-08-14T15:52:24.786650Z","submitted_at":"2023-05-18T17:41:34Z","title":"UniControl: A Unified Diffusion Model for Controllable Visual Generation In the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11147","snapshot_observed_at":"2026-08-07T05:54:41.731278Z","title":"Unicontrol: A unified diffusion model for controllable visual generation in the wild","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.731278Z"},"links":{"cited_paper":"/paper/2305.11147","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:d9500f75c35da17e2d4db7307758bfed5c2eec6d8ddcc49d3738ce591f8eec01","observation_id":"d06f9419-645f-45c9-9975-5a1cdcf8ffed","resolution":{"observed_at":"2026-08-07T05:54:41.731278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.734633Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.734633Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:74aec63d0a41b17ba01cbdf84ed0c1c2d66bb091148d1261dc8765bc4e5d83d5","observation_id":"a6aa0691-ac95-4374-b461-641133f36b12","resolution":{"observed_at":"2026-08-07T05:54:41.734633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.738601Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.738601Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:eafeb2df6acc7feaa25d54e8d9a731e7354d4075b26efab8e16f60fb548c9c96","observation_id":"6585b1df-9b08-40d2-af2e-1806c823a17e","resolution":{"observed_at":"2026-08-07T05:54:41.738601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10792","last_updated":"2024-10-14T17:56:24Z","snapshot_observed_at":"2026-08-13T10:37:03.105354Z","submitted_at":"2024-10-14T17:56:24Z","title":"Semantic Image Inversion and Editing using Rectified Stochastic Differential Equations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10792","snapshot_observed_at":"2026-08-07T05:54:41.742210Z","title":"Semantic image inversion and editing using rectified stochastic differential equations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.742210Z"},"links":{"cited_paper":"/paper/2410.10792","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:16f9559e48d95a5f75d90ab7902937c6dbe39c900eca2aea40715faabbc40f6d","observation_id":"85389a90-a42d-4bab-9ba1-2cc4e6a851dd","resolution":{"observed_at":"2026-08-07T05:54:41.742210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.745794Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.745794Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:456d2e655b26829594115aa8f173b7abf08973f392fa81f06e676aeb231751e6","observation_id":"de7013f0-8a47-40fe-9904-4e71c4934e1f","resolution":{"observed_at":"2026-08-07T05:54:41.745794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-07T05:54:41.749042Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.749042Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:053f18864722e71ce018c3e2cf348961b19ffac7170e827c857074cf95b04852","observation_id":"bd87cd26-a60a-4e56-9ec6-28a9ddb68799","resolution":{"observed_at":"2026-08-07T05:54:41.749042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-07T05:54:41.752302Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.752302Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:366a2f3ff9292d5db5cf00eef14ad7d81a7e65eacdce8f3f67d93b03a43f44e7","observation_id":"d778a17a-f709-4ab6-b318-dd3560d759e6","resolution":{"observed_at":"2026-08-07T05:54:41.752302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.119446Z","title":"Parasol: Parametric style control for diffusion image synthesis","venue":null,"work_id":"b7222c2e-ac6f-4256-be29-fbdc25be9f23","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.755542Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:70c9e314c8f1c34fad734d2167fc0f103eed3b9a25ee0ee7cc06c08ba72b2808","observation_id":"745a0bc0-7212-4fd0-9da8-bd1165121dc8","resolution":{"observed_at":"2026-08-07T05:54:42.123302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07232","last_updated":"2024-11-12T07:49:39Z","snapshot_observed_at":"2026-08-12T22:02:59.809957Z","submitted_at":"2024-11-11T18:50:09Z","title":"Add-it: Training-Free Object Insertion in Images With Pretrained Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07232","snapshot_observed_at":"2026-08-07T05:54:41.758667Z","title":"Add-it: Training-free object insertion in images with pretrained diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.758667Z"},"links":{"cited_paper":"/paper/2411.07232","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:ec5bd086cdd7d5a58267c0a23a5d546eb7f4aea6b70d6e0bd065954b6a8e9b93","observation_id":"1a09ddf0-2200-4c8a-baae-189bf15fdb27","resolution":{"observed_at":"2026-08-07T05:54:41.758667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.108926Z","title":"Towards effective usage of human-centric priors in diffusion models for text-based human image generation","venue":null,"work_id":"32ec3666-a96e-422f-94e9-001dd30e0020","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.762090Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:6ed3242a4ec78c27069b585df14ede407a289b8246851f76d8a921b6af4a68df","observation_id":"8abcf8e1-4e11-4a33-9cdb-0f8b3044170b","resolution":{"observed_at":"2026-08-07T05:54:42.112816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.098671Z","title":"Stylediffusion: Controllable disentangled style transfer via diffusion models","venue":null,"work_id":"8ee46377-154e-4906-8517-486e0ecd1fc3","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.765269Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:5b53825ae001f40b23159e9d8110644a5d48cc444b55c5f6a5ce6abbf25c3ca5","observation_id":"bb84141d-9300-4ff2-94b1-0d8685b6bd36","resolution":{"observed_at":"2026-08-07T05:54:42.102069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.088454Z","title":"Tokencompose: Text-to-image diffusion with token-level supervision","venue":null,"work_id":"b83d77bf-bf5b-4cd9-a441-ed7374a55d69","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.768745Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:20ce1c99f83e68f8c9e432176e898e31c07e6311a6793590ef7e3bd6ff8c5fb1","observation_id":"a14bdc14-0ffa-4f3e-a68a-c5838f2da39b","resolution":{"observed_at":"2026-08-07T05:54:42.092167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.077180Z","title":"Uncovering the disentanglement capability in text-to-image diffusion models","venue":null,"work_id":"16f78d32-c63e-4ec9-90ff-85298a18b1f1","year":1900},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.772124Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:7a54c66dfccf43da0bfd526fa17c05faefb94c1af16e6597960b86d042c389e7","observation_id":"ed390ec3-120b-4758-ad5b-fc8719bc20bc","resolution":{"observed_at":"2026-08-07T05:54:42.081287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.066342Z","title":"Deep convolutional neural network for image deconvolution","venue":null,"work_id":"9950fbc1-33e3-4017-88c7-09e9a474f519","year":2014},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.775459Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:a549dd462504129b6fe871276de447709510b9ccf89b55afe2d17c0940eedeba","observation_id":"accbf321-a149-4c81-9635-22a348f254ec","resolution":{"observed_at":"2026-08-07T05:54:42.070104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.055146Z","title":"Attngan: Fine-grained text to image generation with attentional generative adversarial networks","venue":null,"work_id":"b98880ec-6192-487d-93bf-57ae6788c7e0","year":2018},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.778508Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:10321a17fd32a0b1c0682cab14532ad4eae25f84517a62c8a4b70a9976e98518","observation_id":"59cc709f-691e-47b4-83e9-f7f84633e9f1","resolution":{"observed_at":"2026-08-07T05:54:42.058895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.044124Z","title":"Dynamic prompt learning: Addressing cross-attention leakage for text-based image editing","venue":null,"work_id":"0bc5b115-3afe-4ed1-bc0d-3550d8223913","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.781531Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:4ab99f98212397ea172c02a44272c3979a9ff22d495ea494ab3730bea4dc0fb6","observation_id":"1bde4031-f263-40fd-8b21-d6806516e025","resolution":{"observed_at":"2026-08-07T05:54:42.047995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-07T05:54:41.784685Z","title":"Ip-adapter: Text compatible image prompt adapter for text-to-image diffusion models.(2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.784685Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:438b41ae23a605c60b496b8ef8a4da541ea8a8e9563b640f8bf929a6644a319a","observation_id":"6675dd94-d1dc-4de3-8644-d4a835c910ad","resolution":{"observed_at":"2026-08-07T05:54:41.784685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.031758Z","title":"Semantic image inpainting with deep generative models","venue":null,"work_id":"939df083-ae94-48a9-8d4a-a4e3e3c33a0c","year":2017},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.788224Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:6b83a40375baf20448b8a30deba9f39e63074a7d36c08ec367165a76547d11d2","observation_id":"fdaeaade-c94a-4e4a-90f2-2bb6fe0503d9","resolution":{"observed_at":"2026-08-07T05:54:42.035646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.020482Z","title":"Generative image inpainting with contextual attention","venue":null,"work_id":"3b8b0265-8d08-41a5-a49c-daf7f5a6f5ca","year":2018},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.791461Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:7bfbfca662e473b9fec478ab74023a99c3b7de05c996aef43e6b5ea51f3fa1df","observation_id":"65a1e9f5-c12d-4529-a17b-fee1df272199","resolution":{"observed_at":"2026-08-07T05:54:42.024412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11430","last_updated":"2024-01-21T08:35:25Z","snapshot_observed_at":"2026-08-13T04:38:24.264758Z","submitted_at":"2024-01-21T08:35:25Z","title":"Exploring Diffusion Time-steps for Unsupervised Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11430","snapshot_observed_at":"2026-08-07T05:54:41.794804Z","title":"Exploring diffusion time-steps for unsupervised representation learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.794804Z"},"links":{"cited_paper":"/paper/2401.11430","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:afd29e203aeba6eb25f7703f0a2d7cb427b90577b68ab562fe42fea77b322a8d","observation_id":"d7a1635d-f20c-47bd-8fe3-c16760be4d50","resolution":{"observed_at":"2026-08-07T05:54:41.794804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.009241Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"4d628d8f-e54c-4577-a0b9-2f5a0cfc1347","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.798109Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:e7fb794c37eee80e9274de446473dd348fe378019b02f5ad83b56dcdacdb5a38","observation_id":"ad04b77d-2dc1-4c8c-8f61-7eecbabb2328","resolution":{"observed_at":"2026-08-07T05:54:42.013157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13077","last_updated":"2023-05-22T14:48:53Z","snapshot_observed_at":"2026-08-15T10:30:25.642027Z","submitted_at":"2023-05-22T14:48:53Z","title":"ControlVideo: Training-free Controllable Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13077","snapshot_observed_at":"2026-08-07T05:54:41.801190Z","title":"Controlvideo: Training-free controllable text-to-video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.801190Z"},"links":{"cited_paper":"/paper/2305.13077","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:e6862f5aa68ddf5f4ed35b161e636648f168327ed8f4b43cf76e1c03c3dbc8d8","observation_id":"3cd75832-ee52-4205-a91f-c9d317662a89","resolution":{"observed_at":"2026-08-07T05:54:41.801190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T07:36:18.134098Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":1,"verified_fuzzy":38},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 0 inbound Pith citation observations for arXiv:2506.06826."}