{"as_of":"2026-08-16T09:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ed3bf21ca724c1262fe6131b28ded870112f7f6187f27f081569f02ff8e0ea69","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:31:02.756764Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.13081/citation-record","integrity":"/paper/2412.13081/integrity","json":"/paper/2412.13081/citation-record.json","paper":"/paper/2412.13081"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.253916Z","title":"Blended diffusion for text-driven editing of natural images","venue":null,"work_id":"443c3690-e065-4360-999a-882c885d620d","year":2022},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.591194Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:346bd531f1062e08594318e6a3dc71c6188428560509ea028ef190b797ab46fb","observation_id":"8274cf53-3c7d-4fd2-b3f0-547115df5ec6","resolution":{"observed_at":"2026-08-11T13:31:03.258027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.243138Z","title":"Text2live: Text-driven layered image and video editing","venue":null,"work_id":"96154a51-509a-4f71-b6af-aeba4d2c8973","year":null},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.595540Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:79cd7531ab7d1351d4c974fd4c9f83c50e8b528eb568961133ed44dac447693d","observation_id":"dff19431-e511-4da8-9b31-905d4ef8a72a","resolution":{"observed_at":"2026-08-11T13:31:03.246884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.231305Z","title":"Inducing optimal at- tribute representations for conditional gans","venue":null,"work_id":"174ba2bc-c129-4bc1-966a-0d489230ad85","year":null},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.599284Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:df96987db91a9094bed6ea915b5cb36b184471b869243782f053439d86ab4291","observation_id":"c4326194-ab8e-46a4-8a09-6da174664600","resolution":{"observed_at":"2026-08-11T13:31:03.235042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.219296Z","title":"Auglabel: Exploiting word representations to augment labels for face attribute classification","venue":null,"work_id":"73511341-6896-44cb-a298-4dd704533a99","year":2020},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.603127Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:162b09b2faf62d9c8772b02a52fb54b32243464bcb9353a31d09220fff8e385e","observation_id":"e782a220-5f42-4a3b-a7cd-c75979dbafa5","resolution":{"observed_at":"2026-08-11T13:31:03.223079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.207494Z","title":"3d dense geometry-guided facial expression synthesis by adver- sarial learning","venue":null,"work_id":"4c4a6bba-f820-4dc8-becf-49c7690f6ea7","year":2021},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.607135Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:260d7fc97191d41c7b1a8464fea6501e9185011563aedadd448c2d69bf3fb6a4","observation_id":"c8542e7f-693d-477d-a1b5-d64edbb7b1db","resolution":{"observed_at":"2026-08-11T13:31:03.212058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.196152Z","title":"Joint training of hierarchical gans and semantic segmentation for expression translation","venue":null,"work_id":"b801e95a-ee6d-43b9-b559-6a0d448726b2","year":2023},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.611083Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:4992343edcf8d489c888eb5668aa5e79634357042cbb1007c88f830083a61b81","observation_id":"f312ea10-f9a6-4032-8a59-7286d493025f","resolution":{"observed_at":"2026-08-11T13:31:03.200136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05947","last_updated":"2023-05-10T07:39:14Z","snapshot_observed_at":"2026-08-15T15:43:00.528575Z","submitted_at":"2023-05-10T07:39:14Z","title":"iEdit: Localised Text-guided Image Editing with Weak Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.05947","snapshot_observed_at":"2026-08-11T13:31:02.615534Z","title":"iedit: Localised text-guided image editing with weak supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.615534Z"},"links":{"cited_paper":"/paper/2305.05947","citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:c3880ec22994ea0ff3ec1cb542083ac4f1d3cf20ebc342ba6b140a1cec24f4b3","observation_id":"525556e3-8622-4c70-9d12-4ec8f7c7a3dd","resolution":{"observed_at":"2026-08-11T13:31:02.615534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.185367Z","title":null,"venue":null,"work_id":"a21c25f3-99c6-495f-9dea-fa176846063e","year":2023},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.620025Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:787e1c8ed9b8203bfb665960ac3e2dc782a0dd3a6ae3e751e60da6c4a5688611","observation_id":"1a11cdf0-2343-4b99-85c6-ef82b074d589","resolution":{"observed_at":"2026-08-11T13:31:03.189310Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.173945Z","title":"Remix: Towards image-to-image translation with limited data","venue":null,"work_id":"5d857565-991b-4313-9833-bd7e75782826","year":null},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.624644Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:66ba1bc73f7c0ebdcc9bbd435baf4ce62fb5278bbd359e6d732371b95e435f20","observation_id":"63fde66c-433b-449a-afea-0a1d4f13d267","resolution":{"observed_at":"2026-08-11T13:31:03.177447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:02.628471Z","title":"Masactrl: Tuning-free mu- tual self-attention control for consistent image synthesis and editing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.628471Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:e9ca50e584c6f65e5a19815ebd69c7f9495e98693c8f880dbcd46d73c8d0084e","observation_id":"f00c5d85-623b-4ea4-be1c-f0bb0540c8df","resolution":{"observed_at":"2026-08-11T13:31:02.628471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.153539Z","title":"DiffEdit: Diffusion-based Semantic Image Editing with Mask Guidance","venue":null,"work_id":"a2856dc4-92c6-40ff-bce0-ee5ea4200dd3","year":2023},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.632290Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:a8762b166c0ac3982f654c00afee7e095eb5fce05e1f5f3809d7576babffe2e7","observation_id":"4586e0a8-5e7b-47f6-a020-33a4007965ee","resolution":{"observed_at":"2026-08-11T13:31:03.157748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.141008Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"5f3e878e-beee-469c-add4-07f51bf4f910","year":2009},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.635981Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:d63a3e3f85cd478d3652d8164620d46902cf86f1ed31e0c17de13a4cd9f1bf23","observation_id":"c1c9c79c-6818-4dc8-b709-091844d16a50","resolution":{"observed_at":"2026-08-11T13:31:03.145364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.127736Z","title":"Bert: Pre-training of deep bidirectional trans- formers for language understanding","venue":null,"work_id":"81486e6f-8081-4547-bd77-c1b15c3ce11a","year":2019},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.640030Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:190a5ebdf62fcbd537d0eec99673f5e753bc0eadc0dba8c4748297a99faff66c","observation_id":"1bbb70b9-be0c-4877-b8bd-94b45e100386","resolution":{"observed_at":"2026-08-11T13:31:03.131953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.116682Z","title":"Deep em- bedding learning with discriminative sampling policy","venue":null,"work_id":"547cc732-4c80-4654-927d-a766bcbc8f63","year":2019},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.644469Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:eba0b30e22ab629ff0197c97a1d35e472bc2c317ff53c470d77f778e0e8c47a5","observation_id":"52f45b05-51be-4648-af08-66c964b86f36","resolution":{"observed_at":"2026-08-11T13:31:03.120536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.104360Z","title":"Diffusion self-guidance for control- lable image generation","venue":null,"work_id":"1e0d4714-cc65-4de8-a2f2-6b61f16910ad","year":2023},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.648120Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:652153faec69c546370eb4eb83bec8553cd960facd97bb60693c0956034cc724","observation_id":"3747d161-77cb-403e-a936-cec534663761","resolution":{"observed_at":"2026-08-11T13:31:03.108669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.091999Z","title":"Prompt-to-prompt image editing with cross attention control","venue":null,"work_id":"0a825560-0328-46bc-ba61-61ab9aecd9e6","year":2022},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.652606Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:acf273bb5c18c6773b96edd744a19cfeb9b6c1a546b608c8f72925f3b19e4b05","observation_id":"75fcc0c0-dc2b-415c-b21d-36e59c25ac15","resolution":{"observed_at":"2026-08-11T13:31:03.096425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:02.656073Z","title":"Clipscore: A reference-free evaluation met- ric for image captioning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.656073Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:a00abfe10e3d03254fa07aa6191cd8615c17904b2998abd5e6fdd365cbd14e73","observation_id":"1a37e329-4b02-4b3f-a503-4a78479c656c","resolution":{"observed_at":"2026-08-11T13:31:02.656073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.074800Z","title":"Imagic: Text-based real image editing with diffusion models","venue":null,"work_id":"120602d7-0f34-4055-a9f9-23a484aef122","year":2023},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.659777Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:36f37465f9b5def962774eca17e2dec596b81b282a8a8526ad2f81ebaff59203","observation_id":"f9ddc13f-5e3d-4be1-a3c6-527f3d6ee2b9","resolution":{"observed_at":"2026-08-11T13:31:03.078833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.064170Z","title":"Dif- fusionclip: Text-guided diffusion models for robust image manipulation","venue":null,"work_id":"91790786-1e94-4d7a-ba47-22168e2caf90","year":2022},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.663546Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:3878eea23567c27b914c1f3d99c05b0cfc799d17c7b51c80ea42d54961f5071d","observation_id":"755f88c5-4779-4cad-8e7f-77c4fd2f0a05","resolution":{"observed_at":"2026-08-11T13:31:03.067922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.053581Z","title":"Arbitrary-scale image generation and upsampling using latent diffusion model and implicit neural decoder","venue":null,"work_id":"56c226aa-0804-4bcc-8557-efbb9a1aedd1","year":2024},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.667150Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:2f83f75d8ccb861b5206b8e1a604db4f3814c085575de7ef77e64ad67647808c","observation_id":"f6e78f56-340a-45eb-a040-5e9c78141f38","resolution":{"observed_at":"2026-08-11T13:31:03.057538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.040606Z","title":"Deep metric learning beyond binary supervi- sion","venue":null,"work_id":"884f96c3-af0d-47a2-bcbd-6864612fdff1","year":2019},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.671347Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:0702c63ed323c648d5c9e0278fcb9717ca6f3735d9840b17f68cfd265e1cc308","observation_id":"5c17d192-89f9-435e-add8-67057d7bcfab","resolution":{"observed_at":"2026-08-11T13:31:03.045320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.029422Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":"795e85d0-2c75-4649-8b3e-b6707138fdea","year":2022},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.675984Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:0599f757b83495a975c31c5756e701f5bbe6051479185f801aa04c13ad906e07","observation_id":"3e10fb18-8530-472c-912d-525aa00f3fb7","resolution":{"observed_at":"2026-08-11T13:31:03.033262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.017955Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":"29616af3-b2c2-4886-a592-3a82d3607f49","year":2014},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.679580Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:7bc026134416ee011dc02a8d77bd05da34cde56847d9ce745093b8e02b9ee299","observation_id":"1a8086db-abfe-48b8-b999-83c3f58fb0c4","resolution":{"observed_at":"2026-08-11T13:31:03.022116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04651","last_updated":"2023-05-08T12:08:12Z","snapshot_observed_at":"2026-08-15T11:04:44.546735Z","submitted_at":"2023-05-08T12:08:12Z","title":"ReGeneration Learning of Diffusion Models with Rich Prompts for Zero-Shot Image Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04651","snapshot_observed_at":"2026-08-11T13:31:02.683139Z","title":"Regeneration learning of diffusion models with rich prompts for zero-shot image translation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.683139Z"},"links":{"cited_paper":"/paper/2305.04651","citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:b6aef72ceafa8e883d4f2df196ed7d4c9a63a9ecfddcc6fc89da3b0a1fb2862c","observation_id":"6392ae18-8f6b-4ff0-84cc-3035016e4918","resolution":{"observed_at":"2026-08-11T13:31:02.683139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12073","last_updated":"2023-04-26T15:41:05Z","snapshot_observed_at":"2026-08-13T12:56:09.203802Z","submitted_at":"2023-01-28T03:10:33Z","title":"Towards Equitable Representation in Text-to-Image Synthesis Models with the Cross-Cultural Understanding Benchmark (CCUB) Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12073","snapshot_observed_at":"2026-08-11T13:31:02.686950Z","title":"Towards equitable representation in text-to-image synthesis models with the cross-cultural un- derstanding benchmark (ccub) dataset","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.686950Z"},"links":{"cited_paper":"/paper/2301.12073","citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:403176f4425c9bbe6c0e1ab2e222b227570970f3bf9187882e15c41973c4bd5d","observation_id":"b0a6b698-d5d0-42fe-957a-e034dbebe29f","resolution":{"observed_at":"2026-08-11T13:31:02.686950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:03.006083Z","title":"Spe- cialist diffusion: Plug-and-play sample-efficient fine-tuning of text-to-image diffusion models to learn any unseen style","venue":null,"work_id":"09a9738c-105a-46e9-bb47-6748df9dcc0b","year":2023},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.690895Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:e62eacc3e5519ccfaad0737fc75f25303399c20e0506d1aa47385c032b698fe9","observation_id":"158dc0a9-51d5-4711-860a-e433120142a3","resolution":{"observed_at":"2026-08-11T13:31:03.010772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:02.994747Z","title":"Sdedit: Guided image synthesis and editing with stochastic differential equa- tions","venue":null,"work_id":"ba5361d7-766f-49f8-b464-944a5912b0e3","year":2022},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.694198Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:8d0dbbd0179db72ee546f367c57f221664131118766ef2cd48f48b7edd41d286","observation_id":"281643c6-863b-4543-ba24-1e901d03d63b","resolution":{"observed_at":"2026-08-11T13:31:02.998910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:02.982746Z","title":"Benchmark for compositional text-to- image synthesis","venue":null,"work_id":"f0f86bae-604b-4d79-b7ee-b482a5aef3c5","year":2021},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.697702Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:619e946476412c19fec2453358ec1134b9185f8e6d48ce6303235a63774b1889","observation_id":"7145d155-5095-49e8-91df-88d679fa4c78","resolution":{"observed_at":"2026-08-11T13:31:02.986866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:02.970066Z","title":"Efros, Richard Zhang, and Jun-Yan Zhu","venue":null,"work_id":"83ebe4af-7d62-4269-8db5-755f5fb84dc4","year":2020},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.701313Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:1be038eda3a2183ca34324ddd41116cda69c42b5f04c8800e6712522b0e4fdd4","observation_id":"2ff74083-0b62-4ddd-a4ef-6144ea0fcee8","resolution":{"observed_at":"2026-08-11T13:31:02.973722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:02.959077Z","title":"Zero-shot image-to-image translation","venue":null,"work_id":"976fe718-ffe4-46a6-a9b8-682e9cea5ab7","year":2023},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.706178Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:1add8de104e6f9a4f79022bbaae6b65f7b6297ee385ff33a49f438f8a1a44344","observation_id":"265e9b7e-5686-4825-9ffd-a57dba2798c0","resolution":{"observed_at":"2026-08-11T13:31:02.962951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-11T13:31:02.709834Z","title":"Hierarchical text-conditional image gen- eration with clip latents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.709834Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:f3b2c51bb5a922961522c62ee5f1bb2bd3d4e96fdb8074bf28f27599dda4f118","observation_id":"439ae406-6900-4bc4-9fbe-a15c4db91aaa","resolution":{"observed_at":"2026-08-11T13:31:02.709834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:02.946902Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"01f2bcea-7941-4911-bc13-def10c6bf516","year":2022},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.713856Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:f8a7fc13dac43a1a86aec14dba6793afb1748fb6835b26a9719eeea8f9052698","observation_id":"7ac8d6aa-de60-4476-aef1-490f2c7a1e94","resolution":{"observed_at":"2026-08-11T13:31:02.951240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:02.935526Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":"b261f294-f699-468d-8773-dfa6ba641b24","year":2015},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.718417Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:f63d8638d2221fda77170e39f4dfd3a5f93b264a53c8a306f33e0149a8148407","observation_id":"9d63d850-6ae8-4a1c-b559-fdfe3375f29b","resolution":{"observed_at":"2026-08-11T13:31:02.939553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.12242","last_updated":"2023-03-15T17:52:27Z","snapshot_observed_at":"2026-08-13T14:38:54.124751Z","submitted_at":"2022-08-25T17:45:49Z","title":"DreamBooth: Fine Tuning Text-to-Image Diffusion Models for Subject-Driven Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.12242","snapshot_observed_at":"2026-08-11T13:31:02.722043Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.722043Z"},"links":{"cited_paper":"/paper/2208.12242","citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:d6a5fc3a498e2d66264d19644d7fe5a41b0e4a4007b95fd9b0c5a0a9440532ae","observation_id":"8a20317b-03b5-4233-9001-a19a496b5035","resolution":{"observed_at":"2026-08-11T13:31:02.722043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:02.923800Z","title":"Gordon, Ross Wightman, Mehdi Cherti, Theo Coombes, Aarush Katta, Clayton Mullis, Mitchell Worts- man, Patrick Schramowski, Srivatsa R","venue":null,"work_id":"296d9539-4560-410d-ab5e-51415f7f5e81","year":2022},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.726072Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:ce0151646f06700313592eb2ad187f361737ae8b13a8af705d03637a1826dc7c","observation_id":"9cb0ca9b-3473-49b5-aa50-b0b9ebeb9f3f","resolution":{"observed_at":"2026-08-11T13:31:02.927800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:02.729981Z","title":"pytorch-fid: FID Score for PyTorch","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.729981Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:25e6592669c37fc892ee1667180afdc1877412aecb36db10cbd6ba7366f7ab59","observation_id":"2ef9e001-6df3-4205-88d3-746b2257afad","resolution":{"observed_at":"2026-08-11T13:31:02.729981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:02.904903Z","title":"High- fidelity guided image synthesis with latent diffusion models","venue":null,"work_id":"1d085d89-17e8-4586-9334-aed56869026a","year":2023},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.734049Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:ac337b0353ecd4dcf66f8731a581bc748d84f89e5fc013777837e51d6a92dcfa","observation_id":"20a7166d-8281-4740-b4e4-fe9c6db178f2","resolution":{"observed_at":"2026-08-11T13:31:02.908869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:02.893345Z","title":"Soft contrastive learning for visual localization","venue":null,"work_id":"cbb5f78a-c4aa-446b-865b-7ddd29802952","year":2020},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.737873Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:ee5d900d85553f10a547d947d8d6292182ae29b646836e4247194952a8fcf5bd","observation_id":"25d6a8ec-c1e4-4407-85fa-c5511d93ca70","resolution":{"observed_at":"2026-08-11T13:31:02.897139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12572","last_updated":"2022-11-22T20:39:18Z","snapshot_observed_at":"2026-08-15T09:45:42.001814Z","submitted_at":"2022-11-22T20:39:18Z","title":"Plug-and-Play Diffusion Features for Text-Driven Image-to-Image Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12572","snapshot_observed_at":"2026-08-11T13:31:02.741748Z","title":"Plug-and-play diffusion features for text- driven image-to-image translation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.741748Z"},"links":{"cited_paper":"/paper/2211.12572","citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:66a6e1a1af70c6c44c5d71a6b514ddc86d37d4d95d8e6fae8aff687931cd5de6","observation_id":"c014c163-f73a-4cfc-bde5-587e74f9f0f6","resolution":{"observed_at":"2026-08-11T13:31:02.741748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:02.881704Z","title":"Fleet, Radu Soricut, Jason Baldridge, Mo- hammad Norouzi, Peter Anderson, and William Chan","venue":null,"work_id":"42932169-28ed-4916-9ebb-a523003aa4c2","year":2023},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.745784Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:279ced08e644cb5c651b538a6ab7ae77c8f5fbf98b75c0a8ad90d9493ea88e12","observation_id":"1bcee73b-bc2f-4ec1-9c09-036ace153b2a","resolution":{"observed_at":"2026-08-11T13:31:02.885611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:02.869693Z","title":"A latent space of stochastic diffusion models for zero-shot image editing and guidance","venue":null,"work_id":"49dbeaef-74a4-4bc5-b6af-9066daff6aca","year":null},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.749315Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:eba6dbcb71ce3f4e853448c897a75c8f16b83719beb132516a8928ede2a2469a","observation_id":"6c97ecd7-1fe1-400f-a1b4-87cc661f5aa2","resolution":{"observed_at":"2026-08-11T13:31:02.874107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:31:02.855512Z","title":"Cross-modal contrastive learning for text-to- image generation","venue":null,"work_id":"c01f190a-2534-4821-8568-f73eaac14222","year":2021},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.753165Z"},"links":{"citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:edae2d2ff0467f9d082af845f37e918d45926ed7f120efffec3d7e93eb8e5a50","observation_id":"7d56e322-6f35-41f0-b17f-1af7c59641fa","resolution":{"observed_at":"2026-08-11T13:31:02.861431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.02595","last_updated":"2020-06-04T00:16:02Z","snapshot_observed_at":"2026-08-03T14:35:18.390848Z","submitted_at":"2020-06-04T00:16:02Z","title":"Image Augmentations for GAN Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.02595","snapshot_observed_at":"2026-08-11T13:31:02.756764Z","title":"Image augmentations for gan training","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T13:31:02.756764Z"},"links":{"cited_paper":"/paper/2006.02595","citing_paper":"/paper/2412.13081"},"observation_digest":"sha256:3c1113a3534c34273c1d1d77272840502c1f6f887e095e6d103ef1c84542c52c","observation_id":"8eb93850-5244-4e94-b795-b83265a09c5f","resolution":{"observed_at":"2026-08-11T13:31:02.756764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.13081","last_updated":"2024-12-17T16:54:05Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T09:45:58.329244Z","submitted_at":"2024-12-17T16:54:05Z","title":"Prompt Augmentation for Self-supervised Text-guided Image Manipulation"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":32},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2412.13081."}