{"as_of":"2026-08-16T11:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3fec19d5a1c9c8f80b7963a13a7486774ae611c4a8ab8aeee12fa4212a2120d8","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:06:44.471345Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.10743/citation-record","integrity":"/paper/2505.10743/integrity","json":"/paper/2505.10743/citation-record.json","paper":"/paper/2505.10743"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-15T21:06:44.372321Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.372321Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:20fac75515a8c33421d6a7e2e8dca44fe9b7f8b0c322a219e9f7806d18433951","observation_id":"15df8658-24fa-489d-b412-b313f8514879","resolution":{"observed_at":"2026-08-15T21:06:44.372321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-15T21:06:44.375633Z","title":"Rinon Gal, Yuval Alaluf, Yuval Atzmon, Or Patashnik, Amit H","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.375633Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:259614fe0bce0a0833cffd3f4b03cce3b06076f25b40ed00a27bbad53401b603","observation_id":"472b20d6-ff5e-4b18-8da3-6a285ab84875","resolution":{"observed_at":"2026-08-15T21:06:44.375633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-15T21:06:44.389168Z","title":"Tero Karras, Samuli Laine, and Timo Aila","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.389168Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:6bb92c1525bf07fb414b27dedd11358096382e2f670a68c3bbc5d0807d699d7b","observation_id":"6497fd6b-d566-4886-974a-d885aee770d4","resolution":{"observed_at":"2026-08-15T21:06:44.389168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:44.392649Z","title":"Tero Karras, Samuli Laine, Miika Aittala, Janne Hellsten, Jaakko Lehtinen, and Timo Aila","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.392649Z"},"links":{"citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:8752e92faf20098334980bd7d65b40c246f23c2df6e85855c380d0fbf7156aab","observation_id":"b3ffee24-ef5d-4bfb-af4e-dcff81ba53df","resolution":{"observed_at":"2026-08-15T21:06:44.392649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:44.395788Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.395788Z"},"links":{"citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:58515dacfc19f189a0cd9390690332dc64e6700a6912818a0efee768cbb92249","observation_id":"0b32d475-b561-4136-b0c3-ee08a0fd3a23","resolution":{"observed_at":"2026-08-15T21:06:44.395788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.12423","last_updated":"2021-10-18T10:52:33Z","snapshot_observed_at":"2026-08-13T18:58:32.693622Z","submitted_at":"2021-06-23T14:20:01Z","title":"Alias-Free Generative Adversarial Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.12423","snapshot_observed_at":"2026-08-15T21:06:44.399031Z","title":"Alexander Kirillov, Eric Mintun, Nikhila Ravi, Hanzi Mao, Chloe Rolland, Laura Gustafson, Tete Xiao, Spencer Whitehead, Alexander C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.399031Z"},"links":{"cited_paper":"/paper/2106.12423","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:3220f3ffefee7e6147e4c9155db77625cdf177b8771549eb8733e31e286361f4","observation_id":"bf9fd8b0-d376-4154-9c8b-8c6b44339ce4","resolution":{"observed_at":"2026-08-15T21:06:44.399031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-15T21:06:44.402284Z","title":"Nupur Kumari, Bingliang Zhang, Richard Zhang, Eli Shechtman, and Jun-Yan Zhu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.402284Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:0246d844e59be96dc4f10452f7785b84b93125e803c60d13077998bf2a4a51fe","observation_id":"b9db18d2-244f-490d-bcdf-cf09c82636dd","resolution":{"observed_at":"2026-08-15T21:06:44.402284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14030","last_updated":"2021-08-17T16:41:34Z","snapshot_observed_at":"2026-08-13T19:24:14.214828Z","submitted_at":"2021-03-25T17:59:31Z","title":"Swin Transformer: Hierarchical Vision Transformer using Shifted Windows","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.14030","snapshot_observed_at":"2026-08-15T21:06:44.405276Z","title":"9 Published as a workshop paper at DeLTa Workshop (ICLR","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.405276Z"},"links":{"cited_paper":"/paper/2103.14030","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:9da01807be3e614bc632be0a458c6ba8810d9c1800f99e78957c932dd717a867","observation_id":"26c52e85-3c3b-4d44-b554-24b18721f3f9","resolution":{"observed_at":"2026-08-15T21:06:44.405276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05125","last_updated":"2023-03-09T09:16:04Z","snapshot_observed_at":"2026-08-13T12:28:32.854815Z","submitted_at":"2023-03-09T09:16:04Z","title":"Cones: Concept Neurons in Diffusion Models for Customized Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05125","snapshot_observed_at":"2026-08-15T21:06:44.408647Z","title":"Anish Mittal, Anush Krishna Moorthy, and Alan Conrad Bovik","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.408647Z"},"links":{"cited_paper":"/paper/2303.05125","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:9a7ccc3ea3491892160eb2939dde32f3f12ec364bd004d3e8c7a6f1a1037cbbf","observation_id":"f06d1d87-51b5-495f-90ce-8d8d6b13b0a2","resolution":{"observed_at":"2026-08-15T21:06:44.408647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.09672","last_updated":"2021-02-18T23:44:17Z","snapshot_observed_at":"2026-08-16T00:48:59.926421Z","submitted_at":"2021-02-18T23:44:17Z","title":"Improved Denoising Diffusion Probabilistic Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.09672","snapshot_observed_at":"2026-08-15T21:06:44.418282Z","title":"Yotam Nitzan, Kfir Aberman, Qiurui He, Orly Liba, Michal Yarom, Yossi Gandelsman, Inbar Mosseri, Yael Pritch, and Daniel Cohen-or","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.418282Z"},"links":{"cited_paper":"/paper/2102.09672","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:55bf9a1307fe75af8e87d7e4fcf44f2c967cf78fabd36174ab73f8f812936100","observation_id":"10358eea-a92d-454d-9b1c-619e33027748","resolution":{"observed_at":"2026-08-15T21:06:44.418282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17272","last_updated":"2022-10-06T17:59:14Z","snapshot_observed_at":"2026-08-14T03:31:22.750005Z","submitted_at":"2022-03-31T17:59:19Z","title":"MyStyle: A Personalized Generative Prior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17272","snapshot_observed_at":"2026-08-15T21:06:44.421138Z","title":"Dustin Podell, Zion English, Kyle Lacey, Andreas Blattmann, Tim Dockhorn, Jonas M ¨uller, Joe Penna, and Robin Rombach","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.421138Z"},"links":{"cited_paper":"/paper/2203.17272","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:beaf4f21d9fe1aebdb99f702e17f4f18bf2c378302673e8aae0025652e9c4f49","observation_id":"d8d07d2d-fcea-4853-b093-377bb18e1966","resolution":{"observed_at":"2026-08-15T21:06:44.421138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-15T21:06:44.424528Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.424528Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:f080fbc7fa93be3ead57393c904f9552b1f6767da493eb82c4e951aefa046941","observation_id":"666a1ce6-ad0b-4c17-8c9d-cc98af039288","resolution":{"observed_at":"2026-08-15T21:06:44.424528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-15T21:06:44.427617Z","title":"Aditya Ramesh, Mikhail Pavlov, Gabriel Goh, Scott Gray, Chelsea V oss, Alec Radford, Mark Chen, and Ilya Sutskever","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.427617Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:377f9a0b4f4d5c7d624b53a80c499c27b134b0a53b11ce01f06b40c03c29d4ca","observation_id":"337e2f2d-2f9a-479c-9f24-ab5d72f58bbf","resolution":{"observed_at":"2026-08-15T21:06:44.427617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.12092","last_updated":"2021-02-26T23:26:05Z","snapshot_observed_at":"2026-07-06T10:44:09.403787Z","submitted_at":"2021-02-24T06:42:31Z","title":"Zero-Shot Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.12092","snapshot_observed_at":"2026-08-15T21:06:44.430532Z","title":"Aditya Ramesh, Prafulla Dhariwal, Alex Nichol, Casey Chu, and Mark Chen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.430532Z"},"links":{"cited_paper":"/paper/2102.12092","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:5531fc2cca982bcac8b77b889843f09a453f97388ebcb858d6f55ab116565068","observation_id":"4aa9d947-798c-4e0f-a7b6-5bbff39e8e10","resolution":{"observed_at":"2026-08-15T21:06:44.430532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-15T21:06:44.433711Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.433711Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:217ca08fa2b48d75eec133975fef60ec7aa6b5b41faee3594d39075131e2416a","observation_id":"747a0dd3-1ade-46dd-90cc-6b10523cfe0f","resolution":{"observed_at":"2026-08-15T21:06:44.433711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10752","last_updated":"2022-04-13T11:38:44Z","snapshot_observed_at":"2026-07-06T12:20:47.369918Z","submitted_at":"2021-12-20T18:55:25Z","title":"High-Resolution Image Synthesis with Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10752","snapshot_observed_at":"2026-08-15T21:06:44.439724Z","title":"Olaf Ronneberger, Philipp Fischer, and Thomas Brox","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.439724Z"},"links":{"cited_paper":"/paper/2112.10752","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:7e080195958096a1d3146281c4e29c676e290994058510de2c7a968a728d6b24","observation_id":"2178cd22-4a9f-442e-bc86-349c2291ec75","resolution":{"observed_at":"2026-08-15T21:06:44.439724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.12242","last_updated":"2023-03-15T17:52:27Z","snapshot_observed_at":"2026-08-13T14:38:54.124751Z","submitted_at":"2022-08-25T17:45:49Z","title":"DreamBooth: Fine Tuning Text-to-Image Diffusion Models for Subject-Driven Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.12242","snapshot_observed_at":"2026-08-15T21:06:44.446234Z","title":"Nataniel Ruiz, Yuanzhen Li, Varun Jampani, Wei Wei, Tingbo Hou, Yael Pritch, Neal Wadhwa, Michael Rubinstein, and Kfir Aberman","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.446234Z"},"links":{"cited_paper":"/paper/2208.12242","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:25618ddab7153b24e6f20c7f6f6a708a74ff5d1446fa99749d5b78ff8ecabcd6","observation_id":"5789dafe-bb19-45c7-b297-0546c0202822","resolution":{"observed_at":"2026-08-15T21:06:44.446234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06949","last_updated":"2024-10-16T23:55:27Z","snapshot_observed_at":"2026-08-13T10:55:57.064533Z","submitted_at":"2023-07-13T17:59:47Z","title":"HyperDreamBooth: HyperNetworks for Fast Personalization of Text-to-Image Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06949","snapshot_observed_at":"2026-08-15T21:06:44.449775Z","title":"Chitwan Saharia, Jonathan Ho, William Chan, Tim Salimans, David J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.449775Z"},"links":{"cited_paper":"/paper/2307.06949","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:70aee059d463802664a62948983aea04775d62904ba16b88468e0be177e0a316","observation_id":"bed91aab-657e-44bc-bf5e-5f08b2c6420c","resolution":{"observed_at":"2026-08-15T21:06:44.449775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.07636","last_updated":"2021-06-30T07:34:57Z","snapshot_observed_at":"2026-08-13T19:39:13.324750Z","submitted_at":"2021-04-15T17:50:42Z","title":"Image Super-Resolution via Iterative Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.07636","snapshot_observed_at":"2026-08-15T21:06:44.452942Z","title":"Chitwan Saharia, William Chan, Huiwen Chang, Chris A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.452942Z"},"links":{"cited_paper":"/paper/2104.07636","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:3fc4a94c1d2c15d80c491e51e5ceef259903d41fa582555b78d05a0438e383f5","observation_id":"2223e4a7-7cda-4bb6-ad72-5d6b366db23d","resolution":{"observed_at":"2026-08-15T21:06:44.452942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03411","last_updated":"2023-04-06T23:26:38Z","snapshot_observed_at":"2026-08-15T02:33:47.682205Z","submitted_at":"2023-04-06T23:26:38Z","title":"InstantBooth: Personalized Text-to-Image Generation without Test-Time Finetuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03411","snapshot_observed_at":"2026-08-15T21:06:44.459251Z","title":"Jascha Sohl-Dickstein, Eric A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.459251Z"},"links":{"cited_paper":"/paper/2304.03411","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:008b6c91a8af64931ddd024fe6ce0df7bf505c9329124b13e0c82b6619a35df1","observation_id":"357b9ede-5083-43b7-b576-9b40f9b3c869","resolution":{"observed_at":"2026-08-15T21:06:44.459251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.03585","last_updated":"2015-11-18T21:50:51Z","snapshot_observed_at":"2026-07-06T04:11:47.439779Z","submitted_at":"2015-03-12T04:51:37Z","title":"Deep Unsupervised Learning using Nonequilibrium Thermodynamics","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.03585","snapshot_observed_at":"2026-08-15T21:06:44.462263Z","title":"Jiaming Song, Chenlin Meng, and Stefano Ermon","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.462263Z"},"links":{"cited_paper":"/paper/1503.03585","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:6d367e3a968e93eb12933499573fa8c11c98601b49609e9fb31278d71d371508","observation_id":"eb3ea67a-5265-4083-84c4-fb46e6f58ec7","resolution":{"observed_at":"2026-08-15T21:06:44.462263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-15T21:06:44.465375Z","title":"Yang Song and Stefano Ermon","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.465375Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:860ca7dc315d7e82f2a34a445fa2119c2330aa06c2503ffe32378eb81a67c465","observation_id":"21589c2d-27e3-408b-8d76-23d6458fb8ea","resolution":{"observed_at":"2026-08-15T21:06:44.465375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14007","last_updated":"2024-04-22T09:16:25Z","snapshot_observed_at":"2026-08-14T04:46:25.368906Z","submitted_at":"2024-04-22T09:16:25Z","title":"Infusion: Preventing Customized Text-to-Image Diffusion from Overfitting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14007","snapshot_observed_at":"2026-08-15T21:06:44.468305Z","title":"Shiwen Zhang, Shuai Xiao, and Weilin Huang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.468305Z"},"links":{"cited_paper":"/paper/2404.14007","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:aa168d26cc664a445c38c8d04dc31f9afb5d3fe29b8f531ed83371f676e0c9d7","observation_id":"a76b4593-f97a-4eb2-bfe4-e4e1f2e95ebe","resolution":{"observed_at":"2026-08-15T21:06:44.468305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10556","last_updated":"2024-03-17T16:55:07Z","snapshot_observed_at":"2026-08-16T07:14:48.667934Z","submitted_at":"2023-09-19T12:05:26Z","title":"Forgedit: Text Guided Image Editing via Learning and Forgetting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10556","snapshot_observed_at":"2026-08-15T21:06:44.471345Z","title":"A A PPENDIX A.1 B LURRING TECHNIQUES We integrated selective blurring of the main object in the base image before passing it to the img-to- img SDXL pipeline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.471345Z"},"links":{"cited_paper":"/paper/2309.10556","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:3e8791ef198fb4a3e479348ad213306e0e5f1951706022292cd5ac651dbb643a","observation_id":"ebe5de2b-8b47-4fd7-bf03-35e7cbfacbc3","resolution":{"observed_at":"2026-08-15T21:06:44.471345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:44.411802Z","title":"completely blind","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.411802Z"},"links":{"citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:742bab0513c12b8bfcdacfed082c52b1ab9d7e289caa53f15340aaf28d5a2cce","observation_id":"dc37d303-9df4-4b5d-a7e7-40a7505c39d9","resolution":{"observed_at":"2026-08-15T21:06:44.411802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:44.414864Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.414864Z"},"links":{"citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:f55f3262d861df81822a50b52959eadea311aff514545ce9f3a55d76fd81fd22","observation_id":"c5c2617d-1aee-4b7a-953f-659b225a1b43","resolution":{"observed_at":"2026-08-15T21:06:44.414864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1406.2661","last_updated":"2014-06-10T18:58:17Z","snapshot_observed_at":"2026-08-16T11:06:16.881602Z","submitted_at":"2014-06-10T18:58:17Z","title":"Generative Adversarial Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.2661","snapshot_observed_at":"2026-08-15T21:06:44.382613Z","title":"Jonathan Ho, Ajay Jain, and Pieter Abbeel","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.382613Z"},"links":{"cited_paper":"/paper/1406.2661","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:34d11254d89eb7bf0745c7f2aed149986f0608d38e3b15a590632d308b6ccc47","observation_id":"d0c5da51-11e3-434e-a1f5-cb8cf448be47","resolution":{"observed_at":"2026-08-15T21:06:44.382613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1505.04597","last_updated":"2015-05-18T11:28:37Z","snapshot_observed_at":"2026-08-15T21:30:31.645090Z","submitted_at":"2015-05-18T11:28:37Z","title":"U-Net: Convolutional Networks for Biomedical Image Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.04597","snapshot_observed_at":"2026-08-15T21:06:44.443060Z","title":"Nataniel Ruiz, Yuanzhen Li, Varun Jampani, Yael Pritch, Michael Rubinstein, and Kfir Aberman","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.443060Z"},"links":{"cited_paper":"/paper/1505.04597","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:0c773a6d06c736985ee0eb6828513826651a7dfedcd9e9e97c0f5f1c2d37bed4","observation_id":"6d15d24c-b2d7-4b2e-8e95-3d2a50edc4e8","resolution":{"observed_at":"2026-08-15T21:06:44.443060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.11096","last_updated":"2019-02-25T21:32:06Z","snapshot_observed_at":"2026-07-06T07:04:57.275371Z","submitted_at":"2018-09-28T15:38:49Z","title":"Large Scale GAN Training for High Fidelity Natural Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.11096","snapshot_observed_at":"2026-08-15T21:06:44.361439Z","title":"Tim Brooks, Aleksander Holynski, and Alexei A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.361439Z"},"links":{"cited_paper":"/paper/1809.11096","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:752980c344d3defb76af1185ffc56f5f45a97057eeafb66a57b88c2444eecf7a","observation_id":"455f48f2-b0b2-48e3-ac96-2921f8c14e33","resolution":{"observed_at":"2026-08-15T21:06:44.361439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11239","last_updated":"2020-12-16T21:15:05Z","snapshot_observed_at":"2026-08-10T05:21:27.485481Z","submitted_at":"2020-06-19T17:24:44Z","title":"Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11239","snapshot_observed_at":"2026-08-15T21:06:44.385907Z","title":"Edward J","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.385907Z"},"links":{"cited_paper":"/paper/2006.11239","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:557743957d94523f589b62327c68c42eb5b08477961e1102ccb59b6532c54193","observation_id":"7e780fc1-1a7b-421b-9680-6d8a9661c9cd","resolution":{"observed_at":"2026-08-15T21:06:44.385907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.14294","last_updated":"2021-05-24T17:49:18Z","snapshot_observed_at":"2026-08-04T11:32:10.695202Z","submitted_at":"2021-04-29T12:28:51Z","title":"Emerging Properties in Self-Supervised Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.14294","snapshot_observed_at":"2026-08-15T21:06:44.368780Z","title":"Jacob Devlin, Ming-Wei Chang, Kenton Lee, and Kristina Toutanova","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.368780Z"},"links":{"cited_paper":"/paper/2104.14294","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:0d202828814c20090970587ca7fe8401277408bcc23d171602a45b4b6aba306e","observation_id":"f0c40c19-54e3-4a82-be4e-9f3b47be4e58","resolution":{"observed_at":"2026-08-15T21:06:44.368780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-15T21:06:44.378948Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.378948Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:efe4c6246cf79757a87252d0c0bb0f59927f7aa47df6d42f1dafd36c10df3245","observation_id":"3d41cc41-bbe7-4d28-8bbb-2442384e0cd4","resolution":{"observed_at":"2026-08-15T21:06:44.378948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-13T13:40:09.134144Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-15T21:06:44.365413Z","title":"Mathilde Caron, Hugo Touvron, Ishan Misra, Herv ´e J ´egou, Julien Mairal, Piotr Bojanowski, and Armand Joulin","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.365413Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:12499f01dccb9197de7f5291d76fe42684ef29e40d28b185fcf5c38f7d204e1a","observation_id":"4b93ca34-00f3-4f49-aa6f-cb0bacb2aa0b","resolution":{"observed_at":"2026-08-15T21:06:44.365413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-15T21:06:44.436602Z","title":"Robin Rombach, Andreas Blattmann, Dominik Lorenz, Patrick Esser, and Bj ¨orn Ommer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.436602Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:4d853f559714aabb9ec0fafc6409b3ba9c227e6e2a0d364dd8f85a71ffada979","observation_id":"6b2c4936-0aa0-4a3f-9f00-109c86f6e257","resolution":{"observed_at":"2026-08-15T21:06:44.436602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11487","last_updated":"2022-05-23T17:42:53Z","snapshot_observed_at":"2026-08-12T12:48:35.419134Z","submitted_at":"2022-05-23T17:42:53Z","title":"Photorealistic Text-to-Image Diffusion Models with Deep Language Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11487","snapshot_observed_at":"2026-08-15T21:06:44.456067Z","title":"Sara Mahdavi, Rapha Gontijo Lopes, Tim Sal- imans, Jonathan Ho, David J Fleet, and Mohammad Norouzi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:44.456067Z"},"links":{"cited_paper":"/paper/2205.11487","citing_paper":"/paper/2505.10743"},"observation_digest":"sha256:5d162e23740cffccdb75317b0ea3838f033a69748c5fafe30d9b5d5f84dea846","observation_id":"e4ff8042-b9ff-439f-8ef1-f3d528aade30","resolution":{"observed_at":"2026-08-15T21:06:44.456067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.10743","last_updated":"2025-05-15T23:08:52Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T21:02:05.791789Z","submitted_at":"2025-05-15T23:08:52Z","title":"IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2505.10743."}