{"as_of":"2026-08-09T19:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:94d54faae5cd7d82cdb854491a1a6c54ac92baf8f5a488552ebe4f987fa7b0a8","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:48:35.908863Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.20909/citation-record","integrity":"/paper/2505.20909/integrity","json":"/paper/2505.20909/citation-record.json","paper":"/paper/2505.20909"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:40.269535Z","title":"High- resolution image synthesis with latent diffusion models,","venue":null,"work_id":"c79a2c03-62c9-4e20-bb9a-f0c4cd286b88","year":2022},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:33.386159Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:0f7f1fa94ca280fee32404cfde6fcb0189eaa29c0c2635591e000903040e739b","observation_id":"c348abd5-6460-4ca8-a46b-52eafef98d75","resolution":{"observed_at":"2026-08-07T13:48:40.404666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:39.992519Z","title":"TRIP: Temporal Residual Learning with Image Noise Prior for Image-to-Video Diffusion Models,","venue":null,"work_id":"f215ec6a-1058-43a7-aaf9-d481a6bb025c","year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:33.474528Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:d030fd813113e8f12cf6ce44ffd911b3f3cda84ae18deb5d855ffea89791c641","observation_id":"26a7605a-4054-407f-981a-8ac79d29763b","resolution":{"observed_at":"2026-08-07T13:48:40.134070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:39.766180Z","title":"MotionPro: A Precise Motion Controller for Image-to-Video Generation,","venue":null,"work_id":"f9b79c6d-cb5a-42cd-8a78-bd5da858687b","year":2025},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:33.589031Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:bf5b5084f2c4274bdbf2959bbb27a9305eb0fc8c2341d71acb44db041b82c817","observation_id":"5bb18277-1c48-40a1-84c4-b4fe440dd5fd","resolution":{"observed_at":"2026-08-07T13:48:39.876686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:39.524050Z","title":"An image is worth one word: Personalizing text-to-image generation using textual inversion,","venue":null,"work_id":"22b4e990-bfee-42f8-8249-886521725f18","year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:33.738311Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:991a44652e53a1cd1408e3e23f5c4062adf7b465e35f2e1c35194ebb60abad69","observation_id":"22c6a66e-5de6-46e7-bde5-8fedde2ed8a1","resolution":{"observed_at":"2026-08-07T13:48:39.635937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:39.255460Z","title":"Dreambooth: Fine tuning text-to- image diffusion models for subject-driven generation,","venue":null,"work_id":"bb5adac0-85eb-4867-b3d0-df81be56ead9","year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:33.832069Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:2b4778a36c1e76de75a527f84d794b6ffa9398ba4cfc816074f28339affcb14c","observation_id":"742c8803-9113-4b15-ac20-b7b8464716fc","resolution":{"observed_at":"2026-08-07T13:48:39.367858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:38.944832Z","title":"Multi-concept customization of text-to-image diffusion,","venue":null,"work_id":"c22faae0-b34d-478b-a16c-a0fb09e7d936","year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:33.957635Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:9738ac816942b48f686845ec32b75139c96d802b58d2c169feb5618cd9f17d34","observation_id":"e4c96d64-81e2-435e-a482-890d2d36d444","resolution":{"observed_at":"2026-08-07T13:48:39.086919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:38.703225Z","title":"Ssr-encoder: Encoding selective subject representation for subject-driven generation,","venue":null,"work_id":"be65e02e-7088-4966-974c-2e05673d4826","year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:33.992942Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:1ec292ec0856b1e17424211344aee4ae53cbf88caa9bbbfd6109b4fc98a9ea81","observation_id":"52aaa2b9-cb12-4240-bf55-86607696c232","resolution":{"observed_at":"2026-08-07T13:48:38.800091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:38.432726Z","title":"Blip-diffusion: Pre-trained subject representation for controllable text-to-image generation and editing,","venue":null,"work_id":"308d7af9-0713-45a8-81de-4e1d9bc3f040","year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.033547Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:f5815345e8cfda68764cb013a5c077e58bb61d3010dd671243485a4a46bb670c","observation_id":"8af1e7b6-2f03-410a-a01d-dce5a9be7c2e","resolution":{"observed_at":"2026-08-07T13:48:38.550719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:38.177903Z","title":"Generative multimodal models are in- context learners,","venue":null,"work_id":"5f6f52cc-1591-425a-9f3a-e813d8c30413","year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.104135Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:c737d733b6ac37e6082c180a368dfff6fcef607f9c123e2d36a5de98ad2b76fe","observation_id":"eec0c16d-21bc-44c5-9bbe-506982e15ce7","resolution":{"observed_at":"2026-08-07T13:48:38.327398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02992","last_updated":"2024-04-26T01:24:57Z","snapshot_observed_at":"2026-07-06T16:27:47.445841Z","submitted_at":"2023-10-04T17:28:44Z","title":"Kosmos-G: Generating Images in Context with Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02992","snapshot_observed_at":"2026-08-07T13:48:34.203912Z","title":"Kosmos-g: Generating images in context with multimodal large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.203912Z"},"links":{"cited_paper":"/paper/2310.02992","citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:c620c1b5d56e881777b312540ebc3e57d88b06c6ed7af14c3218dd2994ef27dc","observation_id":"c3a3fb72-17da-4008-a3fc-acab907f9fec","resolution":{"observed_at":"2026-08-07T13:48:34.203912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:37.905409Z","title":"Instancediffusion: Instance-level control for image generation,","venue":null,"work_id":"ec0ca248-da9d-42e3-a00d-6f0c2682bc8c","year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.254379Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:17867cc4e78c8550c6a5c123dfe46f8d3f0a6266ce739d66158bcaa9e8ce80b1","observation_id":"e96bcf18-40bc-4b62-b569-891094033f2d","resolution":{"observed_at":"2026-08-07T13:48:38.028216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-07T13:48:34.323871Z","title":"Ip-adapter: Text compatible image prompt adapter for text-to-image diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.323871Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:45518818fba9f9cb54cd029256babcaa3aa704f73d40474db702aa5309d768c1","observation_id":"edf20545-e900-4265-adb5-ac7574cac077","resolution":{"observed_at":"2026-08-07T13:48:34.323871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05195","last_updated":"2024-04-09T22:14:37Z","snapshot_observed_at":"2026-08-07T14:37:15.434465Z","submitted_at":"2024-02-07T19:07:10Z","title":"$\\lambda$-ECLIPSE: Multi-Concept Personalized Text-to-Image Diffusion Models by Leveraging CLIP Latent Space","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05195","snapshot_observed_at":"2026-08-07T13:48:34.424437Z","title":"λ- eclipse: Multi-concept personalized text-to-image diffusion models by leveraging clip latent space,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.424437Z"},"links":{"cited_paper":"/paper/2402.05195","citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:d645ba9b776e97fc81bdf2293f8e35a3223ac7eed0c7adb5b44604c083bf092f","observation_id":"5ffda3e5-f2de-4fe0-9615-ebf98a369428","resolution":{"observed_at":"2026-08-07T13:48:34.424437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:37.699471Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"becff80c-23b5-40f8-bbdb-6bf5a1d95f6a","year":2021},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.542654Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:e25c6c8f0cd9a7c922980898af91ce0fd7328cd96192aa2e8e87fa942939bf07","observation_id":"0bebb68c-7160-440d-9d48-2e403e5d86e2","resolution":{"observed_at":"2026-08-07T13:48:37.787586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09481","last_updated":"2024-05-08T03:21:34Z","snapshot_observed_at":"2026-08-09T10:44:37.868390Z","submitted_at":"2023-07-18T17:59:02Z","title":"AnyDoor: Zero-shot Object-level Image Customization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09481","snapshot_observed_at":"2026-08-07T13:48:34.680927Z","title":"Anydoor: Zero-shot object-level image customization,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.680927Z"},"links":{"cited_paper":"/paper/2307.09481","citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:8e3c3303eaa82d5d66c98f368d37ad0916b01be2259a58f9e4d85713dc48dd3f","observation_id":"8ffa62a7-eafc-4385-aba8-9c8474f19a33","resolution":{"observed_at":"2026-08-07T13:48:34.680927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07209","last_updated":"2025-03-04T06:21:26Z","snapshot_observed_at":"2026-07-06T18:28:51.180903Z","submitted_at":"2024-06-11T12:32:53Z","title":"MS-Diffusion: Multi-subject Zero-shot Image Personalization with Layout Guidance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07209","snapshot_observed_at":"2026-08-07T13:48:34.780116Z","title":"Ms- diffusion: Multi-subject zero-shot image personalization with layout guidance,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.780116Z"},"links":{"cited_paper":"/paper/2406.07209","citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:b83756da6d3c91fa64c023aad6e95bc992ebca52c9c82763e8085ebc32e7165e","observation_id":"f9fc5dca-64d6-4fd3-ac47-eb9cc2073c7c","resolution":{"observed_at":"2026-08-07T13:48:34.780116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:34.831272Z","title":"Adding conditional control to text-to-image diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.831272Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:1a2969bc8f88ee4df338890ae6632956622f47290404b67441ec10f81aea0c61","observation_id":"7317e420-0fc7-42cd-99bd-24eacbb74771","resolution":{"observed_at":"2026-08-07T13:48:34.831272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:37.506778Z","title":"Layoutdiffusion: Controllable diffusion model for layout-to-image generation,","venue":null,"work_id":"be385f17-a1a3-43db-96a4-882120e06156","year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.922080Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:3e38f376863db97a0456f63179d216c08f97309fa3d5995250a9ae57c4246f9c","observation_id":"4c3e7534-910f-4107-aa70-0f7f1c5e4c38","resolution":{"observed_at":"2026-08-07T13:48:37.563702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:35.031893Z","title":"Gligen: Open-set grounded text-to-image generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.031893Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:fa0f76c75d20e25c83345df1c9bd9d965b860f54ab24c1453a9f0e47efb0b8fa","observation_id":"cd9dda3d-d91a-42f8-8de2-515769dda517","resolution":{"observed_at":"2026-08-07T13:48:35.031893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:37.241248Z","title":"Training-free layout control with cross-attention guidance,","venue":null,"work_id":"12276351-caf0-4d9e-8952-6e52e67bca50","year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.145813Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:8c85533081bbeb89194f0d68d13601e5ddb38ff213d396f15c42d9ce3014868e","observation_id":"2d86ae8a-24c5-44b4-8b14-f28400fb0224","resolution":{"observed_at":"2026-08-07T13:48:37.384930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:37.102919Z","title":"Boxdiff: Text-to-image synthesis with training-free box-constrained diffusion,","venue":null,"work_id":"17419297-deca-438c-964d-ef3d97a47c29","year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.246863Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:4d9399a4701e42b3a93a35989b2b254a6bb802ca5daf2c9ef198865e80251799","observation_id":"cbc2de7e-2525-41c2-86c7-f78454cc78be","resolution":{"observed_at":"2026-08-07T13:48:37.184320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:36.952090Z","title":"Segment anything,","venue":null,"work_id":"324e5b1b-8366-45b3-84df-23bcf220179d","year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.366089Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:af23f47b337ae420936dc265f84d515b84b72ec96f4b04094e69be16a42e7348","observation_id":"362291ea-99af-4558-b3fa-446df2ac9510","resolution":{"observed_at":"2026-08-07T13:48:36.998320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:36.739841Z","title":"Flamingo: a visual language model for few-shot learning,","venue":null,"work_id":"4483f3c5-6683-4a1e-95c8-e6b269161e2c","year":2022},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.486664Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:8618225635d845df45e504ff4a5cb135d1884c7305978325eff5dbe77b5527a7","observation_id":"d2560623-8c75-4ff0-b8ef-d8ba3a464216","resolution":{"observed_at":"2026-08-07T13:48:36.810479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:36.472912Z","title":"Moma: Multimodal llm adapter for fast personalized image generation,","venue":null,"work_id":"9d67e183-7388-456d-88f7-0df609e4d06b","year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.583537Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:0a456a8193f1cf38f5d9873da4957e001891aa8d7ac22ef85afe82dea7403a91","observation_id":"f949f0bc-1185-4ac4-8c49-be374de90ac8","resolution":{"observed_at":"2026-08-07T13:48:36.566877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:36.305241Z","title":"Coco-stuff: Thing and stuff classes in context,","venue":null,"work_id":"e6fe340d-1809-4b4b-846f-630fb9fa8a0b","year":2018},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.647233Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:8ddd515b940e175a457d3a3d428a22d2b7a72fc6c858ef61427408395ff966a7","observation_id":"d3902ba2-2b04-482a-ab5c-c793de3bc6a4","resolution":{"observed_at":"2026-08-07T13:48:36.366437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:36.105712Z","title":"The open images dataset v4: Unified image classification, object detection, and visual relationship detection at scale,","venue":null,"work_id":"e00e6f9e-eeba-498e-b1c3-bc4c80321aa0","year":2020},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.760399Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:df892212448467bb76935833cb36dacc662f0472db9611b878a0155d782daeb7","observation_id":"c9d062ff-09f2-419f-bb80-5f8df0e6b607","resolution":{"observed_at":"2026-08-07T13:48:36.219074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03459","last_updated":"2024-06-05T17:07:24Z","snapshot_observed_at":"2026-07-06T18:26:01.717861Z","submitted_at":"2024-06-05T17:07:24Z","title":"LW-DETR: A Transformer Replacement to YOLO for Real-Time Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03459","snapshot_observed_at":"2026-08-07T13:48:35.843367Z","title":"Lw-detr: A transformer replacement to yolo for real-time detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.843367Z"},"links":{"cited_paper":"/paper/2406.03459","citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:df847642918f8d2510ac9790b9023f97b06d09fdd82e3b545f3ca4ad19524e40","observation_id":"95a8d426-622c-4254-a8c7-3bb79f77ee92","resolution":{"observed_at":"2026-08-07T13:48:35.843367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-09T18:02:17.307812Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-07T13:48:35.908863Z","title":"Dinov2: Learning robust visual features without supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.908863Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:3a1d50d64861b4cbbdad66281dde368d262b67fa1055d29295db65b18ecab791","observation_id":"d0dd19e8-53fd-41ef-93e8-0723dbe878f5","resolution":{"observed_at":"2026-08-07T13:48:35.908863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T21:30:55.452623Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2505.20909."}